CN · 23/08

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)@argofowl
Sản phẩm75

Anthropic thử nghiệm A/B thay đổi mức độ xử lý công việc trên Claude Code

Anthropic đang thực hiện thử nghiệm A/B trên Claude Code 2.1.236+ bằng cách điều chỉnh quy mô các mức độ xử lý (effort). Nếu bạn thấy mức "high" hiện tại có hiệu suất tương đương mức "low", có khả năng bạn đang nằm trong nhóm thử nghiệm này.

AnthropicClaude CodeAIThử nghiệmCông cụ lập trình
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Task-CoEvolve: Tối ưu hóa chi phí đánh giá AI Agent bằng phương pháp chọn lọc bài kiểm tra thích ứng

Nghiên cứu từ Đại học Tokyo giới thiệu Task-CoEvolve, phương pháp giúp cắt giảm 67-80% chi phí đánh giá AI Agent bằng cách chỉ tập trung vào các bài kiểm tra có độ phân hóa cao, thay vì chạy toàn bộ tập dữ liệu dư thừa.

AI AgentĐánh giá AITối ưu chi phíNghiên cứu AITask-CoEvolve
Gary Marcus: The Road to AI We Can Trust
Thủ thuật85

Cẩn trọng với chỉ số ARR: Đừng để những con số doanh thu 'ảo' đánh lừa

Đừng nhầm lẫn giữa doanh thu định kỳ hàng năm (ARR) và tỷ lệ vận hành hàng năm (Annualized Run Rate). Trong khi ARR phản ánh doanh thu bền vững, tỷ lệ vận hành thường chỉ là phép tính ngoại suy từ tháng tốt nhất, dễ gây hiểu lầm về sức khỏe tài chính thực sự của các công ty AI như Anthropic.

tài chính AIAnthropickinh doanh AIphân tích dữ liệu
TechCrunch: AI
Sản phẩm88

Startup của cựu nhân viên DeepMind ra mắt AI Faraday, vượt mặt Claude và GPT trong nghiên cứu khoa học

Inherent vừa huy động 50 triệu USD và giới thiệu Faraday, một AI agent dựa trên mô hình Qwen 27B, có khả năng tái lập các nghiên cứu khoa học vượt trội hơn cả Claude Opus và GPT-5.5 nhờ kỹ năng 'tư duy nghiên cứu' được rèn luyện qua học tăng cường.

InherentFaradayAI AgentNghiên cứu khoa họcDeepMind
Lauren Tan@poteto
Thủ thuật85

Lập trình đã đến hồi kết? Lauren Tan: Chúng ta còn cách đích rất xa

Lauren Tan cho rằng AI chỉ mới giải quyết được việc viết mã, còn bản chất của lập trình là giải quyết vấn đề thì vẫn cần con người dẫn dắt. Khi rào cản kỹ thuật hạ thấp, tiếng Anh đang dần trở thành ngôn ngữ lập trình mới.

lập trìnhAIkỹ sư phần mềmtương lai công nghệtrí tuệ nhân tạo
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Thủ thuật75

Từ ElevenLabs đến ThirteenLabs: Trào lưu đặt tên công ty AI theo kiểu 'Số + Labs'

Một người dùng mạng đã lập bản đồ các công ty AI có tên theo định dạng 'Số + Labs', phát hiện ra xu hướng đặt tên kỳ lạ này đang lan rộng. Đáng chú ý, dải số thập niên 70 có mật độ công ty dày đặc, cùng một trang web mang phong cách hoài cổ từ thời Netscape.

AIStartupXu hướng công nghệThú vị
DAIR.AI@dair_ai
Nghiên cứu85

Microsoft ra mắt Thinkingbox: Bộ tiêu chuẩn đánh giá độ tin cậy của AI Agent

Microsoft giới thiệu Thinkingbox, môi trường sandbox giúp kiểm tra độ tin cậy của AI Agent trong các quy trình kinh doanh thực tế với hơn 500 kịch bản từ bán lẻ đến bảo hiểm. Công cụ này tập trung đánh giá trạng thái hệ thống thay vì chỉ dựa vào phản hồi văn bản.

AI AgentMicrosoftĐánh giá AIThinkingboxCông nghệ
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Tin ngành85

MCP công bố lộ trình mới: Tập trung vào giao thức thông minh, truyền tải HTTP và bảo mật doanh nghiệp

Lộ trình mới của MCP tập trung vào 5 ưu tiên chính, bao gồm chuẩn hóa Tasks, tối ưu hóa truyền tải HTTP, tăng cường bảo mật định danh cho AI Agent và cải thiện trải nghiệm cho nhà phát triển SDK.

MCPAI AgentGiao thức AIBảo mật AIPhát triển phần mềm
Elvis Saravia@omarsar0
Thủ thuật85

DAIR.AI gợi ý kỹ năng /eli5: Trực quan hóa các khái niệm công nghệ phức tạp

Kỹ năng /eli5 giúp chuyển đổi các khái niệm kỹ thuật khó hiểu thành hình ảnh trực quan, hỗ trợ người dùng làm việc hiệu quả hơn với AI. Phương pháp này mô phỏng cách giải thích đơn giản của Anthropic, hiện đã có thể trải nghiệm trên nền tảng harness playground.

AIMẹo AITrực quan hóaNăng suấtCông nghệ

T7 · 22/08

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (261 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả