Nghiên cứu
Khung Agent mã nguồn mở gây sốt với ARC-AGI-3: 'Tự cải tiến' bằng RLM gây tranh cãi
(giờ Việt Nam)
Tóm tắt AI
Prime Agent đạt 95,5% điểm trên ARC-AGI-3 nhờ ứng dụng mô hình ngôn ngữ đệ quy (RLM), mở ra hướng đi mới cho khả năng suy luận tự chủ của AI.
Bản dịch AI
OpenAI khẩn cấp dừng dự án mô hình "người lớn"; Tạp chí Nature công bố nhà khoa học AI tự động hoàn toàn, Agent mã nguồn mở khởi đầu cuộc chiến giữa các vị thần.
Đã tạm dừng vô thời hạn kế hoạch chatbot khiêu dâm "chế độ người lớn" gây tranh cãi của mình.... Bảng xếp hạng ARC-AGI-3 bị tiết lộ có biểu hiện bất thường, gây ra cuộc thảo luận gay gắt trong cộng đồng....
Tiếng còi tàu kéo đoàn tàu
(Từ YC) Tự cải tiến đệ quy: Con đường nhanh nhất dẫn đến siêu trí tuệ — Góc nhìn của Ian Fischer, nhà sáng lập Poetiq.
Harness có nơi dịch là 'bộ công cụ' hoặc 'khung', ở đây thống nhất dịch là 'tăng cường'... Ý tưởng tự cải tiến đệ quy không phải là mới, nhưng đột phá của Poetiq nằm ở việc hiện thực hóa chi phí thấp...
Cộng đồng Sáng tạo AI (AI)
Top 10 bài báo AI tuần này: Các Agent đồng loạt "thức tỉnh", con người bị ARC-AGI-3 nghiền nát với tỷ số 100:1.
Bài báo về Agent "búp bê Nga" tự cải tiến: https://arxiv.org/abs/2603.19461... Bài báo về ARC-AGI-3: Con người 100%, AI chưa đến 1%: https://arxiv.org/abs/...
Xin chào Wall-E
Bản tin AI | 30/03/2026: Cơn sốt IPO và cuộc chơi "AI chủ quyền", Agent khởi động "thao tác từ xa" và "tài sản hóa kỹ thuật số".
Nguồn tin: TLDR AI Newsletter (25/03/2026) "Harness design for... ARC-AGI-3, nhằm đánh giá năng lực thực tế của AI trong "suy luận tổng quát kiểu người". Điều này...
Hành trình trưởng thành của một "lính mới" Backend
AI sớm biết - Tuần san - 23/03/2026 - 29/03/2026
Bộ dữ liệu điều khiển từ xa toàn thân cho robot hình người thế giới thực mã nguồn mở • AI2 MolmoBot: Khai... Khung này đạt điểm số 36,08% vào ngày ARC-AGI-3 ra mắt, vượt xa Opus 4.6 (0,2...
Air7.fun
Agent Memory thay thế RAG, Anthropic chuyển mình thành Agent OS | Quan sát chuyên sâu về AI - 02/03/2026
Điểm chuẩn ARC-AGI-2 đạt **95%** (ngang tầm hiệu năng GPT-5.2). Cơ sở hạ tầng giao tiếp giữa các Agent - Agent Relay (mã nguồn mở): Dành cho Claude và Codex Agent...
Thử và sai (Trial and Error)
Bản tin công nghệ AI ngày 25 tháng 3 năm 2026: Tiến hóa kiến trúc Agent, sự cố bảo mật LiteLLM và những tiến bộ mới của mô hình mã nguồn mở.
Hệ sinh thái mã nguồn mở tiếp tục thịnh vượng: Nous phát hành Hermes Agent v0.4.0, tích hợp API tương thích OpenAI và vòng lặp tự cải tiến. Đồng thời, AI2 phát hành tác nhân trình duyệt MolmoWeb,...
Ghi chép lỗi (BUG)
Agent tự tiến hóa MiniMax M2.7
M2.7 sở hữu khả năng tự xây dựng và lặp lại các Harness Agent phức tạp. Tự xây dựng:... Năng lực R&D: Trong bài kiểm tra MLE Bench Lite bao gồm 22 tác vụ học máy,...
Kho tri thức chọn lọc về AI
Bàn tròn mã nguồn mở AI tại Diễn đàn Trung Quan Thôn 2026: Các chuyên gia hàng đầu tranh luận về thế hệ Agent tiếp theo, lợi thế cốt lõi của mô hình lớn Trung Quốc nằm ở đâu | Dương Thực Lân, Trương Bằng, Hạ Lập Tuyết, La Phúc Lợi, Hoàng Siêu.
Để toàn bộ cộng đồng có thể tham gia sâu và cải tiến khung Agent là tiền đề quan trọng cho sự phát triển của ngành... Đồng thời thông qua hệ thống harness, hệ thống kỹ năng (skills) để đảm bảo độ chính xác khi hoàn thành tác vụ, giữ vững...
Geek ABC
Đại đạo chí giản, OpenClaw đã phá vỡ lộ trình khung Agent trước đây.
Từ "khung cồng kềnh" chuyển sang "harness tối giản", từ "ưu tiên đám mây" chuyển sang "cục bộ"... Tối đa tạo ra một Agent nhánh sao chép chính mình, tập trung vào tác vụ cụ thể, kết quả trả về cho...
Mèo đen xúi giục dũng sĩ mèo mướp
12345678910 Trang sau
Tìm thấy khoảng 142 kết quả
Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.