Today we're launching our leaderboard for Terminal-Bench-Science 0.1, an agentic benchmark for scien…
DịchArtificial Analysis vừa công bố bảng xếp hạng Terminal-Bench-Science 0.1, trong đó GPT-6 Astra (max) dẫn đầu với 63%, theo sát là Claude Opus 5.5 (xhigh) với 62%.
Meta published A-MLE, a new AI agent framework they actually built and deployed to automate ML exper…
DịchMeta giới thiệu A-MLE, khung tác tử LLM giúp tự động hóa toàn bộ quy trình từ đề xuất ý tưởng, chạy thử nghiệm đến phân tích kết quả và tối ưu hóa mô hình quảng cáo quy mô lớn.
Catch the International Agentic AI Forum livestream at Apsara Conference 2026 and hear global techno…
DịchĐón xem trực tiếp Diễn đàn AI Tác tử Quốc tế tại Hội nghị Apsara 2026 để lắng nghe các chuyên gia công nghệ hàng đầu thảo luận về sự phát triển của AI tác tử trong hạ tầng và ứng dụng thực tế.
AI will require "gazillions" of tokens. - Qualcomm CEO Cristiano Amon: Agentic AI will consume dra…
DịchCEO Cristiano Amon nhận định AI tác tử (Agentic AI) sẽ tiêu thụ token vượt xa chatbot truyền thống do phải liên tục ra quyết định, sử dụng công cụ và điều phối hệ thống. Trong tương lai, mô hình tính phí phần mềm có thể chuyển từ số lượng người dùng sang lượng token hoặc suy luận máy.
A new model of enterprise intelligence is taking shape. At #ApsaraConference2026, Jeffrey Zhang, Hea…
DịchTại hội nghị Apsara 2026, Alibaba Cloud giới thiệu khái niệm 'Smart Fusion' nhằm thúc đẩy sự hình thành của các doanh nghiệp thuần AI (Agent-native), mở ra kỷ nguyên vận hành thông minh mới.
The latest #AISpotlight explores @qwenwork International and how it takes workplace AI beyond answer…
DịchQwenWork không chỉ dừng lại ở việc trả lời câu hỏi mà còn hỗ trợ lập kế hoạch, thực thi và hoàn thiện các tác vụ phức tạp từ nghiên cứu đến quản lý tài liệu, giúp nâng cao hiệu suất làm việc chuyên nghiệp.
Meta vừa giới thiệu Muse, trợ lý AI có khả năng kết nối với email, lịch và thanh toán để thay người dùng xử lý các công việc như đặt lịch trình, mua sắm và quản lý hóa đơn.
// Memory is what breaks long-horizon agents // It's undeniable how important memory/recall is for …
DịchDAIR.AI thử nghiệm 15 mô hình LLM quản lý đội bóng qua 20 mùa giải. Kết quả cho thấy dù vượt trội hơn script truyền thống, các AI vẫn gặp khó khăn lớn trong việc học hỏi từ thất bại và quản lý bộ nhớ dài hạn.
Long-horizon agent reliability has not arrived yet with better models. On WeaveBench's 114 hybrid …
DịchDù các mô hình AI ngày càng mạnh, khả năng thực hiện nhiệm vụ dài hạn vẫn hạn chế với tỷ lệ thành công chỉ 41,2% trên WeaveBench. Nghiên cứu chỉ ra rằng độ tin cậy phụ thuộc nhiều vào hệ thống kiểm soát ngoại vi (harness) hơn là bản thân mô hình.
AgentMercury là khung làm việc đột phá giúp tự động tạo ra các môi trường kinh doanh thực tế, có thể kiểm chứng thay vì dựa vào các tác vụ thủ công, cho phép huấn luyện AI trong các quy trình công việc phức tạp và đa dạng.
Vì sao đáng đọc: Đây là nghiên cứu quan trọng giải quyết bài toán thiếu hụt dữ liệu môi trường thực tế cho AI tác tử, có tính ứng dụng cao trong doanh nghiệp và quy mô dữ liệu ấn tượng.
I had the pleasure of speaking at the Agentic AI Summit in Berkeley alongside an incredible bunch of…
DịchTại Hội nghị AI Tác tử ở Berkeley, Peter Steinberger nhận định rằng các khung chat hiện nay chỉ là giai đoạn sơ khai của AI, tương tự như cách truyền hình từng mô phỏng phát thanh trước khi định hình bản sắc riêng.
Tại DAC 2026, Synopsys, Cadence và Siemens EDA đồng loạt ra mắt các chiến lược AI tác tử cho thiết kế chip, mở ra kỷ nguyên tự động hóa mới trong khi các nhà cung cấp Trung Quốc đang nỗ lực bứt tốc để bắt kịp xu hướng.
Vì sao đáng đọc: Tin tức cập nhật xu hướng công nghệ quan trọng, có tính thời sự cao về sự thay đổi trong ngành bán dẫn và tác động của AI tác tử đối với chuỗi cung ứng toàn cầu.
12/08
Thứ Tư · 2 tin
OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)
Nghiên cứu từ OpenAI chỉ ra cách các doanh nghiệp hàng đầu chuyển dịch từ việc dùng AI hỗ trợ sang tự động hóa quy trình bằng ChatGPT và Codex, tạo lợi thế cạnh tranh khác biệt.
Nghiên cứu đề xuất khung phân loại ba giai đoạn về sự đồng tiến hóa giữa các tác tử và môi trường, giúp hệ thống AI tự thích nghi và phát triển mà không cần sự can thiệp liên tục từ con người.
Vì sao đáng đọc: Chủ đề mang tính tiên phong về khả năng tự chủ của AI, cung cấp khung lý thuyết quan trọng cho tương lai của các hệ thống tác tử tự tiến hóa.
Tổng 14 tin, không còn tin nào nữa
40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (31 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả