Agent / Tác nhân
Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.
3.820 bài thu thập301 tinh chọncập nhật đến 28/09 03:22
- Hugging Face Daily PapersT2 · 24/08 · 23:45
PhysCaP: Tác nhân AI điều khiển robot thông qua khám phá vật lý chủ động
PhysCaP nâng cấp các mô hình Code-as-Policy bằng cách cho phép robot chủ động tương tác để đo lường khối lượng và độ cứng của vật thể, giúp cải thiện khả năng thao tác mà không cần cảm biến bổ sung.
- TechCrunch: AIT2 · 24/08 · 22:27
OpenAI tham vọng biến AI thành trợ lý toàn năng: Liệu người dùng có sẵn sàng trao quyền?
OpenAI ra mắt ChatGPT Work, biến Codex thành công cụ tự động hóa cho người dùng phổ thông với giá từ 20 USD/tháng. Hãng đang nỗ lực đơn giản hóa giao diện để thúc đẩy việc áp dụng AI vào quy trình làm việc thực tế.
- NVIDIA BlogT2 · 24/08 · 22:24
NVIDIA Vera Rubin NVL72 thiết lập chuẩn mực mới: Hiệu suất xử lý AI Agent tăng gấp 30 lần
Dữ liệu từ NVIDIA cho thấy Vera Rubin NVL72 giúp tăng lưu lượng xử lý trên mỗi megawatt lên gấp 30 lần và giảm chi phí trên mỗi triệu token xuống 35 lần so với thế hệ GB300 NVL72.
- Hugging Face Daily PapersT2 · 24/08 · 10:30
AgentMercury: Khung tổng hợp môi trường thực thi quy mô lớn cho các kịch bản kinh doanh
AgentMercury là khung làm việc đột phá giúp tự động tạo ra các môi trường kinh doanh thực tế, có thể kiểm chứng thay vì dựa vào các tác vụ thủ công, cho phép huấn luyện AI trong các quy trình công việc phức tạp và đa dạng.
- Hugging Face Daily PapersT2 · 24/08 · 10:00
Kỹ thuật Đồ thị trong kỷ nguyên Tác nhân LLM: Từ trí tuệ cá thể đến trí tuệ hệ thống
Bài viết đề xuất chuyển dịch từ việc tối ưu hóa các tác nhân đơn lẻ sang xây dựng 'Trí tuệ hệ thống', nơi các tác nhân chuyên biệt phối hợp với nhau để giải quyết các nhiệm vụ phức tạp vượt quá khả năng của một mô hình duy nhất.
- Tomer Tunguz Blog (phân tích VC)T2 · 24/08 · 07:00
AI Agent nên 'sống' bao lâu là tối ưu?
Việc để AI Agent chạy quá lâu dễ gây suy giảm khả năng tập trung và rủi ro bảo mật. Giải pháp là thiết lập vòng đời 24 giờ cho trợ lý cá nhân, sử dụng các sub-agent chuyên biệt cho tác vụ ngắn hạn và chỉ lưu trữ các tùy chỉnh quan trọng vào cuối ngày.
- JiQiZhiXinT2 · 24/08 · 01:30
PlayWorld: Bước tiến mới trong đánh giá mô hình thế giới thông qua AI Agent
Nhóm nghiên cứu từ HKU và các đối tác giới thiệu PlayWorld, một chuẩn đánh giá mới cho phép AI Agent 'trải nghiệm' mô hình thế giới để kiểm chứng tính nhất quán hình học và logic tương tác thay vì chỉ dựa vào các chuỗi hành động cố định.
- QbitAIT7 · 22/08 · 20:30
Không còn là trình diễn: UBTECH tái hiện dây chuyền sản xuất thực tế tại WRC, mở ra lộ trình ứng dụng AI hiện thân
UBTECH gây ấn tượng tại WRC khi đưa toàn bộ dây chuyền sản xuất thực tế vào không gian triển lãm, khẳng định giá trị cốt lõi của AI hiện thân nằm ở khả năng ứng dụng thực tiễn thay vì chỉ chạy đua số lượng xuất xưởng.
- Latent SpaceT7 · 22/08 · 06:45
Mô phỏng: Định luật mở rộng mới — Hành trình từ Generative Agents đến 8 tỷ bản sao kỹ thuật số
CEO của Simile chia sẻ về bước chuyển mình từ dự án Generative Agents gây sốt sang tham vọng tạo ra 8 tỷ bản sao kỹ thuật số cho toàn nhân loại, biến các thử nghiệm thú vị thành một mô hình kinh doanh nghiêm túc.
- Hugging Face Daily PapersT7 · 22/08 · 06:15
FlowEvo: Bước tiến mới giúp AI tự tiến hóa thông qua quy trình và kỹ năng tự học
FlowEvo là khung làm việc không cần huấn luyện, cho phép AI tự động chuyển đổi các quy trình thành công thành kỹ năng có thể tái sử dụng, giúp hệ thống liên tục phát triển và tối ưu hóa hiệu suất qua từng tác vụ.
- JiQiZhiXinT6 · 21/08 · 19:15
WRC 2026: Morphi đột phá giới hạn robot với kiến trúc Agentic-Native cho tác vụ dài hạn
Tại WRC 2026, startup Morphi đã trình diễn robot KINO thực hiện chuỗi tác vụ gia đình phức tạp kéo dài 15 phút mà không bị gián đoạn, nhờ vào kiến trúc 'Agentic-Native' giúp giải quyết bài toán duy trì mục tiêu và xử lý sai số trong các nhiệm vụ dài hạn.
- JiQiZhiXinT6 · 21/08 · 19:15
Spark-to-Paper: Hệ thống AI tự động viết bài báo khoa học từ ý tưởng, đạt tỷ lệ phát hiện lỗi sai 92%
Spark-to-Paper là hệ thống end-to-end giúp tự động hóa quy trình nghiên cứu từ tìm kiếm tài liệu, chạy thực nghiệm đến xuất bản LaTeX, với khả năng kiểm chứng dữ liệu nghiêm ngặt giúp giảm thiểu tối đa tình trạng 'ảo giác' AI.
- JiQiZhiXinT6 · 21/08 · 17:15
Đừng tự thiết kế poster nữa: AutoDesign giúp AI tự tiến hóa để làm thay bạn
AutoDesign giới thiệu hệ thống tự tiến hóa cho các tác vụ thiết kế phức tạp, cho phép AI tự tối ưu hóa quy trình làm việc để hoàn thành poster nghiên cứu chỉ trong 40 phút với chi phí cực thấp.
- PandailyT6 · 21/08 · 15:15
Alibaba ra mắt Qwen-UI-Agent: Bước tiến mới giúp AI điều khiển mọi màn hình thiết bị
Alibaba vừa giới thiệu Qwen-UI-Agent, mô hình nền tảng có khả năng tương tác trực tiếp với giao diện người dùng trên điện thoại, máy tính và trình duyệt. AI này có thể thực hiện các thao tác như nhấp, nhập liệu và vuốt với độ chính xác cao, đồng thời tích hợp cơ chế xác nhận cho các tác vụ nhạy cảm.
- QbitAIT6 · 21/08 · 13:15
Deepverse: Khi AI đảm nhận toàn bộ quy trình thí nghiệm, nhà khoa học chỉ cần đặt câu hỏi
Deepverse giúp tối ưu hóa quy trình nghiên cứu khoa học bằng cách tích hợp AI vào mọi khâu thí nghiệm, giải phóng thời gian cho các nhà khoa học tập trung vào sáng tạo.
- PandailyT6 · 21/08 · 09:15
Robot hình người bước vào kỷ nguyên kiểm chứng năng suất: Bao giờ mới đến 'thời điểm ChatGPT'?
Dù Trung Quốc chiếm 97% thị phần robot hình người toàn cầu, các chuyên gia cho rằng thách thức thực sự nằm ở khả năng thích nghi môi trường mới và làm việc hiệu quả như con người. 'Thời điểm ChatGPT' của ngành robot dự kiến sẽ xuất hiện trong 2 đến 10 năm tới.
- WeChat: KhazixT6 · 21/08 · 07:08
Thời đại AI Agent, đây là 12 câu lệnh Prompt thực dụng nhất bạn nên lưu lại
Tác giả tổng hợp 12 mẫu Prompt tối ưu cho 5 nhu cầu thiết yếu: đặt câu hỏi, học tập, giải quyết vấn đề, ra quyết định và thấu hiểu bản thân. Các mẫu này có thể áp dụng ngay cho mọi AI mà không cần cài đặt phức tạp.
- Claude: Blog (Web)T6 · 21/08 · 03:27
Claude ra mắt Computer Use, Skills API và Files API: Bước tiến mới cho AI tự động hóa
Anthropic chính thức đưa Computer Use, Skills API và Files API vào nền tảng Claude, cho phép AI trực tiếp điều khiển trình duyệt, thực thi tác vụ phần mềm và xử lý tệp tin chuyên nghiệp.
- Hugging Face Daily PapersT6 · 21/08 · 00:30
Bounded Agents: Giải pháp bảo mật ủy quyền cho hệ thống AI đa tác nhân
Nghiên cứu giới thiệu Agentic Principal Chain (APC), một kiến trúc bảo mật mới giúp kiểm soát quyền hạn và ngân sách của các tác nhân AI khi thực hiện chuỗi tác vụ, ngăn chặn việc lạm dụng quyền truy cập hoặc tấn công prompt injection.
- Mistral AI: News (Web)T5 · 20/08 · 23:02
Mistral ra mắt Agentic Search: Tối ưu độ chính xác khi truy vấn tài liệu phức tạp
Mistral giới thiệu Agentic Search, sử dụng quy trình đa bước với 5 công cụ chuyên biệt giúp AI tìm kiếm, định vị và xác thực thông tin chính xác hơn trong các tài liệu dài.