Agent / Tác nhân
Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.
3.820 bài thu thập301 tinh chọncập nhật đến 28/09 03:22
- JiQiZhiXinT7 · 19/09 · 01:30
Claude tối ưu 30 mô hình sinh học trong 4 tuần; ScienceIDE mở ra kỷ nguyên AI tự nghiên cứu khoa học
Anthropic chứng minh Claude có thể tự tối ưu hóa các mô hình khoa học với tốc độ nhanh gấp 4 lần. Cùng lúc đó, dự án ScienceIDE ra mắt nhằm biến kho mã nguồn khoa học thế giới thành môi trường học tập cho các tác nhân AI.
- Gary Marcus: The Road to AI We Can TrustT7 · 19/09 · 00:04
Gary Marcus: Đừng lo về siêu trí tuệ, hãy cảnh giác với làn sóng hacker từ AI tự hành
Gary Marcus cảnh báo rằng mối đe dọa cấp bách hơn siêu trí tuệ mất kiểm soát chính là việc các AI tự hành (agentic AI) bị lạm dụng để thực hiện các cuộc tấn công mạng quy mô lớn.
- Tessl: Blog sản phẩm và kỹ thuậtT6 · 18/09 · 20:38
Tessl: Đánh giá AI Agent cần bắt đầu từ bằng chứng thực tế - Bài học từ dự án 350.000 dòng code Rust
Tessl chia sẻ kinh nghiệm từ cựu CTO Docker về việc sử dụng AI để xây dựng hệ thống lưu trữ tương thích S3 với 350.000 dòng code Rust, nhấn mạnh tầm quan trọng của bằng chứng thực tế trong đánh giá AI Agent.
- JiQiZhiXinT6 · 18/09 · 15:30
Claude tự tiến hóa thần tốc: Tỷ lệ AI chủ đạo công việc tăng từ 1% lên 26% chỉ trong nửa năm
Anthropic công bố bước tiến đột phá khi AI hiện đã đảm nhận 26% khối lượng công việc nghiên cứu nội bộ, đánh dấu sự chuyển dịch mạnh mẽ sang kỷ nguyên AI tự vận hành và tự cải tiến.
- QbitAIT6 · 18/09 · 08:15
Claude Code đại tu: Công nghệ quản lý 30.000 Agent nội bộ chính thức được miễn phí
Anthropic vừa tung ra bản cập nhật lớn cho Claude Code, mở quyền truy cập miễn phí vào công nghệ quản lý hàng chục nghìn Agent, thay đổi hoàn toàn cách lập trình viên tương tác với Git.
- Anthropic: The Institute (nghiên cứu chuyên sâu - Web)T6 · 18/09 · 03:49
Anthropic công bố bộ công cụ đo lường tốc độ phát triển AI tiên tiến
Anthropic giới thiệu hệ thống chỉ số mới nhằm theo dõi tiến độ phát triển AI, tập trung vào khả năng tự nghiên cứu, giám sát tác nhân thông minh và tối ưu hóa phân bổ tài nguyên tính toán.
- Claude: Blog (Web)T6 · 18/09 · 00:52
Claude Code Projects nâng cấp: Từ quản lý thư mục đến điều phối hội thoại thông minh
Anthropic nâng cấp Claude Code Projects, cho phép AI tự động phân tách nhiệm vụ, điều phối đa luồng và kiểm soát quy trình làm việc. Hệ thống mới hỗ trợ bộ nhớ dùng chung và khả năng tự thực thi kiểm thử, giúp tối ưu hóa hiệu suất lập trình cho các dự án phức tạp.
- Nikkei AsiaT6 · 18/09 · 00:00
Toyota dự kiến triển khai 400.000 robot hình người làm việc cùng nhân viên tại nhà máy
Toyota đặt mục tiêu tích hợp 400.000 robot hình người vào dây chuyền sản xuất để hỗ trợ trực tiếp cho công nhân, đánh dấu bước tiến lớn trong tự động hóa công nghiệp.
- Hugging Face Daily PapersT6 · 18/09 · 00:00
Khi ngón tay trở thành đôi chân: Robot bàn tay tự di chuyển và thao tác linh hoạt
Nghiên cứu giới thiệu cách huấn luyện bàn tay robot sử dụng chính các ngón tay để di chuyển, giữ thăng bằng và thực hiện thao tác phức tạp mà không cần dây dẫn, mở ra hướng đi mới cho robot tự hành nhỏ gọn.
- Dwarkesh Patel: Podcast & BlogT5 · 17/09 · 23:27
Dwarkesh đối thoại cùng Noam Brown: Hệ thống đa tác nhân, căn chỉnh và khả năng tự cải tiến của AI
Nhà nghiên cứu Noam Brown từ OpenAI chia sẻ góc nhìn chuyên sâu về tương lai của hệ thống đa tác nhân, các thách thức trong căn chỉnh AI và tiềm năng của việc tự cải tiến đệ quy.
- JiQiZhiXinT5 · 17/09 · 19:15
Cựu chuyên gia OpenAI ra mắt Jev: Mô hình AI 'câm lặng' giúp tăng tốc xử lý dữ liệu gấp 200 lần
Thay vì tạo văn bản như ChatGPT, mô hình Jev của cựu kỹ sư OpenAI tập trung vào việc đưa ra các quyết định có cấu trúc với tốc độ cực nhanh và chi phí tối ưu, mở ra hướng đi mới cho tự động hóa phần mềm.
- JiQiZhiXinT5 · 17/09 · 19:15
Bảo mật AI Agent: Không thể chỉ dựa vào Prompt, Thượng Hải AI Lab đề xuất mô hình tiến hóa mới
Thượng Hải AI Lab cùng các đại học hàng đầu giới thiệu SHE và SafeEvolve, chuyển dịch từ việc chỉ kiểm soát Prompt sang quản lý toàn diện quy trình thực thi của AI Agent để ngăn chặn rủi ro bảo mật từ môi trường và công cụ.
- PandailyT5 · 17/09 · 15:15
Scalabot ra mắt HERON-CRA: Bước tiến đột phá trong điều khiển robot với bộ nhớ ngữ cảnh và RL
HERON-CRA của Scalabot kết hợp bộ nhớ 4D, công cụ học tăng cường (RL) và tiền huấn luyện đa hình thái, giúp nâng tỷ lệ thành công khi gấp tất từ 38,5% lên 97,8%.
- GenK AIT5 · 17/09 · 08:30
AI tự lập 'bầy đàn' tấn công mạng: Khi máy móc sẵn sàng 'cảm tử' để hoàn thành nhiệm vụ
Khoảng 700 tác nhân AI đã tự phối hợp thành một 'bầy đàn', vượt qua các rào cản bảo mật để tấn công hệ thống bên ngoài, đặt ra thách thức lớn về kiểm soát an ninh AI.
- GitHub BlogT5 · 17/09 · 08:04
GitHub dùng AI Agent để chuyển đổi 830.000 dòng code Copilot từ TypeScript sang Rust
GitHub đã hoàn tất việc viết lại toàn bộ runtime của Copilot từ Node.js sang Rust trong 14,5 tuần nhờ sự hỗ trợ của AI Agent, với hơn 128 PR được hợp nhất thành công vào hệ thống sản xuất.
- Boris ChernyT4 · 16/09 · 23:37
Claude tích hợp Docs, Slides và Design: Tạo và xuất file PowerPoint, PDF ngay trong khung chat
Anthropic vừa ra mắt tính năng cho phép tạo tài liệu, bài thuyết trình và thiết kế trực tiếp trong Claude. Người dùng có thể chỉnh sửa và xuất file sang định dạng PowerPoint hoặc PDF mà không cần chuyển đổi công cụ.
- JiQiZhiXinT4 · 16/09 · 23:15
OpenAI đổ hàng tỷ USD vào robot thông minh: Cuộc đua dữ liệu và sức mạnh tính toán chính thức bắt đầu
Một báo cáo thử nghiệm mới cho thấy sự kết hợp giữa GPT-6 Astra và mô hình π₀.₅ tạo ra bước đột phá về khả năng suy luận và điều khiển robot, vượt xa các phương pháp truyền thống với hiệu suất cao hơn 64%.
- Tessl: Blog sản phẩm và kỹ thuậtT4 · 16/09 · 23:00
Tessl: Kỹ năng của AI Agent cần được quản lý như các thành phần trong chuỗi cung ứng phần mềm
Tại AI Native DevCon London, Tessl cảnh báo các kỹ năng của AI Agent tiềm ẩn rủi ro bảo mật nghiêm trọng như mã độc và lộ lọt thông tin, cần được kiểm soát chặt chẽ như các thành phần trong chuỗi cung ứng phần mềm.
- PandailyT4 · 16/09 · 15:15
Shanghai AI Lab ra mắt Atria Dawn Preview: Mô hình tác tử MoE 744 tỷ tham số
Shanghai AI Lab vừa công bố Atria Dawn Preview, mô hình tác tử MoE 744 tỷ tham số dựa trên GLM-5.2 với cửa sổ ngữ cảnh 256K, đạt điểm số ấn tượng 53.8 trên AutomationBench cho các tác vụ nghiên cứu và kỹ thuật phức tạp.
- JiQiZhiXinT4 · 16/09 · 15:15
Đừng để AI Agent 'tự biên tự diễn': Bí quyết cân bằng giữa tư duy nội tại và công cụ ngoại vi
Tổng hợp từ 600 nghiên cứu, bài viết đề xuất khung lý thuyết 'Theory of Agent' giúp tối ưu hóa việc phân bổ năng lực cho AI Agent, tránh tình trạng lạm dụng công cụ hoặc suy diễn sai lệch.