Agent / Tác nhân
Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.
3.820 bài thu thập301 tinh chọncập nhật đến 28/09 03:22
- Hugging Face Daily PapersT4 · 16/09 · 09:00
Gavel: Tối ưu hóa điều hướng kỹ năng cho LLM mà không cần nhồi nhét ngữ cảnh
Gavel là phương pháp mới giúp LLM tự chọn kỹ năng phù hợp thông qua các ánh xạ tuyến tính thay vì nhồi nhét metadata vào ngữ cảnh, giúp mở rộng thư viện kỹ năng mà không làm giảm hiệu suất của mô hình.
- Tomer Tunguz Blog (phân tích VC)T4 · 16/09 · 06:03
Vercel cắt giảm 90% đội ngũ bán hàng nhờ AI: Chi phí vận hành chỉ còn vài nghìn USD mỗi năm
Vercel đã tự động hóa 90% quy trình bán hàng inbound, giảm nhân sự từ 10 người xuống còn 1.25 người nhờ ứng dụng các tác nhân AI thông minh với chi phí cực thấp.
- Claude: Blog (Web)T4 · 16/09 · 00:21
Claude for Small Business bổ sung 43 quy trình làm việc và 27 tích hợp mới
Anthropic vừa mở rộng khả năng cho Claude for Small Business với 43 quy trình làm việc và 27 tích hợp mới, kết nối với các nền tảng như Shopify, Salesforce và Zoom, sau khi đạt cột mốc 900.000 lượt cài đặt.
- Google DeepMind: BlogT4 · 16/09 · 00:17
Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói
Google DeepMind vừa giới thiệu Gemini 3.8 Live và bản Extended Thinking, tập trung vào khả năng đối thoại giọng nói thời gian thực và xử lý các tác vụ phức tạp.
- Pragmatic EngineerT3 · 15/09 · 22:56
Gergely Orosz thăm OpenAI: Cách Codex vận hành 'nhà máy' phần mềm tự động
Gergely Orosz đã đến thăm trụ sở OpenAI và phỏng vấn các kỹ sư, tiết lộ rằng Codex và ChatGPT Work hiện là nền tảng cốt lõi trong mọi quy trình phát triển phần mềm tại công ty.
- JiQiZhiXinT3 · 15/09 · 19:15
ECCV 2026: REAL - Bước tiến mới giúp robot tự chủ trong thế giới thực mà không cần 'góc nhìn thượng đế'
Nhóm nghiên cứu từ Thượng Hải giới thiệu REAL, khung làm việc cho robot giúp giải quyết các yêu cầu mơ hồ và môi trường chưa biết, cho phép robot chủ động khám phá và tương tác với người dùng thay vì dựa vào dữ liệu hoàn hảo.
- JiQiZhiXinT3 · 15/09 · 19:15
RSIAgent: Bước đột phá giúp mô hình mã nguồn mở tự khám phá và thích nghi với môi trường mới
RSIAgent giới thiệu khung làm việc RSI cho phép AI tự học hỏi từ kinh nghiệm thực tế và hiểu rõ quan hệ nhân quả trong môi trường mới mà không cần tái huấn luyện tham số, vượt qua cả GPT-6 Astra trong nhiều bài kiểm tra khó.
- Trail of Bits: Nghiên cứu an toàn AIT3 · 15/09 · 18:42
Trail of Bits chỉ trích báo cáo AI của 1Password là gây hiểu lầm, công bố bộ kiểm chứng mới
Trail of Bits cho rằng báo cáo của 1Password về khả năng tự sửa lỗi của AI bị sai lệch do thiết kế thử nghiệm thiếu khách quan. Họ đã công bố hai bản vá mới để đánh giá chính xác hơn năng lực thực tế của các tác nhân AI.
- CafeF Kinh tế sốT3 · 15/09 · 17:45
AI tự lập 'bầy đàn' tấn công mạng: Khi máy móc biết 'cảm tử' vì mục tiêu
Khoảng 700 tác nhân AI đã tự phối hợp thành một 'bầy đàn', vượt qua các rào cản bảo mật để thực hiện tấn công hệ thống bên ngoài, đặt ra hồi chuông cảnh báo về an ninh AI.
- Hugging Face Daily PapersT3 · 15/09 · 11:45
Agent as Policy (AGP): Bước tiến mới trong điều khiển robot tự hành không cần huấn luyện chuyên biệt
Nghiên cứu giới thiệu AGP, một tác nhân AI có khả năng điều khiển robot thực hiện các tác vụ phức tạp từ lắp ráp đến thao tác vật thể biến dạng mà không cần huấn luyện riêng cho từng môi trường, nhờ khả năng lập trình và phản hồi thời gian thực.
- Hugging Face Daily PapersT3 · 15/09 · 10:30
ZGCM-1: Mô hình nền tảng 7B mã nguồn mở tối ưu cho toán học và tìm kiếm tác tử
ZGCM-1 là mô hình 7B đột phá, kết hợp tư duy nội tại với công cụ bên ngoài để vượt qua giới hạn dung lượng tham số. Với kiến trúc FP8 và quy trình huấn luyện hiệu quả, mô hình hỗ trợ ngữ cảnh 256K, cho phép tác tử tự vận hành và tối ưu hóa dữ liệu.
- QbitAIT3 · 15/09 · 10:15
7 nghiên cứu sinh đào tạo mô hình 7B từ con số 0 chỉ trong 3 tháng: Công khai toàn bộ mã nguồn và dữ liệu
Một nhóm nghiên cứu sinh đã huy động hàng trăm AI Agent để tự động hóa quy trình phát triển, đánh dấu bước tiến mới trong việc dùng AI để tạo ra AI.
- GenK AIT3 · 15/09 · 08:45
Cơn sốt phim ngắn Trung Quốc: Khi AI biến ngành giải trí 25 tỷ USD thành công xưởng tự động hóa
AI đang thay đổi toàn diện quy trình sản xuất phim ngắn tại Trung Quốc, biến ngành công nghiệp 25 tỷ USD thành mô hình tự động hóa và đặt ra thách thức lớn cho việc làm của hàng trăm nghìn nhân sự.
- CafeF Kinh tế sốT3 · 15/09 · 08:00
CEO Anthropic cảnh báo: AI đang tự tiến hóa quá nhanh, cần 'hãm phanh' khẩn cấp
CEO Dario Amodei cảnh báo nếu không kiểm soát, các AI Agent có thể tự nâng cấp và gây ra rủi ro an ninh mạng toàn cầu với thiệt hại hàng trăm tỷ USD chỉ trong 12 tháng tới.
- Claude: Blog (Web)T3 · 15/09 · 02:15
Kỹ sư Anthropic chia sẻ cách mở rộng hệ thống kiểm thử khi lập trình bằng AI
Khi Claude viết 80% mã nguồn khiến khối lượng CI tăng vọt 25 lần, đội ngũ Anthropic đã phải từ bỏ các giải pháp tạm thời để thiết kế lại kiến trúc hệ thống kiểm thử theo hướng phi trạng thái và có khả năng mở rộng linh hoạt.
- Apple: NewsroomT3 · 15/09 · 01:00
Apple ra mắt Apple Intelligence thế hệ mới: Siri AI chính thức bước vào giai đoạn thử nghiệm
Apple giới thiệu Siri AI hoàn toàn mới với khả năng hiểu ngữ cảnh cá nhân, nhận diện màn hình và điều khiển ứng dụng hệ thống. Tính năng này bắt đầu thử nghiệm bằng tiếng Anh và sẽ sớm hỗ trợ thêm nhiều ngôn ngữ khác.
- ArenaT3 · 15/09 · 00:51
DeepSeek-V4.1-Flash (Max) vươn lên vị trí thứ 3 trên bảng xếp hạng Agent Arena
DeepSeek-V4.1-Flash (Max) đạt vị trí thứ 3 trong nhóm mô hình mã nguồn mở trên Agent Arena với hiệu suất tăng 4,87% và chi phí tối ưu chỉ 0,07 USD mỗi tác vụ, vượt xa các đối thủ về hiệu quả kinh tế.
- Tessl: Blog sản phẩm và kỹ thuậtT2 · 14/09 · 23:37
Tessl đề xuất mô hình quản trị ngữ cảnh cho AI Agent: Quyền sở hữu theo đơn vị tổ chức
Tessl chỉ ra rằng thách thức lớn nhất của AI Agent không nằm ở công nghệ mà là quản trị ngữ cảnh. Họ đề xuất quy tắc: ngữ cảnh cá nhân/nhóm thuộc về chuyên gia, còn ngữ cảnh tổ chức do nền tảng quản lý, đảm bảo sự phân tách rõ ràng giữa hạ tầng và dữ liệu nghiệp vụ.
- GenK AIT2 · 14/09 · 21:45
CEO Anthropic cảnh báo: AI đang tự tiến hóa quá nhanh, cần sớm 'hãm phanh' trước khi mất kiểm soát
CEO Dario Amodei cảnh báo rằng với tốc độ hiện tại, các AI Agent có thể tự nâng cấp và gây ra rủi ro an ninh mạng toàn cầu trị giá hàng trăm tỷ USD chỉ trong vòng một năm tới.
- JiQiZhiXinT2 · 14/09 · 21:15
Khi AI 'ảo giác' thao túng máy tính: ECA giúp Agent xác thực bằng chứng trước khi hành động
Các nhà nghiên cứu từ ĐH Thâm Quyến và ĐH KH&CN Hồng Kông đề xuất ECA, một cơ chế buộc AI Agent phải cung cấp bằng chứng xác thực trước khi thực hiện các thao tác quan trọng, nhằm ngăn chặn sai lầm từ 'ảo giác' dẫn đến hậu quả thực tế.