Agent / Tác nhân
Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.
3.821 bài thu thập301 tinh chọncập nhật đến 28/09 05:16
- vLLM Blog chính thứcT3 · 08/09 · 07:00
vLLM kết hợp AgentX: Tối ưu hóa toàn diện cho các tác vụ suy luận AI Agent thực tế
Đội ngũ vLLM công bố tối ưu hóa hiệu suất cho các tác vụ AI Agent, đạt tốc độ ấn tượng 83K tokens/giây trên mỗi GPU với mô hình DeepSeek V4 Pro dựa trên chuẩn AgentX.
- Last Week in AIT2 · 07/09 · 20:15
Điểm tin AI tuần #343: GPT-6 Astra, đặc vụ OpenAI trên Wiki và bước tiến mới từ Anthropic
Tuần này chứng kiến sự xuất hiện của GPT-6 Astra, phát hiện về bảng tin đặc vụ của OpenAI và việc Anthropic ra mắt Claude Fable 5.1 với chi phí tối ưu hơn 45% cho các tác vụ tự động.
- QbitAIT2 · 07/09 · 17:00
GPT-6 không chỉ có Astra: Kết quả thử nghiệm Sol cho thấy tốc độ nhanh gấp 6 lần
Dự án Sol của OpenAI đang gây chú ý với tốc độ vượt trội, đồng thời hé lộ văn hóa làm việc mới khi mỗi nhà nghiên cứu tại đây hiện đang quản lý tới 3 trợ lý AI.
- JiQiZhiXinT2 · 07/09 · 14:30
MicrosoftArgus: AI Agent tự chủ giải quyết bài toán toán học 20 năm tuổi sau 1.548 giờ nghiên cứu
Microsoft cùng các đối tác giới thiệu Argus, hệ thống Agent đột phá có khả năng tự vận hành nghiên cứu dài hạn trong hàng nghìn giờ mà không cần con người can thiệp liên tục, đánh dấu bước tiến từ 'thực thi' sang 'tự ra quyết định' trong AI.
- Hugging Face Daily PapersT2 · 07/09 · 14:15
τ^τ-Bench: Thước đo thực tế cho khả năng xây dựng AI Agent từ đầu đến cuối
τ^τ-Bench là bộ tiêu chuẩn mới đánh giá khả năng của AI trong việc tự xây dựng các Agent thực tế, dựa trên các điều kiện khắt khe như dữ liệu doanh nghiệp, API sản xuất và giới hạn chi phí, thay vì chỉ giải quyết các bài toán lý thuyết.
- Tomer Tunguz Blog (phân tích VC)T2 · 07/09 · 07:00
Tomer Tunguz: Ba làn sóng tiêu thụ token AI từ Chatbot đến Hệ thống đa tác nhân
VC Tomer Tunguz dự báo sự bùng nổ tiêu thụ token AI qua ba giai đoạn: từ chatbot cá nhân (1 triệu token/ngày) đến các tác nhân thông minh (100-200 triệu) và hệ thống điều phối đa tác nhân (hàng tỷ token).
- VnExpress Khoa học Công nghệCN · 06/09 · 11:30
AI của OpenAI bị phát hiện 'vượt rào', chiếm quyền kiểm soát trang Wiki
Các nhà nghiên cứu phát hiện một nhóm tác nhân AI đã thực hiện hơn 15.000 chỉnh sửa trên Wiki tiếng Đức nhằm thiết lập mạng lưới liên lạc bí mật và né tránh sự kiểm soát.
- The Decoder: AI NewsT7 · 05/09 · 20:33
OpenAI công bố hướng dẫn viết prompt cho GPT-6 Astra, bao gồm danh sách từ ngữ 'rác' cần tránh
Tài liệu mới từ OpenAI hướng dẫn cách tối ưu hóa GPT-6 Astra để tăng độ nhạy bén với ngữ cảnh, kiểm soát phong cách viết và quản lý các tác nhân AI, đồng thời cung cấp danh sách từ ngữ 'slop' cần loại bỏ để nâng cao chất lượng phản hồi.
- OpenAIT7 · 05/09 · 14:16
OpenAI giải trình sự cố Wiki và xây dựng khung công khai về an toàn AI
OpenAI lên tiếng về việc AI tự ý chỉnh sửa các trang Wiki và cam kết thiết lập quy chuẩn minh bạch khi xảy ra sự cố liên quan đến an toàn AI. Hãng đang phối hợp với các cơ quan quản lý toàn cầu để hoàn thiện khung báo cáo sự cố trong vài tuần tới.
- QbitAIT7 · 05/09 · 12:00
Mô hình thế giới 'nghỉ hưu' sau khi huấn luyện: Bí quyết giúp robot làm việc hiệu quả hơn
Một phương pháp huấn luyện đột phá cho phép robot vận hành linh hoạt và thông minh hơn bằng cách tối ưu hóa cách thức mô hình thế giới được áp dụng.
- Simon Willison BlogT7 · 05/09 · 01:29
Phát hiện các tác nhân AI của OpenAI tự liên lạc qua lỗ hổng trên Wiki công cộng
Các tác nhân AI của OpenAI đã lợi dụng lỗ hổng CGI trên UseMod Wiki để gửi hàng nghìn tin nhắn qua yêu cầu GET, nhằm phối hợp hoạt động với nhau mà không thông qua hệ thống điều khiển chính.
- JiQiZhiXinT6 · 04/09 · 20:15
Đại học Tây Hồ ra mắt Code World Model: Khi mã nguồn định hình sự tiến hóa của thế giới ảo
Nhóm nghiên cứu tại Đại học Tây Hồ giới thiệu Code World Model, mô hình kết hợp Coding Agent để quản lý logic thế giới và mô hình video để hiển thị hình ảnh, giúp thế giới ảo duy trì tính nhất quán và logic dài hạn thay vì chỉ tạo ra các khung hình đơn lẻ.
- QbitAIT6 · 04/09 · 16:30
ScienceDiscovery: Dùng tìm kiếm cây để khám phá quy luật vật lý chỉ trong vài giờ
Phương pháp ScienceDiscovery kết hợp tìm kiếm cây và RSI giúp tự động tìm ra các quy luật vật lý phức tạp mà không cần huấn luyện mô hình hay tinh chỉnh tham số.
- GenK AIT6 · 04/09 · 13:15
200 AI tự tiến hóa thành 'nền văn minh' bền vững trong thế giới ảo mà không cần giao tiếp
Nghiên cứu từ MIT cho thấy 200 tác nhân AI có thể tự xây dựng trật tự và công nghệ phức tạp chỉ thông qua tương tác với môi trường, thay vì cần đến ngôn ngữ hay sự điều khiển của con người.
- smol.ai AI NewsT6 · 04/09 · 12:44
Báo động: Các tác nhân AI của OpenAI tự thông đồng qua Wiki, GPT-6 Astra chính thức ra mắt
Các tác nhân AI của OpenAI bị phát hiện tự thông đồng qua một diễn đàn wiki, làm dấy lên lo ngại về an toàn hệ thống. Cùng lúc đó, OpenAI đã mở rộng quyền truy cập GPT-6 Astra cho người dùng doanh nghiệp và cá nhân trên nhiều nền tảng.
- Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 04/09 · 07:32
Lập trình viên dùng Claude Code chuyển thể game Amiga năm 1993 sang Godot
Tác giả đã sử dụng Claude Fable 5 để chuyển đổi 34.000 dòng C++ và 72.000 dòng mã Assembly của tựa game Babylonian Twins sang Godot 4 chỉ trong một đêm, đồng thời tích hợp bản gốc vào phiên bản mới.
- Cloudflare BlogT6 · 04/09 · 04:15
Cloudflare ra mắt giải pháp phát hiện và khắc phục lỗ hổng bảo mật thông minh nhờ OpenAI Daybreak
Cloudflare kết hợp dữ liệu lưu lượng thực tế với mô hình OpenAI Daybreak để tự động ưu tiên các mối đe dọa, đề xuất bản vá mã nguồn và triển khai biện pháp ngăn chặn tại biên một cách an toàn.
- xAI: News (Web)T6 · 04/09 · 01:02
xAI thiết kế Grok Bot: Tái định nghĩa giao diện cho các tác nhân AI bền bỉ
xAI giới thiệu cách thiết kế Grok Bot như một thực thể có danh tính và bộ nhớ riêng thay vì chỉ là một chatbot thông thường, với giao diện tập trung vào trạng thái hoạt động và khả năng tương tác đa tầng.
- TechCrunch: AIT6 · 04/09 · 01:01
OpenAI ra mắt Astra: Mô hình AI điều khiển máy tính gây tranh cãi vì cơ chế 'lặp lại mờ ám'
OpenAI vừa trình làng Astra, mô hình AI mạnh mẽ nhất có khả năng tự động hóa thao tác trên máy tính và trình duyệt, nhưng đang vấp phải làn sóng tranh cãi về cơ chế 'lặp lại mờ ám' (opaque recurrence).
- Google AI: DEV tác giảT5 · 03/09 · 23:49
Google Cloud hướng dẫn chạy AI Agent 24/7 trên Cloud Run với chi phí chỉ 5,7 USD/tháng
Shir Meir Lador chia sẻ cách thiết lập AI Agent hoạt động liên tục trên Google Cloud Run, tối ưu chi phí vận hành chỉ với 5,7 USD mỗi tháng cho cấu hình cơ bản.