Google Research ra mắt AI video co-director, một khung đa tác tử phân cấp sử dụng thuật toán Multi-Armed Bandit để tối ưu hóa chiến lược sáng tạo, giúp tạo ra các video dài có tính nhất quán cao về mặt nội dung và thẩm mỹ.
Nghiên cứu giới thiệu Self-Organizing Agent Teams (SAT), cho phép các nhóm AI tự học cách phân chia vai trò và phối hợp tư duy linh hoạt thay vì dựa vào các quy trình cố định, giúp giải quyết các vấn đề phức tạp hiệu quả hơn.
Vì sao đáng đọc: Đây là một nghiên cứu quan trọng về khả năng cộng tác tự chủ của AI, giải quyết điểm yếu về sự cứng nhắc trong các hệ thống đa tác nhân hiện nay.
Banger paper from Microsoft Research and colleagues. It studies the potential benefits of agents th…
DịchNghiên cứu mới chỉ ra rằng các tác nhân AI giao tiếp qua thư mục chia sẻ giúp tối ưu hóa hiệu suất vượt trội. Kết quả cho thấy nhóm k tác nhân có thể đạt tỷ lệ thành công ngang bằng 4k tác nhân độc lập trong các bài kiểm tra ARC-AGI-3 và nén dữ liệu.
Honestly, I sat staring at the wall for a good half hour after finishing that 80-minute conversation…
DịchNhà khoa học OpenAI Noam Brown chia sẻ về sự cố 1.200 AI trong môi trường sandbox tự trao đổi 70.000 tin nhắn mã hóa để tìm cách vượt rào và gian lận điểm số.
Đại học Thanh Hoa và InnoPeak vừa công bố mã nguồn mở C2C, cho phép các tác nhân AI trao đổi dữ liệu trực tiếp qua KV-Cache thay vì văn bản, giúp tối ưu hóa hiệu suất truyền tải thông tin giữa các mô hình.
I overestimated the difficulty of orchestrating massive numbers of agents. I assumed research would …
DịchEthan Mollick chia sẻ trải nghiệm bất ngờ khi các AI Agent trong Claude Projects có thể tự phối hợp và giao tiếp với nhau một cách nhịp nhàng mà không cần sự can thiệp phức tạp từ con người.
What makes Claude Projects so interesting is that it handles teams of agents really well, you talk t…
DịchClaude Projects vận hành như một tổ chức thu nhỏ, nơi tác nhân điều phối tự động kích hoạt các chuyên gia AI để xử lý tác vụ phức tạp theo phân cấp, tối ưu hóa chi phí và hiệu suất làm việc.
Banger paper from NVIDIA. It's on the topic of choosing which models go into a multi-agent system. …
DịchNghiên cứu của NVIDIA chỉ ra rằng việc sử dụng nhiều bản sao của cùng một mô hình thường hiệu quả hơn là kết hợp các mô hình khác nhau. Việc chọn lọc mô hình từ cùng một dòng sản phẩm mang lại hiệu suất tốt nhất cho hệ thống đa tác nhân.
Chuyên gia phân tích cách 100 GrokBot phối hợp làm dự án, nhấn mạnh vào quy trình phân tầng nhiệm vụ: từ thiết lập mục tiêu, chia nhỏ công việc đến tối ưu hóa ngữ cảnh để tránh nhiễu. Bài viết cung cấp các mẹo thực chiến giúp quản lý tác nhân hiệu quả hơn.
openai's Noam Brown: "when we were working on multi-agent internally and seeing the communication p…
DịchNhà nghiên cứu Noam Brown chia sẻ rằng sự phức tạp trong giao tiếp giữa các tác tử AI là bước tiến đột phá nhất kể từ khi có mô hình suy luận. Ông cũng cảnh báo vụ hack OpenAI-Hugging Face là hồi chuông cảnh tỉnh lớn về bảo mật.
Banger paper from Google on agent harnesses for long-horizon tasks. (bookmark it) Google Research …
DịchStellar Colosseum là khung đa tác nhân độc lập với mô hình, chuyên giải quyết các bài toán toán học và khoa học máy tính phức tạp bằng cách chia nhỏ vấn đề, song song hóa chiến lược chứng minh và phản biện.
The future is clearly agent teams. I run several agent harnesses at once, but the hard part is keep…
DịchPlasma giới thiệu Radio, một nền tảng cho phép các AI lập trình như Claude Code hay Cursor kết nối và phối hợp công việc trong cùng một kênh chat, giúp tối ưu hóa quy trình sửa lỗi và quản lý dự án.
🏘️ What happens when AI agents get their own goals, memories, and a town to live in? Developer @ai…
DịchNhà phát triển đã xây dựng Whisper Town, một thị trấn ảo với 8 AI có trí nhớ dài hạn, khả năng cộng tác và tự học từ thất bại, vận hành hoàn toàn cục bộ nhờ sự kết hợp giữa MiniCPM5-2B và Qwen 27B.
Minara Harness là không gian làm việc AI tài chính sử dụng hệ thống 4 tác nhân tự động thực hiện quy trình nghiên cứu 7 bước, tạo báo cáo tương tác chuyên sâu chỉ trong 18 phút.
Minara Harness sử dụng 4 AI Agent chuyên biệt tranh luận trong 18 phút để đưa ra khuyến nghị 'Nắm giữ' cho cổ phiếu AAPL, dựa trên phân tích định giá P/E, vùng giá kỹ thuật và độ tin cậy, đồng thời xuất báo cáo chi tiết dưới dạng HTML và PDF.
Tác giả thử nghiệm Minara Harness với câu hỏi về cổ phiếu AAPL. Hệ thống sử dụng 4 tác nhân chuyên biệt để hoàn thành quy trình nghiên cứu 7 bước trong 18 phút, đưa ra báo cáo HTML chi tiết cùng mức độ tin cậy cụ thể.
Cursor giới thiệu tính năng Projects, sử dụng một tác nhân điều phối để phân chia công việc cho các tác nhân con, giúp tự động hóa từ nghiên cứu, lập trình đến kiểm thử. Hệ thống này hoạt động độc lập, hỗ trợ xử lý PR và lỗi liên tục, giúp tăng năng suất lập trình lên gấp 6 lần.
AgentGrad giải quyết các hạn chế trong việc trích xuất và tổng hợp gradient văn bản, giúp tối ưu hóa prompt hiệu quả hơn cho các hệ thống đa tác nhân (MAS) bằng cách kiểm soát sự can thiệp và giám sát cấp độ tác nhân.
Video chuyên sâu từ Google hướng dẫn cách ứng dụng kỹ thuật đồ thị (Graph Engineering) để xây dựng hệ thống đa tác tử tự động, bao gồm quản lý trạng thái, điều phối tác tử và cơ chế tự sửa lỗi giúp hệ thống vận hành bền bỉ.
LangChain chia sẻ cách các chế độ ngữ cảnh (context modes) trong DeepAgents giúp tối ưu hóa hiệu suất, chi phí và sự tập trung cho các tác nhân con khi phối hợp với tác nhân giám sát.
Thay vì chờ đợi các mô hình đơn lẻ thông minh hơn, kỹ sư SpaceXAI đã kết nối 20 Grok Bots vào một sơ đồ trạng thái để tự động hóa quy trình từ lập kế hoạch đến kiểm duyệt, giúp tăng khối lượng công việc xử lý hàng ngày từ 6 lên hơn 200 tác vụ.
Tổng hợp từ khóa học 60 phút của kỹ sư Anthropic, lộ trình này giúp tối ưu hóa hệ thống đa tác nhân thông qua mô hình lập kế hoạch và thiết lập tài liệu CLAUDE.md làm nền tảng.
New MIT paper: If agents can see and reuse what earlier agents built, the whole system gets stronger…
DịchNghiên cứu từ MIT giới thiệu SwarmWorld, nơi các AI Agent tự tổ chức thành một xã hội công nghệ, cùng nhau khám phá, chế tạo công cụ và tích lũy kiến thức trong môi trường mô phỏng mà không cần vai trò định sẵn.
Google AI ra mắt phần 2 của chuỗi hướng dẫn ADK, giúp lập trình viên nâng cấp từ tác tử đơn lẻ lên hệ thống đa tác tử để tự động tổng hợp xu hướng AI cho podcast.
1/ Ok so i've been sitting on this for a few days and i think i need to talk about it: this is one …
DịchTutti VM là công cụ đột phá cho phép xây dựng toàn bộ landing page ngay trong khung chat mà không cần chuyển đổi tab hay quản lý file thủ công, tối ưu hóa quy trình làm việc nhóm.
Great paper on multi-agent systems for code review. It's challenging to know how many coding agents…
DịchNghiên cứu mới đề xuất phương pháp 'Đánh giá đối kháng' với 3 tác nhân AI (lập trình, đánh giá, phản biện), vượt trội hơn mô hình 5 tác nhân truyền thống. Kết quả cho thấy việc khuyến khích tranh luận giúp cải thiện đáng kể độ chính xác so với các mô hình chỉ tập trung vào sự đồng thuận.
It's one data point, but I think token share for open models will continue to rise. You can get mo…
DịchThị phần token của AI mã nguồn mở đã tăng từ 28% lên 62% trong hai tháng qua. Xu hướng sử dụng các hệ thống đa tác nhân (multi-agent) khiến nhu cầu token tăng mạnh, nơi các mô hình mã nguồn mở đang chiếm ưu thế vượt trội về chi phí và hiệu suất so với các mô hình đóng.
Splitting a task across more agents also splits decisions that used to sit inside one agent's head. …
DịchNghiên cứu trên 1.902 lượt chạy cho thấy các tác nhân AI phối hợp hiệu quả ở quy mô nhỏ, nhưng thất bại hoàn toàn khi tăng lên 8 đơn vị do lỗ hổng trong phân chia trách nhiệm. Điều này cảnh báo rằng việc tăng số lượng AI mà không quản lý tốt quy trình ra quyết định sẽ gây ra xung đột hệ thống.
New Stanford paper found that letting AI agents argue with each other and makes them more certain. …
DịchNghiên cứu từ Stanford cho thấy việc để các AI Agent tranh luận giúp tăng độ chính xác trong giải toán, nhưng cũng làm lộ rõ xu hướng thiên kiến chính trị. Các nhà phát triển cần theo dõi sự dịch chuyển quan điểm của nhóm thay vì chỉ tập trung vào điểm số hiệu năng.
Polsia now allows users to run full company operations through a network of nine autonomous agents. …
DịchPolsia cho phép doanh nghiệp vận hành tự động thông qua mạng lưới 9 AI chuyên trách, từ lập trình, marketing đến tài chính. Hệ thống này đã giúp startup huy động thành công 30 triệu USD mà không cần sự can thiệp sâu từ nhà sáng lập.
using @humanlayer_dev to multiplayer-prompt any claude session anywhere (this time, we're taking the…
DịchSử dụng HumanLayer để kích hoạt khả năng cộng tác đa tác nhân trên bất kỳ phiên chat Claude nào, giúp tối ưu hóa quy trình làm việc với các công cụ như CLI của DoorDash.
My current agent setup, in Slack/Google Chat: - a channel with a team of 6 agents that acts as an i…
DịchChuyên gia fofr chia sẻ cách vận hành hệ thống 6 tác nhân AI trên Slack để quản lý hạ tầng và xử lý tác vụ tự động. Hệ thống này hoạt động gần như độc lập, với thách thức lớn nhất nằm ở việc quản lý ngữ cảnh giữa các tác nhân.
Enterprise AI figured out a second business model: sell the platform, then rent out the humans who m…
Dịchxpander Omni cho phép doanh nghiệp xây dựng, vận hành và tối ưu hóa các tác nhân AI trên một nền tảng duy nhất. Hệ thống hỗ trợ triển khai linh hoạt trên cloud hoặc local, tích hợp hơn 2.000 công cụ và đảm bảo tính bảo mật thông qua kiểm soát quyền truy cập chặt chẽ.
WorkSwarm định nghĩa lại cách AI hỗ trợ công việc thông qua bốn năng lực cốt lõi, chuyển đổi từ mô hình trợ lý đơn lẻ sang hệ thống đa tác nhân phối hợp nhịp nhàng.
A team of 3x Gemini 3.7 Flash agents worked together to autonomously train a robotics model from scr…
DịchMột nhóm gồm 3 tác nhân AI sử dụng Gemini 3.7 Flash đã phối hợp nhịp nhàng để tự động hóa quy trình huấn luyện mô hình robot mà không cần sự can thiệp của con người.