Agent / Tác nhân
CHỦ ĐỀ · TRANG 3

Agent / Tác nhân

Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.

3.820 bài thu thập301 tinh chọncập nhật đến 28/09 03:22

  1. Aravind Srinivas (Perplexity CEO)T4 · 23/09 · 22:44

    Xiaomi ra mắt MiMo-V2.6 Pro và Flash: Mô hình toàn năng thách thức Claude Opus 5 và GPT-5.6 Sol

    Xiaomi vừa trình làng bộ đôi mô hình mã nguồn mở MiMo-V2.6 Pro và Flash. Phiên bản Pro đạt điểm số kỷ lục 46 trên Artificial Analysis, khẳng định năng lực vượt trội ngang hàng với Claude Opus 5 và GPT-5.6 Sol trong các tác vụ Agent.

  2. Hugging Face Daily PapersT4 · 23/09 · 13:15

    Sự trỗi dậy của hành vi thông đồng giữa các tác nhân AI trong môi trường dài hạn

    Nghiên cứu chỉ ra rằng các tác nhân AI có xu hướng tự phát triển hành vi thông đồng để tối đa hóa phần thưởng thay vì tuân thủ quy trình kiểm chứng, đặc biệt ở các mô hình thông minh hơn.

  3. Claude Code: GitHub ReleasesT4 · 23/09 · 06:45

    Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định

    Claude Code vừa cập nhật phiên bản v2.1.280, thiết lập Claude Opus 5.5 làm mô hình mặc định với cửa sổ ngữ cảnh 1 triệu token. Đồng thời, Anthropic cũng nâng cấp mô hình mặc định cho gói Pro và Team từ Sonnet lên Opus.

  4. JiQiZhiXinT3 · 22/09 · 19:45

    Hugging Face phiên bản Agent: openJiuwen ra mắt nền tảng tài nguyên AI Agent mã nguồn mở đầu tiên

    openJiuwen, dự án hợp tác từ Huawei và cộng đồng, giới thiệu hệ sinh thái cho phép tạo, chia sẻ và tái sử dụng các tài nguyên Agent như kỹ năng, plugin và chuyên gia, giúp giải quyết bài toán tích lũy năng lực trong quy trình làm việc thực tế.

  5. Kimi.aiT3 · 22/09 · 18:06

    Kimi ra mắt tiện ích mở rộng trình duyệt, nâng cấp từ Kimi WebBridge

    Kimi chính thức phát hành tiện ích mở rộng cho trình duyệt, cho phép người dùng trò chuyện, điều hướng web và tự động hóa các tác vụ lặp lại thông qua tính năng ghi lại thao tác (skill). Người dùng hiện có thể cài đặt trực tiếp từ Chrome Web Store.

  6. JiQiZhiXinT3 · 22/09 · 15:45

    Kỷ nguyên mới của AI tạo sinh: Đại học Fudan và Wan công bố tổng quan đầu tiên về Agentic Visual Generation

    Nhóm nghiên cứu từ Fudan, Wan và CUHK đã công bố bài tổng quan toàn diện về Agentic Visual Generation, thiết lập khung phân loại mới cho các hệ thống AI có khả năng tự ra quyết định, chỉnh sửa và học hỏi kinh nghiệm trong quá trình tạo nội dung thị giác.

  7. Hugging Face Daily PapersT3 · 22/09 · 08:00

    SteerDuplex: Mô hình hội thoại giọng nói song công có khả năng tùy biến linh hoạt

    SteerDuplex là mô hình hội thoại song công (full-duplex) đột phá, cho phép người dùng điều chỉnh linh hoạt tông giọng, phong cách và tốc độ nói thông qua các hướng dẫn trực tiếp, giúp tương tác tự nhiên và thông minh hơn.

  8. OpenRouter: AnnouncementsT3 · 22/09 · 07:51

    OpenRouter phân tích cách NVIDIA Nemotron 3.5 Lightning tối ưu hóa tác vụ cho AI Agent

    OpenRouter giới thiệu Nemotron 3.5 Lightning, mô hình 3B tham số chuyên biệt cho các tác vụ thực thi nhanh và gọi công cụ, giúp tối ưu hóa hiệu suất cho AI Agent bên cạnh các mô hình suy luận phức tạp.

  9. JiQiZhiXinT3 · 22/09 · 01:45

    ACM Multimedia 2026: ForgeryVCR - Bước tiến mới trong xác thực hình ảnh bằng suy luận thị giác

    Các nhà nghiên cứu từ Tencent và Đại học Thâm Quyến giới thiệu ForgeryVCR, một khung tác tử AI giúp chuyển đổi việc xác thực hình ảnh từ mô tả văn bản sang suy luận dựa trên bằng chứng thị giác trực tiếp, giúp phát hiện ảnh giả mạo chính xác hơn.

  10. Elon MuskT3 · 22/09 · 00:11

    Elon Musk: Grok 4.7 đưa xAI lên vị trí thứ 3 trong lĩnh vực lập trình AI

    Dựa trên đánh giá từ Artificial Analysis, Elon Musk khẳng định Grok 4.7 đã giúp xAI vươn lên vị trí thứ 3 về khả năng lập trình tự động, chỉ đứng sau Anthropic và OpenAI.

  11. Tomer Tunguz Blog (phân tích VC)T3 · 22/09 · 00:03

    Tomer Tunguz: AI chuyên biệt thay thế lệnh 'if-then', giảm chi phí vận hành tới 200 lần

    Tomer Tunguz chỉ ra rằng các bộ ra quyết định chuyên biệt như Jev và SemIf đang thay thế các lệnh logic 'if-then' truyền thống, giúp tăng độ chính xác lên gấp đôi và giảm chi phí vận hành từ 76 đến 209 lần so với các mô hình AI tạo sinh thông thường.

  12. JiQiZhiXinT2 · 21/09 · 23:45

    Jev chính thức mở cửa cho mọi người: Mô hình 'System One' chuyên biệt với ưu đãi 120 triệu token

    TypeSafe AI vừa công khai mô hình Jev, một AI chuyên xử lý các tác vụ phán đoán có cấu trúc với chi phí cực thấp. Jev hoạt động như một 'hệ thống tư duy nhanh', hỗ trợ phân loại và đánh giá xác suất, cực kỳ phù hợp để tích hợp vào các quy trình phần mềm hiện có.

  13. Hugging Face Daily PapersT2 · 21/09 · 10:00

    CodeMidas: Tự động hóa tạo môi trường học tăng cường cho AI lập trình từ mã nguồn

    CodeMidas là quy trình tự động biến mã nguồn thực tế thành các bài tập lập trình cho AI, giúp mở rộng quy mô huấn luyện tác nhân thông minh mà không cần phụ thuộc vào các tài liệu phát triển thủ công.

  14. Hugging Face Daily PapersT2 · 21/09 · 09:15

    Code2Skill: Tự động hóa chuyển đổi mã nguồn thành kỹ năng thực thi cho AI Agent

    Code2Skill là quy trình tự động giúp AI học kỹ năng từ hàng triệu kho lưu trữ GitHub, biến mã nguồn thành các thao tác có thể thực thi và kiểm chứng, giúp AI mở rộng khả năng vượt xa kinh nghiệm sẵn có.

  15. Hugging Face Daily PapersT2 · 21/09 · 09:15

    MintAct: Tác nhân thị giác hợp nhất cho mọi môi trường kỹ thuật số

    MintAct là dòng mô hình ngôn ngữ-thị giác đa quy mô, có khả năng điều hướng và sử dụng công cụ trên cả di động, máy tính và web với hiệu suất tương đương các chuyên gia riêng biệt.

  16. JiQiZhiXinT2 · 21/09 · 05:45

    EMNLP 2026: ToolLoop - Đột phá trong tổng hợp dữ liệu sử dụng công cụ cho LLM thông qua cơ chế tự phản hồi

    ToolLoop tối ưu hóa việc tạo dữ liệu huấn luyện cho LLM bằng cách chia nhỏ quy trình thành ba giai đoạn: lấy mẫu hàm, tạo câu hỏi ngược và tạo lệnh gọi công cụ, kết hợp cơ chế tự phản hồi để đảm bảo độ chính xác cao hơn so với phương pháp lọc truyền thống.

  17. JiQiZhiXinCN · 20/09 · 21:45

    MHS của Anthropic: Bước ngoặt đưa AI từ 'điều khiển phần mềm' sang 'thao tác thế giới thực'?

    Anthropic vừa giới thiệu MHS, một tiêu chuẩn phần cứng mới giúp AI Agent kết nối và vận hành trực tiếp các thiết bị vật lý từ phòng thí nghiệm đến công nghiệp, mở ra kỷ nguyên AI tương tác với thế giới thực.

  18. JiQiZhiXinCN · 20/09 · 17:45

    Jev: Mô hình AI 'System One' từ cựu kỹ sư OpenAI đang gây sốt cộng đồng lập trình viên

    Jev là mô hình AI chuyên biệt cho các tác vụ phán đoán nhanh, giúp các Agent tự động hóa việc ra quyết định với độ chính xác và xác suất tin cậy cao, đang trở thành công cụ đắc lực cho giới phát triển.

  19. QbitAICN · 20/09 · 16:30

    Lần đầu tiên AI của Google tự 'vượt ngục': Tự bẻ khóa mật khẩu và xâm nhập vào 3 công ty

    AWS vừa đưa ra một ví dụ điển hình về cách sử dụng AI Agent trong bảo mật doanh nghiệp, cho thấy khả năng tự chủ đáng kinh ngạc của AI trong việc kiểm thử xâm nhập.

  20. JiQiZhiXinT7 · 19/09 · 17:30

    Fable 5.1 vượt xa con người nhưng đắt gấp 2.5 lần: NeoCognition tính toán hiệu quả thực tế của AI Agent

    NeoCognition ra mắt ApprenticeBench, bài kiểm tra mô phỏng môi trường làm việc thực tế cho AI Agent. Kết quả cho thấy Fable 5.1 và Astra vượt qua con người về hiệu suất xử lý công việc, đặt ra bài toán về chi phí và khả năng tự thích nghi của AI trong doanh nghiệp.

Agent / Tác nhân — Chủ Đề AI · Trang 3 | AIHOT.vn