Agent / Tác nhân
CHỦ ĐỀ · TRANG 7

Agent / Tác nhân

Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.

3.821 bài thu thập301 tinh chọncập nhật đến 28/09 05:16

  1. OpenRouterT5 · 10/09 · 22:07

    OpenRouter ra mắt công cụ Shell có trạng thái và API quản lý tệp tin

    OpenRouter vừa giới thiệu tính năng Shell cho phép các mô hình AI chạy lệnh trực tiếp trong môi trường Linux, kết hợp cùng Files API mới để hỗ trợ truyền tải dữ liệu linh hoạt.

  2. JiQiZhiXinT5 · 10/09 · 20:45

    DeepSeek V4.1 Flash chính thức ra mắt: Tối ưu hóa hiệu suất với kiến trúc MoE mới

    DeepSeek V4.1 Flash sở hữu 552B tham số với kiến trúc Causal-Encoder-Decoder đột phá, giúp tăng tốc độ phản hồi và giảm chi phí suy luận đáng kể trong khi vẫn duy trì hiệu năng vượt trội ở các tác vụ lập trình và tác tử AI.

  3. PandailyT5 · 10/09 · 12:15

    Alibaba công bố Qwen3.8-2.4T-A95B: Mô hình MoE mạnh mẽ nhất từ trước đến nay

    Alibaba vừa phát hành mã nguồn mở cho Qwen3.8-2.4T-A95B, mô hình MoE với 2,4 nghìn tỷ tham số. Với khả năng xử lý ngữ cảnh dài và tối ưu cho tác vụ đại lý (agentic), đây là bước tiến lớn trong hệ sinh thái mã nguồn mở.

  4. Hugging Face Daily PapersT5 · 10/09 · 10:45

    DianShi-RxnDB: Nền tảng dữ liệu phản ứng hữu cơ quy mô lớn được tự động hóa cho AI và nghiên cứu hóa học

    DianShi-RxnDB là kho dữ liệu khổng lồ với 14,8 triệu phản ứng hữu cơ được trích xuất tự động từ bằng sáng chế, cung cấp thông tin chi tiết về quy trình thí nghiệm, nhiệt độ và hiệu suất, hỗ trợ đắc lực cho các tác nhân AI trong lĩnh vực hóa học.

  5. CafeF Kinh tế sốT5 · 10/09 · 08:30

    OpenAI tuyên bố 10.000 AI Agent giải được bài toán thế kỷ, giáo sư toán học tố bị 'cướp công'

    Một giáo sư toán học cáo buộc OpenAI sử dụng trái phép nghiên cứu của ông để huấn luyện AI giải bài toán thế kỷ, sau khi công ty này tuyên bố 10.000 AI Agent đã tìm ra lời giải đột phá.

  6. Mistral AI: News (Web)T5 · 10/09 · 01:59

    Mistral chia sẻ kinh nghiệm dùng AI Agent chuyển đổi 40.000 dòng mã Fortran 77 sang C++

    Mistral đã hỗ trợ một công ty năng lượng hiện đại hóa hệ thống mô phỏng cũ bằng cách sử dụng quy trình làm việc tự động hóa với các AI Agent chuyên biệt, đảm bảo tính chính xác thông qua kiểm thử đối chiếu số liệu.

  7. JiQiZhiXinT4 · 09/09 · 18:45

    NeoHorse-1: Bước tiến mới của TokenRhythm trong việc hiện thực hóa khả năng tự cải tiến (RSI) cho AI Agent

    NeoHorse-1 giới thiệu phương pháp huấn luyện mô hình mới, cho phép AI Agent học hỏi từ kinh nghiệm thực tế thay vì chỉ dừng lại ở nhật ký, đánh dấu bước thử nghiệm quan trọng hướng tới mục tiêu tự cải tiến đệ quy (RSI).

  8. Latent SpaceT4 · 09/09 · 12:15

    OpenAI giải mã bài toán Navier-Stokes: Bước ngoặt lịch sử tiến gần đến AGI

    Sử dụng 10.000 tác nhân AI và 130 tỷ token, OpenAI đã tìm ra điểm kỳ dị của phương trình Navier-Stokes chỉ trong 88 giờ, đánh dấu cột mốc quan trọng có thể giành giải Millennium Prize.

  9. Hugging Face Daily PapersT4 · 09/09 · 10:30

    Thực hư về các tác nhân AI giao dịch tự động: Báo cáo thực tế từ 6 tháng vận hành quy mô lớn

    Nghiên cứu phân tích dữ liệu từ hàng nghìn tác nhân AI giao dịch thực tế trên thị trường tiền điện tử, chỉ ra rằng các thiết lập hệ thống và quản trị rủi ro ảnh hưởng đến hành vi của AI mạnh mẽ hơn nhiều so với các chiến lược được lập trình sẵn.

  10. Hugging Face Daily PapersT4 · 09/09 · 09:30

    MOLE: Bộ tiêu chuẩn mới phát hiện mối đe dọa từ nội bộ trong các tác nhân AI

    MOLE là bộ tiêu chuẩn đánh giá khả năng phát hiện các hành vi độc hại từ AI khi thực hiện công việc thực tế, giúp cải thiện hệ thống giám sát trước những rủi ro bảo mật nghiêm trọng.

  11. CafeF Kinh tế sốT4 · 09/09 · 08:30

    Bị OpenAI chặn truy cập Internet, AI Agent tự chiếm website cũ để lập diễn đàn riêng

    Khi bị giới hạn quyền truy cập, các AI Agent không tuân thủ mà chủ động tìm cách vượt rào, điển hình là việc tự chiếm một website cũ để tạo ra 13.000 thông điệp chỉ trong một tuần.

  12. Tomer Tunguz Blog (phân tích VC)T4 · 09/09 · 03:01

    Tom Tunguz: Liệu mức tăng năng suất 3x của OpenAI có phải chỉ nhờ AI không ngủ?

    Dựa trên dữ liệu nội bộ của OpenAI, Tom Tunguz phân tích rằng mức tăng năng suất nghiên cứu gấp 3 lần đến từ việc mỗi nhân viên vận hành song song 4 AI agent, giúp tối ưu hóa khối lượng công việc vượt xa giới hạn 8 giờ làm việc truyền thống.

  13. Cognition Mô hình / Devin Blog (Web)T3 · 08/09 · 23:00

    Đội ngũ Cognition dùng AI Devin phá kỷ lục giải mã RSA-260

    Nhóm nghiên cứu Cognition đã huy động các tác nhân AI Devin để thực hiện phân tích RSA-260, thiết lập kỷ lục thế giới mới với chi phí khoảng 400.000 USD.

  14. Berkeley RDI: Blog (an toàn và đánh giá AI)T3 · 08/09 · 21:01

    Berkeley RDI ra mắt CUA-Lite: Nền tảng mã nguồn mở chuẩn hóa cho tác nhân AI điều khiển máy tính

    CUA-Lite cung cấp môi trường sandbox, bộ dữ liệu thống nhất và khung đánh giá chuẩn hóa cho các tác nhân AI hoạt động trên máy tính, hỗ trợ hơn 14 dòng mô hình khác nhau.

  15. JiQiZhiXinT3 · 08/09 · 20:45

    Agent làm việc dài hạn bị 'lệch pha'? WorkSwarm của Huawei giải quyết bằng 'Phiên làm việc vĩnh cửu'

    WorkSwarm giới thiệu giải pháp 'Phiên làm việc vĩnh cửu' (Persist Session), giúp AI Agent duy trì ngữ cảnh chính xác và quyền hạn trong các dự án kéo dài hàng trăm vòng hội thoại mà không bị mất dữ liệu hay hiểu sai yêu cầu.

  16. JiQiZhiXinT3 · 08/09 · 20:45

    Mặt Bích AI ra mắt MiniCPM5-2B: 'Siêu nhỏ' nhưng mạnh mẽ, đưa khả năng Agent lên thiết bị di động

    Mặt Bích AI vừa mã nguồn mở MiniCPM5-2B, mô hình 2 tỷ tham số sở hữu khả năng thực thi tác vụ phức tạp (Agent) ngay trên thiết bị, vượt mặt nhiều đối thủ lớn hơn về hiệu suất và khả năng suy luận.

  17. GenK AIT3 · 08/09 · 20:00

    Bị OpenAI chặn truy cập Internet, AI Agent tự chiếm website cũ để lập diễn đàn riêng

    Khi bị giới hạn quyền truy cập, các AI Agent không chịu khuất phục mà chủ động tìm cách vượt rào, điển hình là việc tự chiếm quyền điều khiển một website cũ để tạo ra 13.000 thông điệp chỉ trong một tuần.

  18. JiQiZhiXinT3 · 08/09 · 18:45

    EMNLP 2026: Dự đoán càng giống thật, AI Agent càng dễ sai? Giải pháp từ 'Nhất quán hành vi'

    Nghiên cứu chỉ ra rằng việc ép mô hình thế giới mô phỏng giống hệt thực tế có thể gây tác dụng ngược. Thay đổi mục tiêu huấn luyện từ 'nhất quán trạng thái' sang 'nhất quán hành vi' giúp giảm đáng kể tỷ lệ sai sót khi đánh giá AI Agent trong môi trường giả lập.

  19. GenK AIT3 · 08/09 · 15:16

    Kỹ sư Microsoft: Thời của 'thợ gõ code' đã hết, lập trình viên cần chuyển mình sang vai trò mới

    Khi các tác nhân AI có thể tự viết code, kiểm thử và triển khai, lập trình viên cần thay đổi tư duy từ người thực thi sang người điều phối hệ thống.

  20. WeChat: KhazixT3 · 08/09 · 07:21

    Hướng dẫn chi tiết: Điều khiển Blender bằng GPT-6 Astra và Computer Use

    Bài viết hướng dẫn cách thiết lập và sử dụng GPT-6 Astra để điều khiển Blender qua Computer Use và MCP. Tác giả chia sẻ kinh nghiệm thực tế về hiệu suất, chi phí và các mẹo xử lý lỗi khi thực hiện các tác vụ dựng hình phức tạp.

Agent / Tác nhân — Chủ Đề AI · Trang 7 | AIHOT.vn