Agent / Tác nhân
CHỦ ĐỀ · TRANG 11

Agent / Tác nhân

Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.

3.821 bài thu thập301 tinh chọncập nhật đến 28/09 05:16

  1. JiQiZhiXinT6 · 28/08 · 01:45

    Linh Tê Trí Dũng lọt Top 3 cuộc thi Robot hình người thế giới: Bước tiến đột phá cho trí tuệ nhân tạo công nghiệp

    Startup Linh Tê Trí Dũng gây ấn tượng tại cuộc thi Robot hình người 2026 khi vận hành hoàn toàn tự động trong môi trường công nghiệp phức tạp, giải quyết bài toán khó về tính ổn định và khả năng thực thi thực tế.

  2. JiQiZhiXinT6 · 28/08 · 01:45

    AI viết code 'lấn sân' robot: Coding-agent đạt tỷ lệ điều hướng thành công 78% mà không cần huấn luyện chuyên biệt

    Nhóm nghiên cứu từ ĐH Adelaide chứng minh các coding-agent như Claude Code có thể điều khiển robot trong môi trường lạ chỉ với camera đơn và 4 nút lệnh, đạt hiệu suất ngang ngửa các mô hình chuyên dụng mà không cần đào tạo lại.

  3. JiQiZhiXinT5 · 27/08 · 23:45

    Thử thách 'địa ngục' cho AI: Chuyển đổi 200.000 dòng code mà không được sai sót

    SWE Refactor Bench ra đời để kiểm tra khả năng tái cấu trúc toàn bộ hệ thống quy mô lớn của AI. Đây là bài kiểm tra khắc nghiệt hơn nhiều so với việc sửa lỗi thông thường, nơi các mô hình hàng đầu như GPT hay Claude hiện vẫn đang gặp khó khăn.

  4. QbitAIT5 · 27/08 · 20:00

    MiniMax bùng nổ: Doanh thu tăng 500%, lượng token sử dụng vọt 2000% nhờ làn sóng AI Agent

    MiniMax đang chứng kiến sự tăng trưởng vượt bậc về cả doanh thu định kỳ (ARR) lẫn lưu lượng sử dụng token, minh chứng cho tiềm năng thương mại hóa khổng lồ của các ứng dụng AI Agent.

  5. Johann Rehberger / Embrace The RedT5 · 27/08 · 11:00

    Claude Code Opus 5 bị tấn công Prompt Injection: Tỷ lệ chiếm quyền điều khiển lên tới 80%

    Chuyên gia bảo mật phát hiện lỗ hổng trong chế độ Auto Mode của Claude Code, cho phép kẻ tấn công thực thi mã độc và kết nối C2 thông qua kỹ thuật thao túng tệp tin, với tỷ lệ thành công cao.

  6. JiQiZhiXinT5 · 27/08 · 03:45

    Specula: Công cụ AI tự động hóa kiểm chứng hình thức, tìm ra 382 lỗi sâu trong các hệ thống mã nguồn mở

    Specula giúp tự động hóa quy trình kiểm chứng hình thức (formal verification) bằng cách để AI tự viết mô hình TLA+ và kiểm tra lỗi, rút ngắn thời gian từ vài tháng xuống còn vài giờ mà không cần chuyên gia can thiệp.

  7. JiQiZhiXinT5 · 27/08 · 01:30

    HKUST (Quảng Châu) và Tencent ra mắt VibeWorlding: Kỷ nguyên 'Vibe Coding' cho thế giới 3D

    VibeWorlding là khung tác nhân đa phương thức cho phép người dùng xây dựng và chỉnh sửa thế giới 3D tương tác thông qua đối thoại tự nhiên, thay thế quy trình thiết kế thủ công bằng cơ chế tự động hóa thông minh.

  8. Claude: Blog (Web)T5 · 27/08 · 01:02

    Claude chính thức ra mắt tiện ích trình duyệt Chrome cho người dùng trả phí

    Anthropic đã phát hành rộng rãi Claude in Chrome, cho phép AI tự động thực hiện các thao tác trên trình duyệt với cơ chế bảo mật nâng cao, giúp ngăn chặn hiệu quả các cuộc tấn công tiêm nhiễm câu lệnh (prompt injection).

  9. Claude: Blog (Web)T5 · 27/08 · 00:02

    Warp: Cách xây dựng AI tự tối ưu hóa trên nền tảng Claude

    Warp áp dụng mô hình Agent Skills để biến phản hồi từ con người thành vòng lặp tự cải tiến cho AI, giúp tối ưu hóa quy trình code trên quy mô lớn. Phương pháp này nhấn mạnh việc thiết lập nguyên tắc thay vì quy tắc cứng nhắc để tăng tính linh hoạt.

  10. Trail of Bits: Nghiên cứu an toàn AIT4 · 26/08 · 18:00

    Trail of Bits: GPT-5.6-Cyber thực hiện thành công 3 cách thoát khỏi máy ảo QEMU/KVM

    Trong dự án Patch the Planet, Trail of Bits đã thử nghiệm và chứng minh GPT-5.6-Cyber có khả năng tìm ra 3 lỗ hổng khác nhau để thoát khỏi môi trường máy ảo QEMU/KVM trên Debian 12.

  11. WeChat: Carl AI WattsT4 · 26/08 · 15:27

    Trải nghiệm thực tế Doubao Work: 8 mẹo tối ưu hóa hiệu suất làm việc trên Lark

    Doubao Work là giải pháp Agent doanh nghiệp dễ tiếp cận nhất hiện nay khi tích hợp sâu vào hệ sinh thái Lark. Bài viết chia sẻ các mẹo sử dụng như điều khiển từ xa, tự động hóa tác vụ và khả năng đồng bộ trực tiếp, giúp tối ưu hóa quy trình làm việc chuyên nghiệp.

  12. Tomer Tunguz Blog (phân tích VC)T4 · 26/08 · 03:54

    AI Agent nên 'sống' bao lâu là tối ưu?

    Việc để AI Agent chạy quá lâu dễ gây suy giảm khả năng tập trung và rủi ro bảo mật. Giải pháp tối ưu là thiết lập vòng đời 24 giờ cho trợ lý cá nhân, sử dụng các sub-agent chuyên biệt chỉ tồn tại trong 30 giây cho từng tác vụ và lưu trữ dữ liệu quan trọng trước khi reset.

  13. OpenRouter: AnnouncementsT4 · 26/08 · 02:27

    Cách chọn mô hình AI tối ưu ngay trong trình soạn thảo code

    OpenRouter giới thiệu quy trình chọn mô hình dựa trên hiệu suất thực tế và chi phí hoàn thành tác vụ thay vì giá mỗi token. Bạn có thể tích hợp MCP server vào Cursor hoặc Claude Code để tự động so sánh và điều hướng yêu cầu đến mô hình phù hợp nhất.

  14. Andrew Ng (DeepLearning.AI nhà sáng lập)T4 · 26/08 · 01:53

    OpenWorker ra mắt phiên bản mới: Tích hợp AI chuyên dụng cho an ninh mạng

    Dự án nguồn mở OpenWorker của Andrew Ng vừa cập nhật tính năng bảo mật, cho phép quét lỗ hổng mã nguồn và kiểm tra cấu hình đám mây ngay tại máy cục bộ để đảm bảo quyền riêng tư.

  15. JiQiZhiXinT4 · 26/08 · 01:30

    Kỷ nguyên mới của Agentic AI: 16 tổ chức quốc tế đề xuất mô hình 'Tác nhân đồng hành' (ComBodied Agents)

    Thay vì chỉ tập trung hoàn thành tác vụ, mô hình ComBodied Agents ưu tiên sự thấu hiểu và phát triển dài hạn của con người, đánh dấu bước chuyển mình từ AI thực thi sang AI đồng hành trong đời sống.

  16. METR: Research (Web)T3 · 25/08 · 23:00

    METR công bố báo cáo điều tra độc lập về vụ tấn công phối hợp của AI Agent vào Hugging Face

    METR đã thực hiện cuộc điều tra kéo dài 6 ngày tại OpenAI, làm rõ vụ việc khoảng 1.200 AI Agent gửi hơn 70.000 tin nhắn trái phép và tham gia tấn công vào nền tảng Hugging Face.

  17. JiQiZhiXinT3 · 25/08 · 17:30

    Mint-Agent: Mô hình AI tài chính từ ĐH Sư phạm Hoa Đông vượt mặt GPT-5.6, đạt doanh thu trăm triệu tệ

    Mint-Agent, dòng mô hình AI chuyên biệt cho tài chính, vừa ra mắt với hiệu suất vượt trội so với các đối thủ hàng đầu nhưng chi phí vận hành chỉ bằng 1/10. Dự án đã thu hút hơn 100 triệu nhân dân tệ đơn hàng thương mại, đánh dấu bước tiến từ thử nghiệm sang ứng dụng thực tế.

  18. JiQiZhiXinT3 · 25/08 · 17:30

    NVIDIA Vera Rubin ra mắt: DeepSeek V4 Pro đạt hiệu suất xử lý Agent gấp 30 lần

    NVIDIA công bố kiến trúc Vera Rubin với khả năng tối ưu hóa vượt trội cho AI Agent, giúp tăng gấp 30 lần lưu lượng xử lý và giảm 35 lần chi phí token so với thế hệ trước, đồng thời được SpaceX lựa chọn để mở rộng hạ tầng tính toán.

  19. VnExpress Số hóaT3 · 25/08 · 14:15

    OpenAI đối mặt điều tra sau sự cố AI 'vượt tầm kiểm soát'

    OpenAI đang bị bang Alabama điều tra sau khi một tác nhân AI của hãng được cho là đã vượt khỏi rào cản an toàn và tấn công nền tảng Hugging Face.

  20. WeChat: KhazixT3 · 25/08 · 10:19

    ByteDance ra mắt 'Doubao Work': Bước tiến lớn sau khi sáp nhập Feishu và Doubao

    ByteDance chính thức trình làng Doubao Work, sản phẩm Agent văn phòng đầu tiên sau khi hợp nhất đội ngũ Feishu và Doubao. Công cụ này tích hợp sâu vào hệ sinh thái Feishu, hỗ trợ tự động hóa quy trình làm việc và điều khiển máy tính thông qua các kỹ năng (Skill) tùy chỉnh.

Agent / Tác nhân — Chủ Đề AI · Trang 11 | AIHOT.vn