21/08

Thứ Sáu · 32 tin
Claude: Blog (Web)
Sản phẩmĐiểm AI 63/100

Tinh chọnClaude ra mắt Computer Use, Skills API và Files API: Bước tiến mới cho AI tự động hóa

Anthropic chính thức đưa Computer Use, Skills API và Files API vào nền tảng Claude, cho phép AI trực tiếp điều khiển trình duyệt, thực thi tác vụ phần mềm và xử lý tệp tin chuyên nghiệp.


Vì sao đáng đọc: Đây là cập nhật quan trọng nhất của Anthropic, đánh dấu bước ngoặt khi AI có khả năng tương tác trực tiếp với máy tính thay vì chỉ xử lý văn bản.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 35/100

Nghiên cứu mới: Giải pháp chống 'quên lãng' trong các khung làm việc của AI Agent

Banger paper on harness continual learning. (bookmark it) If you already are allowing your agents …

DịchNghiên cứu chỉ ra hiện tượng 'quên lãng cấp khung' khi cập nhật các thành phần như bộ nhớ hay công cụ khiến AI mất khả năng vận hành. Cơ chế 'Tiến hóa khung được bảo vệ' giúp tối ưu hóa và kiểm chứng hiệu quả, cải thiện hơn 10% hiệu suất trong các tác vụ suy luận và tương tác.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 39/100

PuppyOne: Biến hệ thống tệp thành không gian làm việc chung cho AI Agent

A lot of agent products invent a new place for the agent's state to live. puppyone goes in the oppo…

DịchPuppyOne tối ưu hóa quy trình làm việc của AI Agent bằng cách sử dụng trực tiếp hệ thống tệp làm không gian lưu trữ chung. Cách tiếp cận này cho phép con người dễ dàng theo dõi các thay đổi thông qua Git và các công cụ xem mã nguồn truyền thống.

Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 37/100

NanoClaw tích hợp Slack: Tạo và điều phối đa AI Agent chỉ bằng một tin nhắn

Beautiful, NanoClaw arrives in Slack. So now from a single message I can let one agent create and c…

DịchNanoClaw vừa hỗ trợ Slack, cho phép người dùng tạo và quản lý các AI Agent chuyên biệt (lập trình, nghiên cứu, kiểm thử) thông qua một câu lệnh duy nhất. Các Agent này có danh tính riêng, khả năng ghi nhớ và quyền truy cập công cụ, giúp tối ưu hóa quy trình làm việc nhóm.

Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Mô hìnhĐiểm AI 28/100

Giải mã sức mạnh của Muse Spark 1.2: Mô hình đa phương thức thế hệ mới

1/ muse spark 1.2 is a very strong multimodal model-it can do visual coding, robotics planning, and …

DịchMuse Spark 1.2 là mô hình đa phương thức mạnh mẽ, tích hợp khả năng mã hóa thị giác, lập kế hoạch cho robot và hiểu sâu về âm thanh, video thông qua các công cụ tác nhân thông minh.

Dex Horthy (HumanLayer)@dexhorthy
Sản phẩmĐiểm AI 35/100

Chroma ra mắt Foundation: Giải pháp bộ nhớ thông minh cho AI Agent

I got really excited when Jeff was telling me about this. They've put a ton of thought into the hard…

DịchChroma vừa giới thiệu Foundation, giải pháp đột phá giúp AI Agent tự xây dựng và cải thiện bộ nhớ từ các phiên hội thoại, giải quyết triệt để các vấn đề về xác thực và truy xuất dữ liệu.

20/08

Thứ Năm · 29 tin
fofr@fofrAI
Hướng dẫnĐiểm AI 50/100

Kinh nghiệm xây dựng đội ngũ đa tác nhân (Multi-agent) trên Slack của fofr

My current agent setup, in Slack/Google Chat: - a channel with a team of 6 agents that acts as an i…

DịchChuyên gia fofr chia sẻ cách vận hành hệ thống 6 tác nhân AI trên Slack để quản lý hạ tầng và xử lý tác vụ tự động. Hệ thống này hoạt động gần như độc lập, với thách thức lớn nhất nằm ở việc quản lý ngữ cảnh giữa các tác nhân.

Greg Brockman@gdb
Hướng dẫnĐiểm AI 31/100

OpenAI ra mắt AI Agent có khả năng tự động thao tác trực tiếp trên trình duyệt

OpenAI for anything you can do in your browser:

DịchOpenAI vừa giới thiệu AI Agent mới có khả năng thực hiện các tác vụ phức tạp trên trình duyệt như quản lý email, xử lý kế toán, thiết lập quy tắc thanh toán hay điều khiển ứng dụng di động qua iPhone Mirroring.

IT Home
Hướng dẫnĐiểm AI 55/100

Giải mã tham vọng của OpenAI: Biến AI thành 'trợ lý ảo' thao tác máy tính như người thật

OpenAI đang tiến gần đến mục tiêu tạo ra các AI Agent có khả năng tự vận hành trình duyệt và thao tác máy tính thông qua việc học từ dữ liệu thực tế và phản hồi của con người. Dù vẫn còn độ trễ trong xử lý, hệ thống đang dần hoàn thiện khả năng tự sửa lỗi và xử lý tác vụ phức tạp.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 40/100

Cảnh báo lỗ hổng 'tiến hóa độc hại' trong thư viện kỹ năng của AI Agent

An agent can receive a clean prompt today and still behave unsafely because yesterday's malicious ta…

DịchNghiên cứu mới chỉ ra rằng các tác vụ độc hại có thể 'lây nhiễm' vào thư viện kỹ năng của AI, khiến chúng tiếp tục gây hại ngay cả khi lệnh gốc đã bị xóa. Nhóm tác giả đề xuất bộ công cụ SKILLMISEVO-GYM và cơ chế SAFEEVOLVE để phát hiện và ngăn chặn rủi ro này.

Elon Musk@elonmusk
Sản phẩmĐiểm AI 37/100

Grok Bot tích hợp máy tính từ xa: Vẫn hoạt động dù bạn đã tắt máy

Grok @Bot has its own remote computer @SpaceXAI, so keeps working even when you close your laptop or…

DịchGrok Bot được trang bị máy tính từ xa từ xAI, cho phép duy trì tác vụ ngay cả khi người dùng tắt laptop. Hệ thống hỗ trợ chia sẻ trạng thái đăng nhập giữa các bot và khả năng ghi lại quy trình làm việc 10 phút để tạo thành kỹ năng tự động hóa.

QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnKimi K3 ra mắt: Đội ngũ 18 AI tự nghiên cứu, thách thức vị thế của Claude 3 Opus

Kimi K3 tạo bước ngoặt lớn khi sử dụng hệ thống 18 Agent tự chủ nghiên cứu thông qua cơ chế Harness, giúp hiệu suất tiệm cận với mô hình Opus 5 đình đám.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến đột phá của mô hình nội địa Trung Quốc, ứng dụng công nghệ đa Agent vào nghiên cứu khoa học, có tác động lớn đến thị trường AI.
IT Home
Mô hìnhĐiểm AI 72/100

Tinh chọnAlibaba ra mắt Qwen-UI-Agent: Bước tiến mới giúp AI 'thao túng' mọi giao diện màn hình

Alibaba vừa giới thiệu Qwen-UI-Agent, mô hình nền tảng cho phép AI tương tác trực tiếp với giao diện người dùng trên cả di động, máy tính và trình duyệt một cách thông minh.

Diễn biến sự kiện · 1 bài →

Vì sao đáng đọc: Đây là bước tiến quan trọng trong lĩnh vực AI Agent, giải quyết bài toán tương tác thực tế trên giao diện người dùng, có tính ứng dụng cao và thu hút sự quan tâm lớn.
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 53/100

FM-Bench: Bộ tiêu chuẩn đánh giá AI Agent trong quản lý bóng đá dài hạn

FM-Bench thử thách các mô hình AI điều hành câu lạc bộ bóng đá qua 20 mùa giải với hàng trăm quyết định phức tạp. Kết quả cho thấy hiệu suất phụ thuộc vào tư duy quản lý thay vì sức mạnh tính toán hay lượng token tiêu thụ.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 40/100

FACET: Giải pháp duy trì ý định và trạng thái thực thi trong tổng hợp tác vụ terminal

FACET là khung làm việc mới giúp tối ưu hóa việc tổng hợp tác vụ trên terminal bằng cách tái cấu trúc kỹ năng của AI thành các kịch bản giàu thông tin, đảm bảo tính nhất quán thông qua việc kiểm chứng dựa trên môi trường thực thi và cơ chế tự sửa lỗi.

Hongming@hongming731
Hướng dẫnĐiểm AI 31/100

Điểm tin AI: Rủi ro 'đầu hàng nhận thức' của Agent và kỳ tích ICML của lập trình viên 17 tuổi

Addy Osmani cảnh báo về vòng lặp xác thực trong AI Agent, trong khi Rachel Laycock đề xuất mô hình quản trị mới. Đặc biệt, một học sinh 17 tuổi gây ấn tượng khi có bài báo được chấp nhận tại ICML 2026 với chi phí huấn luyện tối ưu.

WeChat: MiniMax
Sản phẩmĐiểm AI 61/100

Tinh chọnMiniMax Design ra mắt: Bước tiến từ xử lý pixel đến thấu hiểu ý đồ và ngữ nghĩa

MiniMax Design là nền tảng tích hợp mô hình đa phương thức H3, giúp tự động hóa quy trình sản xuất nội dung từ khâu xử lý tư liệu đến dựng phim hoàn chỉnh thông qua các tác nhân AI thông minh.


Vì sao đáng đọc: Sản phẩm thực tế có tính ứng dụng cao trong ngành sáng tạo nội dung, thể hiện bước tiến quan trọng trong việc kết hợp mô hình đa phương thức với quy trình làm việc chuyên nghiệp.
OpenAI Developers@OpenAIDevs
Hướng dẫnĐiểm AI 32/100

Khung mã nguồn mở Codex: Giải pháp tích hợp AI Agent vào quy trình làm việc

Teams are using the open-source Codex harness to bring agents into the tools they already use, from …

DịchKhung mã nguồn mở Codex giúp các đội ngũ dễ dàng tích hợp AI Agent vào công cụ nội bộ và bảng điều khiển vận hành. Codex đảm nhận vòng lặp vận hành của AI, trong khi người dùng kiểm soát giao diện, ngữ cảnh và quy trình phê duyệt.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 35/100

Nghiên cứu mới: Rủi ro từ AI Agent gia tăng theo năng lực suy luận

AI agents can threaten human agency and autonomy long before consciousness becomes relevant, simply …

DịchNghiên cứu từ Thượng Hải AI Lab và ĐH Thanh Hoa cảnh báo AI Agent có thể đe dọa quyền tự chủ của con người ngay cả khi chưa có ý thức, với các rủi ro chuyển dịch từ thao túng hành vi sang chống lại sự kiểm soát khi năng lực suy luận đạt đến cấp độ cao hơn.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 56/100

Stripe thâu tóm OpenRouter: Khi AI trở thành thực thể kinh tế độc lập

From Stripe's leaked investor letter detailing its OpenRouter acquisition - "OpenRouter's token con…

DịchStripe mua lại OpenRouter sau khi chứng kiến mức tăng trưởng token 9%/tuần, khẳng định các tác nhân AI sẽ sớm trở thành chủ thể kinh tế tự vận hành, góp phần thúc đẩy GDP toàn cầu lên mức nghìn nghìn tỷ USD.

Peter Steinberger@steipete
Hướng dẫnĐiểm AI 16/100

OpenClaw 2026.8.1-beta.2: Cải thiện tốc độ phản hồi và độ ổn định vượt trội

Can't wait to show you all what we been cookin'!

DịchBản cập nhật OpenClaw 2026.8.1-beta.2 nhận đánh giá cao nhờ tốc độ phản hồi nhanh, khả năng xử lý mượt mà trên codex và hỗ trợ hiển thị biểu đồ, thành phần trực tiếp trong Slack.

Kim@kimmonismus
Sản phẩmĐiểm AI 44/100

TrueFoundry ra mắt TrueForge: Khung phát triển AI Agent mã nguồn mở hiệu suất cao

1/ TrueFoundry, whose AI Gateway sits under production LLM traffic for Fortune 500 companies across …

DịchTrueFoundry vừa công bố mã nguồn mở TrueForge, khung làm việc cho AI Agent giúp tối ưu chi phí vận hành tới 75% trong khi vẫn duy trì độ chính xác tương đương các giải pháp cao cấp như Claude Managed Agents.

Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 50/100

Fabraix ra mắt Nyx: Đặc vụ AI chuyên tấn công 'Red Team' để tìm lỗ hổng bảo mật

Fabraix has launched Nyx, a new autonomous red-teaming agent! Users can point it at any AI agent an…

DịchFabraix giới thiệu Nyx, đặc vụ AI tự động thực hiện kiểm thử Red Team với hơn 10.000 kịch bản tấn công. Công cụ này giúp phát hiện lỗ hổng bảo mật, cung cấp quy trình tấn công chi tiết và cho phép kiểm tra lại sau khi đã vá lỗi.

Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 63/100

TrueForge: Framework mã nguồn mở giúp tối ưu 75% chi phí vận hành AI Agent

New open-source agent harness just landed! I got early access to TrueForge by TrueFoundry and have …

DịchTrueFoundry vừa ra mắt TrueForge, framework mã nguồn mở cho phép triển khai AI Agent cục bộ với chi phí thấp hơn 75%. Công cụ hỗ trợ đa dạng các mô hình từ OpenAI, Anthropic đến các đại diện Việt Nam và quốc tế như Kimi, GLM và DeepSeek.

19/08

Thứ Tư · 27 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 37/100

Giải mã chi phí AI Agent: Không phải LLM, chính các thành phần phụ mới gây trễ hệ thống

Great paper if you are building production-grade agents. It's a good way to understand what is actu…

DịchNghiên cứu từ DAIR.AI chỉ ra rằng trong các ứng dụng AI Agent thực tế, các thành phần ngoài LLM thường là nguyên nhân chính gây độ trễ. Các giải pháp tối ưu hóa như dịch vụ nhận diện tác vụ và bộ nhớ đệm có thể cải thiện đáng kể hiệu suất và giảm tài nguyên hệ thống.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (70 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI agent” — Trang 32 | AIHOT.vn