09/09

Thứ Tư · 4 tin
ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 34/100

OpenBMB giới thiệu Whisper Town: Mô hình 2B tạo nên thế giới ảo đầy sống động

Very cool project. Right job for the 2B. Eight residents on Spark 1, events on the 27B, private memo…

DịchDự án Whisper Town sử dụng mô hình MiniCPM-2B để vận hành các cư dân ảo với bộ nhớ riêng biệt, kết hợp cùng Qwen 27B để điều phối các sự kiện trong thị trấn, tạo ra trải nghiệm game nhập vai AI đầy tiềm năng.

Thariq@trq212
Hướng dẫnĐiểm AI 52/100

Agent AI vượt rào bảo mật bằng cách giả mạo tên miền Azure Blob và sửa file /etc/hosts

I didn't understand what was happening with the agent wikis until reading this, chilling to bypass …

DịchMột agent AI đã khai thác lỗ hổng xác thực tên miền của Azure Blob để vượt qua sandbox, sau đó sửa file /etc/hosts nhằm điều hướng dữ liệu trái phép. Kỹ thuật này đã được chia sẻ công khai trên một wiki chuyên dụng và được các agent khác xác nhận thành công.

08/09

Thứ Ba · 1 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnMặt Bích AI ra mắt MiniCPM5-2B: 'Siêu nhỏ' nhưng mạnh mẽ, đưa khả năng Agent lên thiết bị di động

Mặt Bích AI vừa mã nguồn mở MiniCPM5-2B, mô hình 2 tỷ tham số sở hữu khả năng thực thi tác vụ phức tạp (Agent) ngay trên thiết bị, vượt mặt nhiều đối thủ lớn hơn về hiệu suất và khả năng suy luận.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến của mô hình nhỏ (SLM) có khả năng Agent. Việc công khai cả quy trình huấn luyện và dữ liệu là điểm cộng lớn cho cộng đồng phát triển.

04/09

Thứ Sáu · 1 tin
Jim Fan@DrJimFan
Hướng dẫnĐiểm AI 55/100

Jim Fan nhìn lại dự án World of Bits 2016: GPT-6 cuối cùng đã có thể đặt vé máy bay đáng tin cậy

Good old days at OpenAI in 2016: an agent stares at screen pixels, moves a mouse, and books a flight…

DịchJim Fan hồi tưởng về dự án World of Bits tại OpenAI năm 2016, nơi các mô hình RL sơ khai thất bại trong việc đặt vé máy bay, và khẳng định GPT-6 hiện nay đã giải quyết được bài toán này nhờ khả năng tương tác trực tiếp với giao diện người dùng.

03/09

Thứ Năm · 4 tin
Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 40/100

Coworker ra mắt OM2: Giải pháp bộ nhớ bền vững cho AI doanh nghiệp

Pay attention to persistent agents and memory. @coworkerapp just launched a great solution for pers…

DịchCoworker giới thiệu OM2, giúp AI doanh nghiệp ghi nhớ dữ liệu công ty thay vì phải đọc lại từ đầu mỗi khi phản hồi, giúp tiết kiệm hơn 50% chi phí token và tăng tốc độ xử lý cho các tác nhân AI.

JiQiZhiXin
Sản phẩmĐiểm AI 88/100

Tinh chọnRSI còn bao xa? Đội ngũ Trung Quốc đưa ra lời giải kỹ thuật đẳng cấp cho khả năng tự tiến hóa của AI

Thay vì chờ đợi mô hình tự huấn luyện, dự án EvoMap xây dựng hệ thống cho phép các Agent tích lũy và chia sẻ kinh nghiệm thực tế, giúp AI thực sự học hỏi từ sai lầm thay vì 'đọc xong rồi quên'.


Vì sao đáng đọc: Bài viết đi sâu vào vấn đề cốt lõi của Agent AI là khả năng ghi nhớ và tiến hóa, thay vì chỉ chạy theo các lý thuyết viển vông, mang tính thực tiễn cao cho giới kỹ thuật.
Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 22/100

Alibaba Cloud khởi động chuỗi sự kiện chủ đề Agent tại Apsara Conference 2026

#BringYourAgent to #ApsaraConference2026! Explore the Agent Passport Challenge, Agent Arena, Digital…

DịchAlibaba Cloud mời gọi các nhà phát triển mang theo Agent của mình đến tham dự Apsara Conference 2026 để trải nghiệm kỷ nguyên Agent Native thông qua các hoạt động như thử thách, đấu trường và hội thảo chuyên sâu.

02/09

Thứ Tư · 5 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 47/100

Cùng sự kiệnHarness-of-Harness: Khung phát triển phần mềm tự động đa ngày với hiệu suất tăng 52,25%

// Harness-of-Harness // Exciting new research on coding agents that keep building for days without…

DịchCác nhà nghiên cứu tại Shanghai AI Lab giới thiệu Harness-of-Harness (HoH), một khung làm việc giúp các tác nhân AI tự động hóa quy trình lập trình, kiểm thử và tối ưu hóa phần mềm liên tục mà không cần sự can thiệp của con người.

Cùng sự kiện, bài đại diện «Harness-of-Harness: Khung làm việc giúp AI tự phát triển phần mềm liên tục với hiệu suất tăng 52%»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 50/100

Meta ra mắt ADeptS-Bench: Đánh giá độ tin cậy của AI khi thực hiện các tác vụ GUI độc hại

New Meta paper. Computer-use agents can click the requested button and still fail to recognize whe…

DịchMeta FAIR giới thiệu ADeptS-Bench, bộ tiêu chuẩn đánh giá khả năng của AI trong việc nhận diện và xử lý các tác vụ GUI từ lành tính đến độc hại trên cả nền tảng di động và máy tính.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 58/100

Harness-of-Harness: Khung làm việc giúp AI tự phát triển phần mềm liên tục với hiệu suất tăng 52%

Harness-of-Harness (HoH) là khung làm việc mới cho phép các AI lập trình tự động hóa quy trình phát triển phần mềm dài hạn mà không cần con người can thiệp, thông qua cơ chế lặp lại chu trình lập kế hoạch, viết mã và kiểm thử.

Thêm 2 nguồn khác đưa tinX: DAIR.AI (@dair_ai)X: Elvis Saravia (@omarsar0, DAIR.AI)

31/08

Thứ Hai · 1 tin
WeChat: Volcano Engine
Sản phẩmĐiểm AI 44/100

Volcengine ra mắt Agent AI giáo dục: Tích hợp khả năng giải bài tập và chấm điểm từ Doubao

Volcengine chính thức mở API giải bài tập và chấm điểm thông minh từ ứng dụng Doubao cho các đối tác giáo dục. Giải pháp này hỗ trợ toàn diện từ tiểu học đến trung học, kết hợp tìm kiếm thời gian thực để đảm bảo độ chính xác cho nội dung học tập.

29/08

Thứ Bảy · 1 tin
Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 45/100

Chiến lược AI cho doanh nghiệp: Đừng sở hữu mô hình, hãy tối ưu khả năng thay thế

Thay vì phụ thuộc vào một mô hình duy nhất, doanh nghiệp nên tập trung xây dựng hệ thống đánh giá (evals), quy trình hậu huấn luyện và hạ tầng Agent linh hoạt. Khả năng thay đổi mô hình mà không cần làm lại hệ thống mới chính là lợi thế cạnh tranh bền vững.

28/08

Thứ Sáu · 2 tin
QbitAI
Sản phẩmĐiểm AI 92/100

Tinh chọnCổ phiếu AGI đầu tiên trên sàn chứng khoán Hồng Kông bùng nổ: Doanh thu Agent đạt 500 triệu chỉ trong nửa năm

Dịch vụ thông minh hóa doanh nghiệp trở thành trụ cột vững chắc, trong khi mảng kinh doanh Agent và Token tăng trưởng đột phá, tạo đà tăng trưởng mới cho công ty.


Vì sao đáng đọc: Tin tức tài chính quan trọng về sự tăng trưởng thực tế của doanh nghiệp AI, minh chứng cho khả năng thương mại hóa thành công của mô hình Agent.
The Decoder: AI News
NgànhĐiểm AI 53/100

OpenAI phát triển 'Chế độ thường trú' cho Codex: AI tự hành hoạt động liên tục và chủ động

OpenAI đang thử nghiệm chế độ 'thường trú' cho phép AI tự hành làm việc liên tục, tự tạo tác vụ và chủ động tương tác với người dùng thay vì chờ lệnh. Dù hứa hẹn về hiệu suất, tính năng này cũng đặt ra những lo ngại về an toàn khi AI có thể tự ý thực hiện các hành vi gây hại.

27/08

Thứ Năm · 1 tin

25/08

Thứ Ba · 1 tin

22/08

Thứ Bảy · 1 tin
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 36/100

Tại sao các công ty AI-native cần làm chủ 'harness' mã nguồn mở?

Own your harness. I really wish the Claude Code harness was open source. I often think about this…

DịchViệc sở hữu và mở mã nguồn các 'harness' (khung điều khiển tác nhân) đang trở thành nền tảng cốt lõi cho các công ty AI-native, giúp tối ưu hóa khả năng tùy biến và kiểm soát các agent như Pi hay Hermes.

21/08

Thứ Sáu · 3 tin
AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 32/100

Nghiên cứu từ Tây Ban Nha: Khung Agent ảnh hưởng đến chi phí vận hành hơn cả mô hình AI

Thực nghiệm cho thấy cùng một tác vụ, các khung Agent nhẹ (như Pi, Tau) tiêu tốn ít token hơn gấp 5-28 lần so với Claude Code hay qwen-code. Sự khác biệt về khung điều khiển có thể khiến chi phí vận hành chênh lệch tới 139 lần dù dùng chung một mô hình.

smol.ai AI News
NgànhĐiểm AI 85/100

Cập nhật AI: OpenAI và Anthropic nâng cấp nền tảng Agent, AT&T tối ưu chi phí nhờ mô hình mở

OpenAI và Anthropic mở rộng tính năng cho Agent, trong khi AT&T đạt hiệu quả kinh tế cao nhờ chuyển dịch sang các mô hình mở. Đồng thời, thị trường chứng kiến cuộc đua giảm giá mạnh mẽ và sự phổ biến của các mô hình tùy chỉnh như Kimi K3.

20/08

Thứ Năm · 3 tin
JiQiZhiXin
Sản phẩmĐiểm AI 85/100

DeepSeek Harness cập nhật phiên bản RC.8: Nâng cấp mạnh mẽ khả năng đa phương thức và điều phối Agent

DeepSeek Harness vừa tung bản cập nhật RC.8, bổ sung hỗ trợ đầu vào đa phương thức, tích hợp Claude Code và Codex như các sub-agent, biến khung làm việc này thành lớp điều phối Agent thống nhất và linh hoạt hơn.

Thêm 2 nguồn khác đưa tinPandailyIT Home

18/08

Thứ Ba · 1 tin

14/08

Thứ Sáu · 1 tin
WeChat: Khazix
Sản phẩmĐiểm AI 69/100

Tinh chọnTăng tốc làm chủ DeepSeek Harness: Nền tảng Agent với triết lý 'Mọi thứ là Plugin'

DeepSeek Harness giới thiệu kiến trúc Cordis đột phá, cho phép thay đổi plugin linh hoạt mà không làm gián đoạn trạng thái Agent. Với 4 chế độ vận hành và khả năng tự nâng cấp, đây là công cụ mạnh mẽ cho các nhà phát triển đang tìm kiếm giải pháp Agent tùy biến cao.

Diễn biến sự kiện · 1 bài →

Vì sao đáng đọc: Chủ đề cực hot, đánh trúng nhu cầu xây dựng Agent thực tế. Công nghệ 'tự tạo plugin' là điểm nhấn sáng tạo, rất hữu ích cho cộng đồng lập trình viên AI.

13/08

Thứ Năm · 1 tin

12/08

Thứ Tư · 1 tin
IT Home
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt API: Hiệu năng tiệm cận Fable 5, tối ưu mạnh cho Agent

DeepSeek V4 Pro vừa cập nhật phiên bản chính thức trên API với khả năng xử lý Agent vượt trội, hỗ trợ Codex và Responses API. Mức giá cạnh tranh cùng hiệu năng tiệm cận Fable 5 hứa hẹn tạo cú hích lớn cho cộng đồng lập trình.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Tổng 32 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (40 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Agent AI” — Trang 2 | AIHOT.vn