09/09

Thứ Tư · 34 tin
Cohere@cohere
Sản phẩmĐiểm AI 50/100

Cohere ra mắt hệ thống suy luận LLM mã nguồn mở mới, nhanh hơn vLLM tới 1,58 lần

Introducing the next evolution in LLM text generation: the first fully-fledged serving system built …

DịchCohere vừa giới thiệu hệ thống phục vụ tạo văn bản LLM dựa trên kiến trúc decode megakernel, mang lại hiệu suất vượt trội so với vLLM và được phát hành hoàn toàn dưới dạng mã nguồn mở.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 54/100

Mô hình ngôn ngữ khuếch tán Mercury 2.5 của Inception đã có mặt trên OpenRouter

Mercury 2.5 from @_inception_ai is now generally available on OpenRouter. It's the fastest model on…

DịchMercury 2.5, mô hình ngôn ngữ sử dụng cơ chế khuếch tán để giải mã token song song, hiện đã khả dụng trên OpenRouter. Đây là mô hình nhanh nhất trên nền tảng này mà không yêu cầu phần cứng chuyên dụng, đặc biệt tối ưu cho các tác vụ lập trình.

Noam Brown@polynoamial
Hướng dẫnĐiểm AI 67/100

Noam Brown lên tiếng về tranh cãi chứng minh Navier-Stokes: OpenAI đang sở hữu mô hình vượt xa LLM hiện tại

I understand how, looking at today's LLMs, people might think the only way we'd achieve NS is by usi…

DịchNoam Brown khẳng định kết quả Navier-Stokes không phụ thuộc vào gợi ý từ bên ngoài và chia sẻ dữ liệu cho thấy các mô hình nội bộ của OpenAI có tỷ lệ giải toán vượt trội so với các LLM công khai hiện nay.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 43/100

Uno: Giải pháp tăng tốc suy luận LLM bằng mô hình khuếch tán song song

Uno shows a simple way to speed up existing LLMs without changing their output distribution: keep th…

DịchUno tối ưu hóa suy luận LLM bằng cách sử dụng mô hình khuếch tán để dự đoán song song nhiều token mà không làm thay đổi chất lượng đầu ra. Phương pháp này giúp tăng thông lượng lên tới 2,5 lần và đẩy nhanh quá trình huấn luyện RL tới 40% trên mô hình Qwen3-8B.

08/09

Thứ Ba · 21 tin
DAIR.AI@dair_ai
NgànhĐiểm AI 47/100

Nghiên cứu mới: Kiến thức toán học trong LLM thiếu cấu trúc logic nhất quán

Finally a good paper testing whether an LLM's mathematical knowledge has coherent structure or just …

DịchNghiên cứu sử dụng lý thuyết không gian tri thức cho thấy các mô hình LLM thường vi phạm sự phụ thuộc logic trong toán học, dù vẫn đạt độ chính xác cao. Các mô hình khác nhau có sự chồng chéo tri thức thấp, cho thấy lỗ hổng trong cách đánh giá năng lực AI hiện nay.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 59/100

TradingAgents: Khung giao dịch tài chính đa tác nhân LLM mã nguồn mở vừa cập nhật v0.4.0

TradingAgents mô phỏng quy trình làm việc của các công ty tài chính chuyên nghiệp thông qua hệ thống đa tác nhân LLM. Bản cập nhật v0.4.0 đã khắc phục lỗi dữ liệu tương lai, đồng thời bổ sung hỗ trợ cho các mô hình GPT-5.6 và GLM-5.3.

DAIR.AI@dair_ai
NgànhĐiểm AI 45/100

Giải mã cấu trúc tư duy của AI: Các bước suy luận nằm sâu trong biểu diễn ẩn

// Beneath the Surface of Chains-of-Thought // Impressive paper on whether reasoning steps have int…

DịchNghiên cứu mới chỉ ra rằng các bước suy luận của AI không chỉ là văn bản mà có cấu trúc hình học riêng biệt trong không gian ẩn. Các thao tác như phân tích mục tiêu hay suy diễn được sắp xếp có hệ thống, cho thấy AI xây dựng logic dựa trên ngữ cảnh thay vì chỉ dự đoán từ ngữ.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnTăng tốc LLM không mất dữ liệu bằng mô hình khuếch tán rời rạc

Nghiên cứu giới thiệu phương pháp kết hợp mô hình khuếch tán vào LLM để tạo nhiều token song song, giúp tăng tốc độ suy luận mà không làm giảm độ chính xác so với cách dự đoán tuần tự truyền thống.


Vì sao đáng đọc: Đây là bước tiến đột phá trong việc giải quyết nút thắt cổ chai của LLM, mang lại hiệu năng cao mà không cần đánh đổi chất lượng, rất có giá trị cho cộng đồng nghiên cứu AI.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Một triệu chứng, ba đòn bẩy: Đánh giá chuyên sâu về kỹ thuật tự chưng cất On-Policy

Nghiên cứu phân tích kỹ thuật tự chưng cất (OPSD) giúp mô hình tự học từ dữ liệu có sẵn mà không cần mô hình giáo viên lớn, đồng thời cảnh báo về rủi ro suy giảm khả năng suy luận do thiên kiến trong quá trình huấn luyện.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 46/100

Đột phá cho mô hình ngữ cảnh dài: Phương pháp 'Trace as State' giúp tối ưu hóa suy luận

For hard long-context tasks, the paper suggests a simple fix: run the model again with its previous …

DịchPhương pháp mới sử dụng dấu vết suy luận làm trạng thái điều kiện, giúp mô hình tập trung vào các điểm trọng yếu trong ngữ cảnh dài, giải quyết triệt để tình trạng bỏ lỡ thông tin quan trọng. Kết quả thử nghiệm cho thấy hiệu suất vượt trội trong 26/27 bài kiểm tra.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Tối ưu hóa khả năng chỉnh sửa tài liệu của LLM: Giải pháp tính toán hiệu quả khi hội thoại

Nghiên cứu này giải quyết thách thức khi LLM phải tự động cập nhật các phần phụ thuộc trong tài liệu khi người dùng yêu cầu chỉnh sửa cục bộ. Nhóm tác giả đề xuất bộ tiêu chuẩn đánh giá mới và các phương pháp tính toán tiết kiệm chi phí để cải thiện độ chính xác khi lan truyền thay đổi.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 53/100

Nghiên cứu mới: Phương pháp RAE đánh giá chính xác khả năng truy xuất kỹ năng của AI Agent

A skill-enabled agent can look better overall while performing worse on the exact tasks where it ret…

DịchCác nhà nghiên cứu từ Đại học Soongsil chỉ ra rằng cách đánh giá AI Agent hiện nay thường bị sai lệch. Họ đề xuất phương pháp RAE để đo lường thực chất hiệu quả của việc truy xuất kỹ năng, giúp khắc phục các hạn chế trong các bài kiểm tra truyền thống.

Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Nghiên cứuĐiểm AI 69/100

Tinh chọnEpoch AI phân tích độ trễ khi xử lý ngữ cảnh dài trên GPT-5.6 và Claude 5

Nghiên cứu từ Epoch AI cho thấy GPT-5.6 có độ trễ TTFT tăng theo đường cong bậc hai khi ngữ cảnh dài, trong khi dòng Claude 5 duy trì hiệu suất gần như tuyến tính.


Vì sao đáng đọc: Nghiên cứu kỹ thuật chuyên sâu về hiệu năng mô hình, cung cấp cái nhìn thực tế cho người dùng và nhà phát triển về khả năng xử lý ngữ cảnh dài của các model hàng đầu.
Elvis Saravia@omarsar0
NgànhĐiểm AI 18/100

Prompt từ Anthropic giúp nâng tầm chất lượng viết của Fable và GPT-5.6

A few days ago, Anthropic shared this brilliant prompt. I was surprised by how it significantly im…

DịchMột bộ prompt mới từ Anthropic đã cho thấy hiệu quả bất ngờ khi cải thiện đáng kể khả năng viết lách của cả Fable 5.1 và GPT-5.6, trở thành công thức tối ưu cho mọi tác vụ biên tập AI.

DAIR.AI@dair_ai
NgànhĐiểm AI 45/100

Tổng quan phê bình về AI Agent: Từ mô hình ngôn ngữ đến hệ thống hành động thực tế

// From Language Models to World-Acting Systems // A critical review of agentic AI, and a framework…

DịchDAIR.AI đề xuất khung đánh giá mới cho AI Agent, chỉ ra rằng khả năng kết nối hành động đang phát triển mạnh hơn so với độ tin cậy và tính tự chủ. Báo cáo cũng cảnh báo về rủi ro chi phí và lỗi phối hợp trong các hệ thống đa tác tử.

ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 55/100

OpenBMB ra mắt MiniCPM5-2B, hỗ trợ triển khai tức thì qua SGLang

Big thanks to @sgl_project for the day-0 support! MiniCPM5-2B is ready to deploy with SGLang today.

DịchOpenBMB vừa giới thiệu MiniCPM5-2B với khả năng triển khai ngay lập tức qua SGLang. Trên card RTX 5090, mô hình đạt tốc độ giải mã ấn tượng hơn 250 tok/s, tối ưu hóa hiệu suất cho các tác vụ lập trình.

07/09

Thứ Hai · 20 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Từ chối thông minh: Giải pháp giảm thiểu tình trạng AI từ chối nhầm các truy vấn an toàn

Nghiên cứu chỉ ra rằng việc tách biệt câu từ chối và phần giải thích giúp AI phân biệt chính xác hơn giữa các truy vấn độc hại và các câu hỏi lành tính có từ ngữ nhạy cảm, từ đó giảm thiểu đáng kể tình trạng từ chối nhầm.

ByteByteGo
Hướng dẫnĐiểm AI 56/100

ByteByteGo: Hướng dẫn toàn diện về xử lý lỗi và thiết kế hệ thống LLM bền bỉ

Bài viết phân tích cách xử lý các lỗi kỹ thuật (timeout, giới hạn tốc độ) và lỗi ngữ nghĩa (ảo tưởng, định dạng sai) trong ứng dụng LLM, đồng thời đề xuất chiến lược phân loại lỗi để xây dựng hệ thống ổn định hơn.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 59/100

Nghiên cứu từ LinkedIn: Liệu bộ nhớ của AI Agent có còn hiệu quả sau khi nâng cấp mô hình?

Brilliant paper from LinkedIn. (bookmark it) I have been saying that memory is one of the most cha…

DịchNghiên cứu của LinkedIn phân tích khả năng duy trì bộ nhớ của các AI Agent khi thay đổi mô hình đọc/ghi, thông qua thử nghiệm trên 48 kịch bản lịch sử tổng hợp để đánh giá tính tương thích.

ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 58/100

MiniCPM5-2B của OpenBMB: Mô hình AI dưới 4B tham số mạnh nhất hiện nay

🚀 Meet MiniCPM5-2B, a 2B-parameter language model bringing high intelligence density to the edge, n…

DịchOpenBMB vừa ra mắt MiniCPM5-2B, mô hình ngôn ngữ nhỏ gọn nhưng dẫn đầu bảng xếp hạng Artificial Analysis cho các model dưới 4B tham số, đồng thời đạt điểm số ấn tượng 20 trong chỉ số Agentic Index.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnGiải mã tư duy của LLM: Cấu trúc hình học ẩn sau các chuỗi suy luận

Nghiên cứu này khám phá cách các mô hình ngôn ngữ lớn tổ chức các thao tác suy luận như phân tích mục tiêu và suy diễn trong không gian biểu diễn ẩn, chứng minh rằng các thao tác này có cấu trúc hình học riêng biệt và không phụ thuộc vào từ vựng.


Vì sao đáng đọc: Nghiên cứu chuyên sâu về cơ chế nội tại của LLM, giúp hiểu rõ cách mô hình 'tư duy' thực sự, rất quan trọng cho việc cải thiện khả năng suy luận của AI.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnτ^τ-Bench: Thước đo thực tế cho khả năng xây dựng AI Agent từ đầu đến cuối

τ^τ-Bench là bộ tiêu chuẩn mới đánh giá khả năng của AI trong việc tự xây dựng các Agent thực tế, dựa trên các điều kiện khắt khe như dữ liệu doanh nghiệp, API sản xuất và giới hạn chi phí, thay vì chỉ giải quyết các bài toán lý thuyết.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng vì nó chuyển dịch trọng tâm từ việc đánh giá AI giải đố sang đánh giá khả năng thực thi dự án thực tế, rất hữu ích cho các kỹ sư AI.
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (54 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “llm” — Trang 13 | AIHOT.vn