24/09

Thứ Năm · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 51/100

Đánh giá Mercury 2.5: Tốc độ suy luận đạt 780.8 token/giây, vượt xa chuẩn thị trường

Artificial Analysis vừa cập nhật dữ liệu cho Mercury 2.5, mẫu mô hình suy luận chuyên biệt ra mắt ngày 8/9/2026 với tốc độ ấn tượng 780.8 token/giây, bỏ xa mức trung bình 110.3 token/giây của các đối thủ cùng phân khúc.

21/09

Thứ Hai · 1 tin
karminski@karminski3
Mô hìnhĐiểm AI 14/100

Ra mắt 'Quantum Jev': Mô hình nhanh nhất lịch sử với tốc độ suy luận 0.12ms, chuẩn bị mã nguồn mở

Tác giả công bố Quantum Jev với tốc độ suy luận nhanh gấp 400 lần bản gốc, đạt 0.12ms mỗi lượt. Dự án sẽ sớm được phát hành dưới giấy phép MIT, hứa hẹn giải quyết các bài toán mà Jev hiện tại chưa thể xử lý.

18/09

Thứ Sáu · 1 tin
WeChat: Zhipu AI (GLM)
Mô hìnhĐiểm AI 61/100

Zhipu ra mắt GLM-5.3-FlashX: Tốc độ suy luận đạt đỉnh 200 tokens/giây

Zhipu vừa trình làng GLM-5.3-FlashX với tối ưu hóa hạ tầng vượt trội, đạt tốc độ 200 tokens/giây trên nền tảng 100.000 chip nội địa. Mẫu model này hứa hẹn hiệu năng mạnh mẽ nhất trong phân khúc cùng chi phí tối ưu, hiện đã sẵn sàng trên API.

Thêm 2 nguồn khác đưa tinIT HomePandaily

04/09

Thứ Sáu · 1 tin

01/09

Thứ Ba · 1 tin
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 57/100

Mô hình suy luận Mercury 2.5 Preview ra mắt trên OpenRouter: Tốc độ ấn tượng 1.107 token/giây

1/ The fastest reasoning LLM is now live exclusively on OpenRouter. Mercury 2.5 Preview from @_ince…

DịchMercury 2.5 Preview vừa cập bến OpenRouter với khả năng tạo token song song, đạt tốc độ kỷ lục 1.107 token/giây, tối ưu hóa cho các tác vụ yêu cầu độ trễ cực thấp và xử lý JSON chính xác.

27/08

Thứ Năm · 1 tin
Epoch AI@EpochAIResearch
Hướng dẫnĐiểm AI 31/100

Hệ thống Nvidia LPX: Đột phá tốc độ giải mã cho các mô hình AI nhỏ

Nvidia's Groq 3 LPX system excels at fast decode of small models (>3, 400 tok/s), according to a @Art…

DịchNvidia giới thiệu hệ thống LPX sử dụng SRAM siêu tốc thay thế HBM, giúp đạt tốc độ giải mã ấn tượng hơn 3.400 token/giây cho các mô hình nhỏ như Gemma 2 2B. Công nghệ này hứa hẹn sẽ kết hợp cùng GPU để tối ưu hóa hiệu suất cho các mô hình AI quy mô lớn.

25/08

Thứ Ba · 1 tin
Kim@kimmonismus
Hướng dẫnĐiểm AI 30/100

Tibo dự báo: Tốc độ 750 token/giây sẽ trở thành tiêu chuẩn mới của AI

Probably one of the coolest interviews of the year: Tibo on Matthew Berman's show. And one of his f…

DịchTrong cuộc phỏng vấn với Matthew Berman, Tibo nhận định tốc độ suy luận 750 token/giây sẽ sớm trở thành mặc định. Khi AI chuyển dịch sang mô hình tác tử (agent), tốc độ vận hành sẽ trở thành yếu tố then chốt quyết định hiệu quả công việc thay vì chỉ dựa vào độ thông minh.

Tổng 7 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (22 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Tốc độ suy luận” | AIHOT.vn