02/09

Thứ Tư · 16 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnQwen3.8-Max-0902 chính thức ra mắt, soán ngôi đầu bảng Code Arena: WebDev

Independent eval from @arena: Qwen3.8-Max-0902 debuts at #1 in Code Arena: WebDev. 1691 pts. Built …

DịchAlibaba Cloud vừa trình làng Qwen3.8-Max-0902, mẫu AI đạt 1691 điểm và vươn lên dẫn đầu bảng xếp hạng Code Arena: WebDev, vượt qua các đối thủ sừng sỏ như Claude Opus 5 và Kimi K3.

Cùng sự kiện, tinh chọn hiển thị «Qwen3.8-Max-0902 soán ngôi đầu Code Arena với mức giá cạnh tranh 5 USD/triệu token»
AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 72/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Max-0902: Vượt mặt Claude Opus 5, dẫn đầu bảng xếp hạng lập trình WebDev

Mô hình Qwen3.8-Max-0902 mới của Alibaba đã xuất sắc đạt 1691 điểm trên CodeArena WebDev, chính thức vượt qua các đối thủ mạnh như Claude Opus 5 và Kimi K3 để chiếm lĩnh vị trí số 1.

Cùng sự kiện, tinh chọn hiển thị «Qwen3.8-Max-0902 soán ngôi đầu Code Arena với mức giá cạnh tranh 5 USD/triệu token»
QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnClaude ra mắt Fable 5.1: Đứng đầu 8 bảng xếp hạng, giảm giá 45% và tích hợp cơ chế chống chưng cất

Fable 5.1 nâng cấp toàn diện khả năng xử lý tác vụ phức tạp của Claude, đồng thời tối ưu hóa chi phí vận hành và bảo mật mô hình với cơ chế chống chưng cất dữ liệu mới.


Vì sao đáng đọc: Tin tức quan trọng về cập nhật mô hình AI hàng đầu, có tác động lớn đến chi phí và hiệu năng cho người dùng doanh nghiệp.
GenK AI
Mô hìnhĐiểm AI 92/100

Cùng sự kiệnAnthropic trình làng Fable 5.1: Hiệu năng vượt trội Opus 5 với chi phí tối ưu

Mô hình Fable 5.1 mới của Anthropic không chỉ giải quyết triệt để các lỗi phần mềm tồn tại lâu năm mà còn giúp giảm đáng kể chi phí cho các tác vụ lập trình phức tạp.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
MarkTechPost
Mô hìnhĐiểm AI 77/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Đạt 52.6% điểm Terminal-Bench, giảm 75% phí đọc bộ nhớ đệm

Anthropic giới thiệu bộ đôi Claude 5.1 với hiệu năng vượt trội và chi phí tối ưu. Trong đó, Fable 5.1 được phát hành rộng rãi, còn Mythos 5.1 giới hạn cho các tổ chức được kiểm duyệt tại Mỹ thuộc dự án Project Glasswing.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Boris Cherny@bcherny
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnAnthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1: Đỉnh cao mới cho lập trình và trí tuệ nhân tạo

Fable 5.1 is our best model yet for coding, data analysis, computer use, design, presentations, Tag, …

DịchAnthropic vừa giới thiệu Claude Fable 5.1 và Mythos 5.1, được đánh giá là những mô hình mạnh mẽ nhất hiện nay trong việc xử lý lập trình, phân tích dữ liệu, thiết kế và các tác vụ đại lý (agent) phức tạp kéo dài.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 27/100

Tài liệu Claude hé lộ Fable 5.1: Siết chặt API để ngăn chặn việc 'chưng cất' mô hình

So, Claude's official support doc is already mentioning Fable 5.1

DịchTài liệu chính thức của Claude đề cập đến Fable 5.1, phiên bản sẽ hạn chế khả năng chỉnh sửa ngữ cảnh xung quanh các khối suy luận (thought blocks) trong Messages API nhằm ngăn chặn hành vi trích xuất dữ liệu huấn luyện từ mô hình.

Kim@kimmonismus
Hướng dẫnĐiểm AI 32/100

Fable 5.1 gây sốt với điểm benchmark vượt kỳ vọng, thách thức các ông lớn AI

Fable 5.1 benchmarls are insane. Ngl, i did not expect such jumps. Terminal-Bench 4.0, Science-Ben…

DịchKOL @kimmonismus chia sẻ kết quả benchmark ấn tượng của Fable 5.1 trên các nền tảng như Terminal-Bench 4.0 và HLE, vượt xa các đối thủ như Opus 5 và GPT-5.6 Sol, tạo áp lực lớn lên OpenAI và Astra.

Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnMeta ra mắt Muse Voice Transcribe: Mô hình chuyển đổi giọng nói thành văn bản đa ngôn ngữ

META 🔥: A new Muse Voice Transcribe model from MSL is now available on Meta models API. > SOTA …

DịchMeta vừa phát hành Muse Voice Transcribe trên API, hỗ trợ hơn 70 ngôn ngữ với khả năng chuyển đổi giọng nói thời gian thực đạt chuẩn SOTA. Mô hình này hiện đã được tích hợp vào các ứng dụng của Meta và cung cấp tùy chọn bảo mật không lưu trữ dữ liệu cho người dùng doanh nghiệp.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Voice Transcribe: Mô hình nhận diện âm thanh thời gian thực đột phá»
Kim@kimmonismus
Mô hìnhĐiểm AI 31/100

Claude Fable 5.1 lộ diện trong tài liệu hỗ trợ, ngày ra mắt đã cận kề

Fable 5.1 already officially mentioned in the support docs. release is imminent.

DịchClaude Fable 5.1 vừa xuất hiện trong tài liệu chính thức của Anthropic với thay đổi quan trọng về Messages API. Bản cập nhật này sẽ hạn chế chỉnh sửa các khối suy luận (thinking blocks) trong hội thoại nhằm ngăn chặn việc chưng cất dữ liệu mô hình.

29/08

Thứ Bảy · 1 tin

26/08

Thứ Tư · 2 tin
Kim@kimmonismus
Mô hìnhĐiểm AI 42/100

GLM-5.3 Flash sắp ra mắt: Hiệu năng tiệm cận Opus 4.8 với chi phí tối ưu

The upcoming Ox Alpha is GLM-5.3 Flash (as expected): 320b total parameters, 18b active. Outperform…

DịchMô hình Ox Alpha (GLM-5.3 Flash) sở hữu 320 tỷ tham số với 18 tỷ tham số kích hoạt, hứa hẹn vượt trội hơn bản 5.2 về lập trình và tác vụ thông minh với chi phí chỉ bằng 1/10.

Thêm 2 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Artificial Analysis (@ArtificialAnlys)
OpenRouter: Announcements
Hướng dẫnĐiểm AI 68/100

Tinh chọnCách chọn mô hình AI tối ưu ngay trong trình soạn thảo code

OpenRouter giới thiệu quy trình chọn mô hình dựa trên hiệu suất thực tế và chi phí hoàn thành tác vụ thay vì giá mỗi token. Bạn có thể tích hợp MCP server vào Cursor hoặc Claude Code để tự động so sánh và điều hướng yêu cầu đến mô hình phù hợp nhất.


Vì sao đáng đọc: Hướng dẫn thực tế, giải quyết nỗi đau về chi phí và hiệu năng cho lập trình viên khi sử dụng AI, có công cụ hỗ trợ tích hợp trực tiếp vào workflow.

24/08

Thứ Hai · 1 tin
Kim@kimmonismus
Mô hìnhĐiểm AI 28/100

Qwen 4 lộ diện trong giai đoạn thử nghiệm, hàng loạt mô hình AI mới sắp ra mắt

The fun doesn't stop: apparently there is also a new Qwen model - Qwen 4 - already being tested. So…

DịchCác nguồn tin uy tín cho thấy Qwen 4 đang được thử nghiệm, cùng với các bản cập nhật từ Claude, GLM và sự xuất hiện của GPT Astra. Một làn sóng mô hình AI thế hệ mới hứa hẹn sẽ khuấy động thị trường trong vài tuần tới.

21/08

Thứ Sáu · 2 tin
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 50/100

Cùng sự kiệnDeepSeek V4 Flash Vision chính thức có mặt trên OpenRouter

DeepSeek V4 Flash Vision Exp is live on OpenRouter! @deepseek_ai's new model supports Image input a…

DịchDeepSeek vừa ra mắt phiên bản V4 Flash Vision hỗ trợ xử lý hình ảnh trên OpenRouter. Mô hình này duy trì mức giá cũ nhưng đạt hiệu suất vượt trội so với Opus-4.8 trong các bài kiểm tra năng lực AI chuyên sâu.

Cùng sự kiện, bài đại diện «DeepSeek ra mắt mô hình đa phương thức thử nghiệm V4-Flash-Vision-Exp»

20/08

Thứ Năm · 3 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 42/100

Nhà sáng lập Zhipu AI: Scaling Law không chỉ nằm ở số lượng tham số

Brilliant piece by Zhipu Founder Tang Jie. AI scaling is moving past parameter growth. "How many …

DịchĐường cong tăng trưởng mô hình không còn phụ thuộc vào tham số, mà nằm ở dữ liệu, tính toán và hậu huấn luyện. Zhipu chứng minh GLM-5.3 dù cùng cấu trúc với bản cũ nhưng nhờ tối ưu hóa suy luận và RL, hiệu suất đã vượt trội đáng kể.

a16z: News
NgànhĐiểm AI 73/100

Cùng sự kiệnStripe thâu tóm OpenRouter: Xây dựng mạng lưới trao đổi trí tuệ nhân tạo toàn cầu

Stripe mua lại OpenRouter để phát triển hạ tầng kết nối các mô hình AI, giúp tối ưu hóa việc lựa chọn và điều phối mô hình thông minh cho doanh nghiệp.

Cùng sự kiện, bài đại diện «OpenRouter gia nhập Stripe để thúc đẩy sứ mệnh đa mô hình AI»

19/08

Thứ Tư · 1 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 26/100

Alibaba Cloud ra mắt Wan 3.0 và tổ chức livestream dành cho nhà sáng tạo

Meet Wan3.0: Simple input. Smart creation. Where imagination meets reality. Join the Wan team and l…

DịchAlibaba Cloud giới thiệu mô hình Wan 3.0 với khả năng chuyển đổi ý tưởng thành hình ảnh/video thông minh. Sự kiện livestream sẽ chia sẻ về các nâng cấp mới, quy trình làm việc thực tế và mẹo sử dụng hiệu quả từ các chuyên gia.

14/08

Thứ Sáu · 6 tin
Pandaily
Mô hìnhĐiểm AI 92/100

Cùng sự kiệnZhipu AI ra mắt GLM-5.3: 'Quái vật' lập trình và bảo mật phá đảo các bảng xếp hạng kỹ thuật

Chỉ vài giờ sau lời hứa từ chuyên gia Tang Jie, Zhipu AI đã tung ra GLM-5.3 chuyên biệt cho lập trình và bảo mật, đạt điểm số kỷ lục trên SWE-Marathon và CyberGym.

Cùng sự kiện, tinh chọn hiển thị «GLM-5.3 ra mắt: Bước tiến đột phá trong năng lực an ninh mạng và phòng thủ tự động»
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 39/100

Cùng sự kiệnGemini 3.7 Flash ra mắt: Hiệu năng ngang ngửa Sonnet 3.5 với chi phí chỉ bằng một nửa

Low latency matters more inside an agent because one task can stack many sequential model calls. Gem…

DịchGemini 3.7 Flash thiết lập chuẩn mực mới về tốc độ và hiệu quả chi phí cho các tác vụ AI phức tạp, đồng thời Devin hiện đang áp dụng ưu đãi giảm giá 50% cho người dùng.

Cùng sự kiện, bài đại diện «Google ra mắt Gemini 3.7 Flash: Hiệu năng mạnh mẽ với giá giảm một nửa»
Elvis Saravia@omarsar0
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle ra mắt Gemini 3.7 Flash: Đột phá khả năng lập trình dài hạn và đọc hiểu PDF

Gemini 3.7 Flash is here! Improved capabilities for long-horizon software engineering tasks, but al…

DịchGemini 3.7 Flash chính thức trình làng với hiệu suất vượt trội trong các tác vụ kỹ thuật phần mềm phức tạp và khả năng phân tích tài liệu PDF chuyên sâu.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»

13/08

Thứ Năm · 7 tin
Kim@kimmonismus
Mô hìnhĐiểm AI 43/100

Gemini 3.7 chính thức lên sóng Vertex AI: Đối đầu trực diện với DeepSeek 4 Flash

Gemini 3.7 is out on vertex. Looks like it's another release day. Let's see how the flash (cheap and…

DịchGoogle vừa đưa Gemini 3.7 lên nền tảng Vertex AI. Phiên bản Flash mới hứa hẹn cân bằng hoàn hảo giữa chi phí và hiệu năng, tạo nên cuộc cạnh tranh gay gắt với DeepSeek 4 Flash.

Kim@kimmonismus
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnDeepSeek-V4-Pro ra mắt: Cho phép tùy chỉnh cường độ suy luận linh hoạt

DeepSeek-V4-Pro GA officially announced! Yesterday's leaked benchmarks were real: The model now su…

DịchDeepSeek-V4-Pro và V4-Flash vừa được cập nhật tính năng tùy chỉnh cường độ suy luận (thấp/cao/tối đa), đồng thời hỗ trợ chuẩn OpenAI Responses API giúp tích hợp dễ dàng hơn.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
IT Home
Mô hìnhĐiểm AI 68/100

Cùng sự kiệnDeepSeek-V4-Pro chính thức ra mắt: Hỗ trợ API OpenAI và tối ưu hóa cho Codex

DeepSeek-V4-Pro đã có mặt trên mọi nền tảng với chế độ chuyên gia, khả năng xử lý tác vụ thông minh và hỗ trợ API OpenAI. Đặc biệt, hãng áp dụng chính sách giá linh hoạt theo khung giờ, giúp tối ưu chi phí cho người dùng.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
DeepSeek@deepseek_ai
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnDeepSeek ra mắt bản nâng cấp V4-Pro và V4-Flash với khả năng tối ưu hóa tác vụ thông minh

We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 …

DịchDeepSeek chính thức trình làng V4-Pro và V4-Flash, hỗ trợ tùy chỉnh cường độ suy luận linh hoạt cho từng loại tác vụ và tích hợp sẵn OpenAI Responses API để dễ dàng triển khai.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 49/100

DeepSeek V4 Pro phiên bản 0813 chính thức có mặt trên OpenRouter

DeepSeek V4 Pro 0813 is live on OpenRouter. @deepseek_ai reports large agent gains over V4 Pro Prev…

DịchDeepSeek V4 Pro 0813 đã cập bến OpenRouter với khả năng xử lý tác vụ thông minh vượt trội, đặc biệt là trong các bài kiểm tra về lập trình và vận hành hệ thống so với bản Preview.

12/08

Thứ Tư · 4 tin
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnGrok 4.6 chính thức ra mắt: Hiệu năng ngang ngửa Fable 5 và GPT 5.6

BREAKING 🔥: SPACEXAI RELEASED GROK 4.6, AND IT IS NOW ON PAR WITH FABLE 5 and GPT 5.6 SOL ON MANY B…

DịchxAI vừa trình làng Grok 4.6 với khả năng xử lý vượt trội, đạt điểm số ấn tượng trên Frontend Arena. Người dùng hiện đã có thể trải nghiệm mô hình này ngay trên Cursor và Grok Build với ưu đãi gấp đôi dung lượng sử dụng trong tuần đầu tiên.

Cùng sự kiện, tinh chọn hiển thị «Grok 4.6 chính thức ra mắt: Thông minh, tốc độ vượt trội và tối ưu chi phí»
X.PIN@thexpin
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Bài viết cung cấp cái nhìn tổng quan về các kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Emad Mostaque@EMostaque
Mô hìnhĐiểm AI 34/100

Cùng sự kiệnEmad Mostaque ca ngợi GDPVal: Grok 4.6 thiết lập chuẩn mực mới về hiệu năng và chi phí

imo GDPVal is probably the most important benchmark, it measures the performance of models on real w…

DịchCựu CEO Stability AI đánh giá cao GDPVal như một thước đo quan trọng cho khả năng thực tế của AI, đồng thời chúc mừng đội ngũ xAI khi Grok 4.6 dẫn đầu về tỷ lệ hiệu năng trên giá thành.

Cùng sự kiện, tinh chọn hiển thị «Grok 4.6 chính thức ra mắt: Thông minh, tốc độ vượt trội và tối ưu chi phí»
X.PIN@thexpin
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Hãy cùng điểm qua những kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Tổng 38 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (69 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI Models” — Trang 2 | AIHOT.vn