31/08

Thứ Hai · 6 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

J-Zero: Khung huấn luyện tự tiến hóa từ con số 0 cho mô hình ngôn ngữ

J-Zero là khung làm việc mới cho phép mô hình ngôn ngữ tự cải thiện thông qua cơ chế đối kháng giữa ba vai trò: Người thách thức, Người giải quyết và Người đánh giá, giúp tối ưu hóa hiệu suất mà không cần dữ liệu con người.

Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 56/100

Ra mắt Apodex 1.1: Mô hình AI mới đạt hiệu suất ấn tượng trong các tác vụ thông minh

Apodex has launched Apodex 1.1, a proprietary model scoring 44 on the Artificial Analysis Intelligen…

DịchApodex vừa trình làng mô hình Apodex 1.1 với điểm số 44 trên bảng xếp hạng Artificial Analysis, ngang hàng với các đối thủ mạnh như Kimi K2.6 và MiniMax-M3.

30/08

Chủ Nhật · 8 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 41/100

Nghiên cứu từ Tencent: Chế độ 'không suy nghĩ' khiến mô hình AI dễ lỗi phản hồi

Switching a multimodal model into non-thinking mode saves latency, but this Tencent paper finds it a…

DịchTencent giới thiệu PatternEval, bộ tiêu chuẩn đánh giá mới giúp phát hiện các lỗi về logic, lặp từ và suy luận giả tạo mà các bài kiểm tra độ chính xác thông thường bỏ lỡ khi mô hình AI chuyển sang chế độ phản hồi nhanh.

JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnKhi AI tự thiết kế 'bộ khung nhận thức' cho nhau: Không cần huấn luyện, vẫn giúp mô hình nhỏ mạnh gấp bội

Thay vì tốn kém huấn luyện lại mô hình, các nhà nghiên cứu đang thử nghiệm phương pháp 'Strong-to-Weak Scaffolding', nơi AI mạnh thiết kế quy trình làm việc tối ưu để nâng cấp năng lực cho AI yếu hơn, mở ra kỷ nguyên AI4AI đầy tiềm năng.


Vì sao đáng đọc: Bài viết đi sâu vào xu hướng kỹ thuật quan trọng: tối ưu hóa hệ thống thay vì chỉ chạy đua kích thước mô hình. Nội dung có tính chuyên môn cao, tầm nhìn xa và rất thực tế cho giới công nghệ.
AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 68/100

Tencent Hunyuan Hy4 lọt Top 5 bảng xếp hạng lập trình toàn cầu

Mô hình Hunyuan Hy4 mới của Tencent với 770 tỷ tham số và cửa sổ ngữ cảnh 1 triệu token đã chính thức góp mặt trong Top 5 bảng xếp hạng lập trình Arena, hứa hẹn mang lại hiệu suất cao cho công việc thực tế.

Diễn biến sự kiện · 2 bài →Thêm 1 nguồn khác đưa tinX: Tencent Hunyuan (@TencentHunyuan)
Tencent WorkBuddy@WorkBuddy_AI
Mô hìnhĐiểm AI 57/100

WorkBuddy ra mắt bản xem trước Hy4: Mô hình 770B tham số với cửa sổ ngữ cảnh 1 triệu token

Hy4 preview is now available on WorkBuddy. 770B total, 49B active, 1M context. Open weights. Anoth…

DịchWorkBuddy vừa phát hành bản xem trước của Hy4, một mô hình mã nguồn mở mạnh mẽ với 770 tỷ tham số (49 tỷ tham số kích hoạt) và hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token.

Simon Willison Blog
Mô hìnhĐiểm AI 66/100

Cùng sự kiệnTencent ra mắt Hy4 Preview: Mô hình ngôn ngữ 770B tham số với cửa sổ ngữ cảnh 1 triệu token

Tencent vừa công bố Hy4 Preview, mô hình ngôn ngữ mã nguồn mở với 770 tỷ tham số và khả năng xử lý cửa sổ ngữ cảnh lên tới 1 triệu token, đánh dấu bước tiến lớn về quy mô so với phiên bản Hy3 trước đó.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 30/100

Tiềm năng và thách thức của các nhà khoa học AI tự hành

This paper does a good job of showing the promise and gaps of autonomous AI scientists. Big question…

DịchBài viết phân tích sâu sắc về triển vọng cũng như những hạn chế hiện tại của các nhà khoa học AI tự hành, đồng thời đặt ra câu hỏi liệu các mô hình tiên tiến hơn có thể khỏa lấp được những khoảng cách này hay không.

29/08

Thứ Bảy · 9 tin
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 24/100

Làm chủ tầng mô hình: Chìa khóa cho sự tự chủ của AI

Own your harness, folks. This way, you control which models to use and how to use them. But don'…

DịchĐừng chỉ dừng lại ở việc quản lý công cụ, hãy bắt đầu tư duy về cách kiểm soát tầng mô hình để làm chủ hoàn toàn cách thức và phạm vi ứng dụng AI trong hệ thống của bạn.

Thomas Wolf (Hugging Face đồng sáng lập/CSO)@Thom_Wolf
Hướng dẫnĐiểm AI 39/100

Đồng sáng lập Hugging Face: Bảo mật mô hình AI không thể dựa vào rào cản bên ngoài

Most people haven't updated their priors yet, but over the long run, safety challenges are exactly t…

DịchThomas Wolf cho rằng thách thức bảo mật giữa mô hình nguồn mở và đóng sẽ dần đồng nhất. Thay vì dựa vào các lớp bảo vệ bên ngoài, giải pháp cốt lõi là phải căn chỉnh (alignment) hành vi của chính mô hình để đảm bảo an toàn từ gốc.

Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 45/100

Chiến lược AI cho doanh nghiệp: Đừng sở hữu mô hình, hãy tối ưu khả năng thay thế

Thay vì phụ thuộc vào một mô hình duy nhất, doanh nghiệp nên tập trung xây dựng hệ thống đánh giá (evals), quy trình hậu huấn luyện và hạ tầng Agent linh hoạt. Khả năng thay đổi mô hình mà không cần làm lại hệ thống mới chính là lợi thế cạnh tranh bền vững.

Tencent Hunyuan@TencentHunyuan
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnTencent ra mắt phiên bản thử nghiệm Hunyuan Hy4 trên OpenCode Go

Hy 4 preview, available in OpenCode Go 👏

DịchPhiên bản Hunyuan Hy4 hiện đã có mặt trên OpenCode Go với các tùy chọn 770B/49B, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và được tối ưu hóa chuyên biệt cho các tác nhân lập trình (coding agents).

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 42/100

Benchmark mới chỉ ra các mô hình AI hàng đầu chỉ đạt tỷ lệ thành công 6,4% trong các tác vụ dài hạn

Another paper that so clearly exposes AI's long-horizon problem. Long-Horizon-Terminal-Bench, where…

DịchKết quả từ Long-Horizon-Terminal-Bench cho thấy 17 mô hình AI tiên tiến nhất hiện nay gặp khó khăn lớn với các tác vụ phức tạp, khi phần lớn thất bại do quá tải thời gian và không thể duy trì logic qua hàng trăm bước thực hiện.

Kim@kimmonismus
Mô hìnhĐiểm AI 44/100

Google tăng tốc cuộc đua AI: Gemini 3.8 sắp ra mắt dù bản 3.7 mới trình làng

Things are now picking up speed: Gemini 3.8 is presumably about to be released. Though Gemini 3.7 is…

DịchChỉ vài tuần sau khi ra mắt Gemini 3.7, Google đã bắt đầu thử nghiệm nội bộ phiên bản 3.8 với hiệu năng vượt trội, cho thấy quyết tâm bám đuổi quyết liệt các đối thủ như OpenAI và Anthropic.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 37/100

So sánh chi phí tạo ảnh: GLM-5.3 Flash áp đảo Claude 4.6 Opus và Tencent Hy4

GLM-5.3 Flash vs Claude Opus 4.6 vs. Tencent Hy4 This is a nice example of why model routers are go…

DịchThử nghiệm cho thấy GLM-5.3 Flash có chi phí tạo ảnh chỉ bằng 1/9,7 so với Claude 4.6 Opus, khẳng định xu hướng ưu tiên chọn mô hình theo nhu cầu thay vì chỉ dùng một mô hình duy nhất.

Perplexity@perplexity_ai
Sản phẩmĐiểm AI 47/100

Mô hình GLM 5.3 chính thức cập bến Perplexity

GLM 5.3 is now available in Perplexity Computer. Built for long-context, multimodal agent workloads…

DịchGLM 5.3 đã có mặt trên Perplexity, được tối ưu hóa cho các tác vụ đa phương thức và xử lý ngữ cảnh dài. Mô hình này đã vượt qua phiên bản tiền nhiệm trong bài kiểm tra WANDR về khả năng nghiên cứu chuyên sâu có dẫn chứng.

28/08

Thứ Sáu · 23 tin
opencode@opencode
Mô hìnhĐiểm AI 53/100

Cùng sự kiệnOpenCode Go ra mắt mô hình Hy4 Preview: Chuyên biệt cho lập trình với cửa sổ ngữ cảnh 1 triệu token

Hy4 preview is now available in OpenCode Go 770B/49B · 1M context · built for coding agents

DịchOpenCode Go vừa giới thiệu Hy4 Preview, mô hình mạnh mẽ với hai phiên bản 770B và 49B, được tối ưu hóa đặc biệt cho các tác nhân AI lập trình cùng khả năng xử lý ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)@Zai_org
Mô hìnhĐiểm AI 51/100

Mô hình GLM-5.3 chính thức mở quyền truy cập trọng số

GLM-5.3 vừa công bố mở quyền truy cập vào trọng số mô hình, cho phép các nhà phát triển có thể tải về và sử dụng tham số. Thông tin này đang thu hút sự chú ý lớn từ cộng đồng công nghệ trên Hacker News.

Thêm 1 nguồn khác đưa tinX: Perplexity (@perplexity_ai)
Meituan LongCat@Meituan_LongCat
Nghiên cứuĐiểm AI 51/100

AI có thể trở thành nhà nghiên cứu độc lập? Đánh giá từ 7 mô hình hàng đầu

AI agents can now propose changes, run experiments, interpret feedback, and refine technical artifac…

DịchNghiên cứu từ Meituan LongCat cho thấy các mô hình AI hiện nay giống công cụ tối ưu hóa kỹ thuật hơn là nhà nghiên cứu độc lập, khi khả năng tối ưu mạnh không đồng nghĩa với năng lực đổi mới sáng tạo.

TechNode
Mô hìnhĐiểm AI 92/100

Cùng sự kiệnTencent công bố mã nguồn mở mô hình Hy4: 770 tỷ tham số và cửa sổ ngữ cảnh 1 triệu token

Tencent vừa ra mắt phiên bản thử nghiệm Hy4 với 770 tỷ tham số và khả năng xử lý ngữ cảnh lên tới 1 triệu token, hiện đã có sẵn thông qua các nền tảng WorkBuddy, CodeBuddy và API.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnCode-as-World: Bước tiến mới giúp AI 'giải mã' thế giới vật lý từ video

Thay vì chỉ mô phỏng hình ảnh, khung làm việc Code-as-World cho phép AI tái tạo thế giới thực dưới dạng mã nguồn có thể thực thi và kiểm chứng, từ đó giúp máy móc hiểu sâu sắc các quy luật vật lý thay vì chỉ bắt chước bề nổi.


Vì sao đáng đọc: Đây là một hướng đi đột phá trong lĩnh vực AI vật lý, chuyển dịch từ việc tạo video đơn thuần sang tư duy logic và hiểu cơ chế vận hành của thế giới, có giá trị học thuật và ứng dụng cao.
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 44/100

Cách các mô hình AI giá rẻ thúc đẩy làn sóng tự động hóa mới

The more I embrace open and cheaper models, the more automation I can afford. Frontier models for o…

DịchViệc kết hợp các mô hình tiên tiến để điều phối cùng các mô hình giá rẻ để thực thi giúp tối ưu chi phí, cho phép triển khai các tác nhân AI chủ động với quy mô lớn hơn bao giờ hết.

Kim@kimmonismus
Mô hìnhĐiểm AI 19/100

Sắp có thể tải và chạy các mô hình AI SOTA ngay trên máy cá nhân

Quick reminder: in 4 hours you will be able to download and run sota AI. If you have enough compute …

DịchChỉ trong vài giờ tới, người dùng có đủ phần cứng sẽ có thể tải xuống và vận hành trực tiếp các mô hình AI đạt chuẩn SOTA (State-of-the-art) ngay trên thiết bị của mình.

Tencent WorkBuddy@WorkBuddy_AI
Mô hìnhĐiểm AI 53/100

Tencent ra mắt bản thử nghiệm Hunyuan Hy4 trên WorkBuddy, miễn phí trải nghiệm

Hy4 preview from @TencentHunyuan is here-and it's now available on WorkBuddy. We tested it inside r…

DịchTencent tích hợp mô hình Hunyuan Hy4 vào WorkBuddy, hỗ trợ mạnh mẽ từ nghiên cứu, xử lý văn phòng đến lập trình và phát triển game. Người dùng có thể trải nghiệm miễn phí Hy4 trong hai tuần tới.

Thêm 1 nguồn khác đưa tinX: Tencent Hunyuan (@TencentHunyuan)
Kim@kimmonismus
Mô hìnhĐiểm AI 51/100

Cùng sự kiệnTencent ra mắt Hy4 Preview: Mô hình mã nguồn mở 770B tham số

Tencent just released Hy4 Preview: a 770B-parameter open-source model with 49B active parameters and…

DịchTencent giới thiệu Hy4 Preview, mô hình 770B tham số với cửa sổ ngữ cảnh 1 triệu token, nổi bật với khả năng điều phối đa tác vụ vượt trội so với Codex trong lập trình và nghiên cứu khoa học.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
IT Home
Mô hìnhĐiểm AI 72/100

Cùng sự kiệnTencent ra mắt mô hình Hunyuan Hy4 Preview: Đối thủ nặng ký trong làng mã nguồn mở

Tencent vừa công bố mô hình Hunyuan Hy4 bản preview với 770 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token. Mô hình hiện đã có mặt trên Tencent Cloud TokenHub và OpenRouter.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
WeChat: Tencent Hunyuan
Mô hìnhĐiểm AI 82/100

Tinh chọnTencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token

Tencent chính thức công bố mô hình flagship Hunyuan Hy4 bản Preview với 770 tỷ tham số và khả năng xử lý 1 triệu token, hiện đã mã nguồn mở trên Tencent Cloud TokenHub và OpenRouter.

Diễn biến sự kiện · 10 bài →Thêm 11 nguồn khác đưa tinSimon Willison BlogHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeX: Tencent Hunyuan (@TencentHunyuan)X: opencode (@opencode)TechNodeX: Kim (@kimmonismus)PandailyX: Testing Catalog (@testingcatalog)X: Tencent WorkBuddy (@WorkBuddy_AI)X: Elvis Saravia (@omarsar0, DAIR.AI)

Vì sao đáng đọc: Đây là bước tiến lớn của Tencent trong lĩnh vực mô hình ngôn ngữ lớn, việc mở mã nguồn và hỗ trợ ngữ cảnh dài giúp tăng tính ứng dụng thực tế cho cộng đồng lập trình viên.
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (67 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “mô hình ngôn ngữ” — Trang 10 | AIHOT.vn