Nhật báoTuần báoNguyệt báo

Nhật báo AI ngày 21/07/2026

ModelAI phối hợp cùng OpenBMB giới thiệu dòng MiniCPM-Robot mã nguồn mở, bao gồm mô hình VLA 1.5B cho thao tác robot và mô hình 0.9B chuyên biệt cho theo dõi chuyển động.

⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)

1. Phát hành / cập nhật mô hình (4 tin)
ModelAI ra mắt MiniCPM-Robot: Bước tiến mới trong trí tuệ hiện thân với mô hình VLA siêu nhẹ
2. Sản phẩm / ứng dụng (7 tin)
Bảng xếp hạng LoRA Speedrun: Tối ưu hóa thời gian tinh chỉnh Qwen2.5-1.5B chỉ trong 6 phút
3. Tín hiệu ngành (3 tin)
Đạo diễn 'District 9' ra mắt phim ngắn kinh dị 'Nightborne' được tạo hoàn toàn bằng AI
4. Nghiên cứu / bài báo (3 tin)
Hơn 30% bài báo mới trên ArXiv có dấu hiệu được viết bởi AI
5. Thủ thuật / thực hành (5 tin)
Vibe Coding: Hướng dẫn chi tiết từ A-Z cho người không biết lập trình

Phát hành / cập nhật mô hình

Sản phẩm / ứng dụng

Bảng xếp hạng LoRA Speedrun: Tối ưu hóa thời gian tinh chỉnh Qwen2.5-1.5B chỉ trong 6 phút

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Dự án LoRA Speedrun ra mắt bảng xếp hạng thi đấu tốc độ tinh chỉnh mô hình Qwen2.5-1.5B trên phần cứng L40S. Kỷ lục hiện tại đạt 6 phút 05 giây với độ chính xác 61.1% trên tập GSM8K, nhanh gấp đôi so với mức cơ sở nhờ kỹ thuật đóng gói chuỗi và che mặt nạ tổn thất.

Grok chính thức có mặt trên Excel: Trợ lý AI giúp viết công thức và phân tích dữ liệu bằng ngôn ngữ tự nhiên

Nguồn: xAI: News (Web) · Bài gốc

xAI ra mắt tiện ích mở rộng Grok cho Microsoft 365, cho phép người dùng Excel đặt câu hỏi, tạo công thức và phân tích dữ liệu bằng ngôn ngữ tự nhiên. Công cụ này hỗ trợ trích xuất dữ liệu từ SharePoint, Google Drive và tích hợp sẵn trên cả Word lẫn PowerPoint.

Xiaohongshu và Đại học Bắc Kinh ra mắt UltraEP: Giải pháp cân bằng tải thời gian thực cho mô hình MoE quy mô lớn

Nguồn: : (dots.llm) · Bài gốc

UltraEP là giải pháp đột phá giúp tối ưu hóa hiệu suất huấn luyện và suy luận cho mô hình MoE bằng cách cân bằng tải động theo thời gian thực. Công nghệ này giúp tăng 42% tốc độ huấn luyện so với Megatron-LM và cải thiện 1,56 lần hiệu suất suy luận prefill so với SGLang.

Claude Code v2.1.216: Khắc phục lỗi treo máy khi hội thoại dài và tối ưu hóa tác vụ Agent

Nguồn: Claude Code: GitHub Releases · Bài gốc

Bản cập nhật mới của Claude Code xử lý triệt để tình trạng giật lag trong các phiên chat dài, sửa lỗi xác thực OAuth và cải thiện tính ổn định của các Agent con. Đồng thời, công cụ bổ sung tùy chọn mới cho phép người dùng linh hoạt hơn trong việc quản lý cách ly hệ thống tệp.

Tín hiệu ngành

Ollama gọi vốn thành công 88 triệu USD, thúc đẩy hệ sinh thái mô hình mở

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Ollama vừa huy động 88 triệu USD để mở rộng nền tảng, vốn đang phục vụ gần 9 triệu nhà phát triển và 85% doanh nghiệp trong danh sách Fortune 500. Khoản vốn này sẽ tập trung tối ưu hóa suy luận hỗn hợp và tích hợp các mô hình AI mở mới nhất ngay khi ra mắt.

Nghiên cứu / bài báo

Thủ thuật / thực hành

Mô hình mã nguồn mở tiệm cận ngưỡng tiên phong, nhưng mô hình đóng vẫn dẫn đầu

Nguồn: Tomer Tunguz Blog (phân tích VC) · Bài gốc

Dù các mô hình mã nguồn mở đang đạt hiệu năng tương đương với các mô hình đóng hàng đầu, nhưng các phiên bản như GPT-5.2 vẫn tạo ra những bước nhảy vọt về công nghệ. Về chi phí, các mô hình mở hiện nay rẻ hơn từ 15% đến 90% so với các giải pháp đóng cao cấp.