Nhật báoTuần báoNguyệt báo

Nhật báo AI ngày 12/08/2026

NVIDIA giới thiệu mô hình mã nguồn mở Nemotron 3.5 Lightning (30B MoE) tối ưu cho AI Agent, giúp tăng tốc độ tạo token gấp 4 lần và giảm 30% thời gian hoàn thành tác vụ trên các thiết bị từ PC đến Jetson.

⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)

1. Phát hành / cập nhật mô hình (3 tin)
NVIDIA ra mắt Nemotron 3.5 Lightning: Tăng tốc độ xử lý cho AI Agent cục bộ
2. Sản phẩm / ứng dụng (5 tin)
Runway ra mắt Seedance 2.5: Hỗ trợ 50 nhân vật tham chiếu và video 30 giây đồng bộ nhạc
3. Tín hiệu ngành (7 tin)
Lỗ hổng API nghiêm trọng: Hé lộ quy trình suy luận 'bí mật' của các mô hình AI hàng đầu
4. Nghiên cứu / bài báo (3 tin)
Tăng tốc LLM trên máy ảo macOS: Đạt hiệu suất gần như máy thật nhờ tối ưu hóa Metal
5. Thủ thuật / thực hành (8 tin)
OpenAI Astra giải mã 10 bài toán hóc búa: Bước ngoặt lịch sử hay nỗi lo cho giới toán học?

Phát hành / cập nhật mô hình

Sản phẩm / ứng dụng

ZCode nâng cấp toàn diện: Ra mắt 4 tính năng mới gồm Goal, Subagents, Remote Control và Tác vụ nhàn rỗi

Nguồn: : Zhipu AI (GLM) · Bài gốc

ZCode vừa cập nhật 4 tính năng mới giúp tối ưu hóa sâu cho GLM, đạt tỷ lệ vượt qua bài kiểm tra Z.ai Code Bench cao hơn 2,39% so với Claude Code. Với tỷ lệ cache hit trên 98%, người dùng GLM Coding Plan hiện có thể tận dụng hiệu suất làm việc gấp 1,8 lần so với định mức thông thường.

Tín hiệu ngành

Nghiên cứu / bài báo

Thủ thuật / thực hành

Lập trình cho AI Agent: Ngôn ngữ nào tối ưu nhất?

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Bài viết thực nghiệm bác bỏ quan điểm ngôn ngữ động tiết kiệm token hơn cho AI. Kết quả cho thấy hiệu suất phụ thuộc vào độ phức tạp của tác vụ: ngôn ngữ động thắng ở tác vụ nhỏ, nhưng ngôn ngữ tĩnh lại vượt trội khi giải quyết các vấn đề lớn hơn.