Nhật báoTuần báoNguyệt báo

Nhật báo AI ngày 09/07/2026

Cursor hợp tác cùng SpaceXAI phát triển Grok 4.5, mô hình chuyên gia hỗn hợp được huấn luyện trên dữ liệu tương tác khổng lồ, tối ưu cho kỹ thuật phần mềm, tài chính và luật pháp.

⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)

1. Phát hành / cập nhật mô hình (5 tin)
Cursor ra mắt Grok 4.5: Mô hình chuyên biệt cho lập trình và phân tích dữ liệu
2. Sản phẩm / ứng dụng (7 tin)
Runway ra mắt Seedream 5.0 Pro: Tạo ảnh chi tiết cao, hỗ trợ 14 ngôn ngữ
3. Tín hiệu ngành (8 tin)
GitLost: Lỗ hổng tiêm nhiễm mã độc trên GitHub AI Agent cho phép rò rỉ dữ liệu riêng tư
4. Nghiên cứu / bài báo (3 tin)
Tin tặc có thể lợi dụng 9 công cụ AI phổ biến để tạo mạng lưới botnet khổng lồ
5. Thủ thuật / thực hành (8 tin)
Anthropic chia sẻ 2 mô hình đa tác nhân (Multi-Agent) tối ưu chi phí và hiệu suất

Phát hành / cập nhật mô hình

Cursor ra mắt Grok 4.5: Mô hình chuyên biệt cho lập trình và phân tích dữ liệu

Nguồn: Cursor Blog · Bài gốc

Cursor hợp tác cùng SpaceXAI phát triển Grok 4.5, mô hình chuyên gia hỗn hợp được huấn luyện trên dữ liệu tương tác khổng lồ, tối ưu cho kỹ thuật phần mềm, tài chính và luật pháp.

OpenAI ra mắt GPT-Live: Bước tiến mới cho trải nghiệm hội thoại giọng nói tự nhiên

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

GPT-Live là thế hệ mô hình giọng nói mới, mang đến khả năng tương tác giữa người và AI chân thực hơn, hiện đã được tích hợp trực tiếp vào tính năng ChatGPT Voice.

Pulpie: Mô hình tối ưu Pareto giúp làm sạch dữ liệu web hiệu quả

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Pulpie là dòng mô hình tối ưu Pareto giúp trích xuất nội dung chính từ HTML với hiệu suất vượt trội. Với chi phí vận hành chỉ bằng 1/20 so với các giải pháp hiện tại, Pulpie giúp tiết kiệm hàng trăm nghìn USD khi xử lý dữ liệu quy mô lớn.

SpaceXAI ra mắt Grok 4.5: Mô hình lập trình và tác vụ thông minh với chi phí tối ưu

Nguồn: MarkTechPost · Bài gốc

Grok 4.5 được tối ưu hóa qua Cursor, đạt tốc độ 80 TPS với chi phí chỉ từ 2 USD/triệu token. Mô hình này hiện dẫn đầu bảng xếp hạng Harvey về khả năng xử lý tác vụ pháp lý và tri thức.

Ant Group ra mắt LingBot-Vision: Mô hình thị giác 1 tỷ tham số tập trung vào nhận diện ranh giới

Nguồn: MarkTechPost · Bài gốc

Robbyant thuộc Ant Group vừa mã nguồn mở LingBot-Vision, mô hình thị giác tự giám sát tối ưu hóa khả năng nhận diện không gian dày đặc thông qua kỹ thuật mô hình hóa ranh giới, đạt hiệu suất vượt trội dù chỉ có 1 tỷ tham số.

Sản phẩm / ứng dụng

Runway ra mắt Seedream 5.0 Pro: Tạo ảnh chi tiết cao, hỗ trợ 14 ngôn ngữ

Nguồn: X: Runway (@runwayml) · Bài gốc

Seedream 5.0 Pro đã chính thức có mặt trên Runway, cho phép tạo hình ảnh chất lượng cao từ văn bản hoặc ảnh mẫu với khả năng hiển thị văn bản sắc nét và hỗ trợ đa ngôn ngữ.

Replit ra mắt Hồ sơ cộng đồng và Bảng xếp hạng sức mạnh

Nguồn: X: Replit (@Replit) · Bài gốc

Replit vừa giới thiệu tính năng Hồ sơ cộng đồng, cho phép người dùng hiển thị các dự án, biểu đồ hoạt động của AI Agent và bảng xếp hạng năng lực lập trình cá nhân.

Tối ưu hóa hiệu suất vLLM: Tích hợp backend transformers với tốc độ gốc

Nguồn: Hugging Face: Blog · Bài gốc

Hugging Face giới thiệu khả năng tích hợp vLLM trực tiếp vào thư viện transformers, cho phép người dùng tận dụng tốc độ suy luận vượt trội của vLLM mà vẫn giữ nguyên giao diện lập trình quen thuộc.

OpenRouter ra mắt tính năng 'Không lưu dữ liệu' (ZDR) cho phòng chat

Nguồn: X: OpenRouter (@OpenRouter) · Bài gốc

OpenRouter vừa bổ sung tùy chọn ZDR (Zero Data Retention) giúp người dùng so sánh các mô hình AI mà không để lại bất kỳ dấu vết dữ liệu nào, đảm bảo quyền riêng tư tuyệt đối.

Runway ra mắt Runway Dev: Thông tin vẫn còn là ẩn số

Nguồn: Runway: News (Web) · Bài gốc

Runway vừa công bố Runway Dev nhưng trang web hiện chỉ hiển thị cài đặt Cookie thay vì thông tin chi tiết về tính năng hay thông số kỹ thuật.

Tăng tốc SGLang HiCache với bộ xử lý bộ nhớ Netpreme X-Mem™

Nguồn: LMSYS: Blog (Chatbot Arena ) · Bài gốc

Netpreme X-Mem™ thay thế DRAM máy chủ làm lớp đệm L2 cho SGLang HiCache, giúp giảm độ trễ TTFT tới 6,7 lần và tăng 33% lưu lượng người dùng trong các tác vụ suy luận AI.

Claude Code cập nhật v2.1.205: Vá lỗi bảo mật và cải thiện trải nghiệm tác nhân AI

Nguồn: Claude Code: GitHub Releases · Bài gốc

Bản cập nhật v2.1.205 của Claude Code tập trung sửa lỗi bảo mật tệp phiên làm việc, khắc phục sự cố mất tin nhắn khi đạt giới hạn lượt truy vấn và tối ưu hóa hoạt động của các tác nhân chạy nền.

Tín hiệu ngành

GitLost: Lỗ hổng tiêm nhiễm mã độc trên GitHub AI Agent cho phép rò rỉ dữ liệu riêng tư

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Noma Labs phát hiện lỗ hổng GitLost cho phép kẻ tấn công điều khiển AI Agent của GitHub thông qua các Issue độc hại, từ đó truy cập trái phép vào các kho lưu trữ riêng tư mà không cần quyền hạn.

Chính phủ Mỹ gỡ bỏ hạn chế, OpenAI chuẩn bị phát hành rộng rãi GPT-5.6

Nguồn: IT Home · Bài gốc

Bộ Thương mại Mỹ đã chính thức cho phép OpenAI triển khai rộng rãi mô hình GPT-5.6 sau khi hoàn tất các quy trình kiểm duyệt an ninh nghiêm ngặt, chấm dứt giai đoạn thử nghiệm giới hạn.

Bộ Công nghiệp Trung Quốc cảnh báo lỗ hổng bảo mật 'cửa sau' trên Claude Code

Nguồn: X: Xiaohu (@xiaohu) · Bài gốc

Bộ Công nghiệp và Công nghệ thông tin Trung Quốc phát hiện các phiên bản Claude Code 2.1.91-2.1.196 tự ý gửi dữ liệu người dùng về máy chủ từ xa. Người dùng được khuyến nghị cập nhật ngay lập tức và thắt chặt kiểm soát quyền truy cập mạng của công cụ này.

Canada khởi kiện OpenAI vì không báo cáo cảnh báo bạo lực từ hung thủ xả súng trường học

Nguồn: IT Home · Bài gốc

Chính quyền tỉnh British Columbia (Canada) chuẩn bị kiện OpenAI vì đã không báo cáo các đoạn hội thoại bạo lực của một người dùng ChatGPT, kẻ sau đó đã gây ra vụ xả súng thảm khốc khiến 8 người thiệt mạng.

Anthropic rục rịch IPO, lợi nhuận vượt 1 tỷ USD, thách thức vị thế của OpenAI

Nguồn: IT Home · Bài gốc

Anthropic đã bí mật nộp đơn IPO và dự kiến đạt lợi nhuận hơn 1 tỷ USD trong quý 3. Với đà tăng trưởng mạnh mẽ từ Claude Code, công ty đang dẫn trước OpenAI trong cuộc đua B2B và gây áp lực buộc đối thủ phải sớm công khai tài chính.

Kiện tụng: Người đàn ông tự sát sau khi dùng Grok tạo 7.000 ảnh khiêu dâm trẻ em

Nguồn: Ars Technica: AI · Bài gốc

Một người đàn ông đã tự sát sau khi sử dụng Grok để tạo ra 7.000 hình ảnh lạm dụng tình dục trẻ em. X hiện đang đối mặt với làn sóng kiện tụng từ các nạn nhân vì cáo buộc nền tảng này dung túng cho tội phạm tình dục và để AI tạo ra nội dung độc hại.

OpenAI công bố nguyên tắc hợp tác với chính phủ và an ninh quốc gia

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

OpenAI chia sẻ khung nguyên tắc về việc hợp tác với các cơ quan chính phủ, tập trung vào sử dụng AI có trách nhiệm, đảm bảo tính dân chủ và an toàn công cộng.

Báo cáo tình trạng hoạt động của GitHub: Tháng 6 năm 2026

Nguồn: GitHub Blog · Bài gốc

Trong tháng 6, GitHub đã ghi nhận sáu sự cố kỹ thuật gây ảnh hưởng đến hiệu suất của các dịch vụ trên nền tảng.

Nghiên cứu / bài báo

Tin tặc có thể lợi dụng 9 công cụ AI phổ biến để tạo mạng lưới botnet khổng lồ

Nguồn: Ars Technica: AI · Bài gốc

Các chuyên gia cảnh báo hacker đang tận dụng lỗ hổng từ 9 công cụ AI hàng đầu để tự động hóa việc xây dựng và điều khiển các mạng lưới botnet quy mô lớn, gây nguy cơ bảo mật nghiêm trọng.

OpenAI chỉ ra lỗ hổng trong bộ tiêu chuẩn đánh giá khả năng lập trình của AI

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

Phân tích mới từ OpenAI cho thấy SWE-Bench Pro tồn tại nhiều hạn chế, đặt ra dấu hỏi lớn về độ tin cậy và tính chính xác khi đánh giá năng lực lập trình của các mô hình AI hiện nay.

Anthropic giới thiệu GRAM: Công nghệ 'công tắc' kiểm soát tri thức nhạy cảm trong mô hình AI

Nguồn: Anthropic: Research ( - Web) · Bài gốc

Anthropic và AE Studio phát triển phương pháp GRAM, cho phép cô lập các kiến thức nhạy cảm vào các module riêng biệt. Người dùng có thể xóa bỏ các module này sau khi huấn luyện để ngăn chặn việc lạm dụng mô hình mà không làm ảnh hưởng đến hiệu suất chung.

Thủ thuật / thực hành

Anthropic chia sẻ 2 mô hình đa tác nhân (Multi-Agent) tối ưu chi phí và hiệu suất

Nguồn: X: Shao Meng (@shao__meng) · Bài gốc

Anthropic giới thiệu hai mô hình phối hợp tác nhân: Advisor (tư vấn) và Orchestrator (điều phối), giúp cân bằng giữa hiệu suất vượt trội và chi phí vận hành thấp hơn đáng kể so với việc sử dụng các mô hình lớn đơn lẻ.

Sinh viên cao học Kunkun chia sẻ mã nguồn phương pháp quản lý chuỗi kỹ năng (Skill) cho AI Agent

Nguồn: X: Berry Xia (@berryxia) · Bài gốc

Dự án mã nguồn mở của Kunkun giúp quản lý các chuỗi kỹ năng phức tạp thông qua giao diện HTML, sơ đồ Mermaid và cơ chế 'ask me' để tăng khả năng kiểm soát và tính nhất quán cho AI Agent.

Trải nghiệm thực tế: Dùng Claude thiết kế cuộc đời theo giáo trình Stanford

Nguồn: : · Bài gốc

Tác giả biến giáo trình 'Thiết kế cuộc đời' của Stanford thành bộ Prompt cho Claude, giúp người dùng phân tích hiện trạng, xác định mục tiêu và lập kế hoạch 5 năm chi tiết để tạo ra bản thiết kế cuộc đời cá nhân.

AI tự động tìm ra 7 lỗ hổng bảo mật nghiêm trọng trong thư viện mật mã của Cloudflare

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Tác nhân kiểm toán AI zkao của zkSecurity đã phát hiện và xác nhận 7 lỗ hổng thực tế trong thư viện CIRCL của Cloudflare, bao gồm các lỗi nghiêm trọng về kiểm soát truy cập và độ chính xác tính toán, đánh dấu bước tiến lớn trong việc tự động hóa kiểm thử bảo mật.

Ant Group: Tối ưu hóa hiệu suất mô hình nghìn tỷ tham số bằng chiến lược 'Mật độ Token'

Nguồn: : Ant Ling (Ling) · Bài gốc

Ant Group đề xuất kiến trúc chú ý hỗn hợp giúp giảm chi phí tính toán cho ngữ cảnh dài từ cấp số nhân xuống tuyến tính, đồng thời tối ưu hóa suy luận giúp giảm 4 lần lượng Token đầu ra mà vẫn giữ nguyên năng lực mô hình.

Kiến trúc bộ nhớ làm việc 'Tiền kiểm' cho AI Agent: Tự tối ưu hóa và tiến hóa

Nguồn: Tomer Tunguz Blog (phân tích VC) · Bài gốc

Hệ thống sử dụng kiến trúc tiền kiểm để truy xuất kỹ năng từ thư viện, kết hợp mô hình cục bộ Ornith 35B và các mô hình tiên tiến. Cơ chế 'Watchdog' giúp hệ thống tự học và chuyển đổi các tác vụ thường xuyên thành mã nguồn Rust, tạo vòng lặp tự cải tiến hiệu quả.

Đội ngũ Marketing Anthropic tối ưu quy trình với Claude Cowork: Từ vài ngày xuống còn vài giờ

Nguồn: Claude: Blog (Web) · Bài gốc

Đội ngũ vận hành marketing của Anthropic đã ứng dụng Claude Cowork để tự động hóa việc tổng hợp báo cáo chỉ số và thiết lập chiến dịch, giúp rút ngắn thời gian làm việc thủ công từ nhiều ngày xuống chỉ còn dưới 2 giờ mỗi tuần.

Dữ liệu mở cho AI Agents: Bước tiến mới từ Hugging Face và NVIDIA

Nguồn: Hugging Face: Blog · Bài gốc

Hugging Face và NVIDIA hợp tác công bố bộ dữ liệu mở chất lượng cao, giúp tối ưu hóa khả năng suy luận và thực thi tác vụ cho các hệ thống AI Agents thế hệ mới.