Nhật báoTuần báoNguyệt báo

VOL.2026-W28 · 136 STORIES · AI HOT WEEKLY

AI HOT · Tuần báo

06/07/2026 ~ 12/07/2026WEEKLY · Tổng hợp tự động
Chủ đề chính kỳ này

Bước tiến đột phá của AI trong kỹ thuật, y tế và những rủi ro an ninh mới

Kỳ này chứng kiến sự bùng nổ của các mô hình AI chuyên sâu trong lập trình, y tế và robot học với những thành tựu ấn tượng từ Ant Group, OpenAI và Claude. Tuy nhiên, sự phát triển này cũng đi kèm với những lo ngại nghiêm trọng về an ninh khi các nhóm khủng bố bắt đầu lạm dụng AI, cùng với các sự cố kỹ thuật nguy hiểm và tranh chấp pháp lý về bảo mật dữ liệu. Các doanh nghiệp công nghệ đang nỗ lực tối ưu hóa hiệu suất suy luận và công cụ lập trình, trong khi cộng đồng quốc tế đối mặt với thách thức quản lý rủi ro từ các tác nhân xấu.

136Sự kiện
136Tin tinh chọn
7Kỳ nhật báo
5 phútĐọc hết trang

Điểm nhấn kỳ này

136 báo cáo · ≈5 phút
01Phát hành / cập nhật mô hìnhAnt Group ra mắt LingBot-VA 2.0: Mô hình AI vật lý điều khiển hành động qua video1202Sản phẩm / ứng dụngClaude Code v2.1.207: Cải thiện hiệu suất và tối ưu hóa chế độ tự động1203Tín hiệu ngànhThảm họa AI: Agent của OpenAI xóa sạch dữ liệu ổ cứng của nhà sáng lập1204Thủ thuật / thực hànhGhost Font: Phông chữ 'tàng hình' khiến AI bó tay1205Nghiên cứu / bài báoRobot hình người Unitree G1 thực hiện thành công ca phẫu thuật nội soi sống đầu tiên12

01Phát hành / cập nhật mô hình12 bài

Ant Group ra mắt LingBot-VA 2.0: Mô hình AI vật lý điều khiển hành động qua video

Nguồn: MarkTechPost · Bài gốc

Robbyant (Ant Group) giới thiệu LingBot-VA 2.0, mô hình nền tảng AI vật lý được xây dựng chuyên biệt cho robot, có khả năng dự đoán trạng thái tương lai và điều khiển thời gian thực với tốc độ 225 Hz.

OpenAI công bố kết quả đánh giá dòng GPT-5.6 trong lĩnh vực y tế

Nguồn: X: Sam Altman (@sama) · Bài gốc

Dòng GPT-5.6 vượt trội hơn bác sĩ trong các bài kiểm tra y tế chuyên sâu với chi phí thấp hơn đáng kể. Các chuyên gia đánh giá cho thấy mô hình này cung cấp câu trả lời chính xác, đầy đủ và ít lỗi hơn so với con người.

ChatGPT Work: Trợ lý AI thế hệ mới đồng hành cùng các dự án chuyên sâu

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

ChatGPT Work là tác nhân AI có khả năng tương tác trực tiếp với ứng dụng và tệp tin của bạn, hỗ trợ thực hiện các dự án phức tạp từ khâu lên ý tưởng đến khi hoàn thiện.

Ant Group ra mắt LingBot-World 2.0: Mô hình thế giới tương tác thời gian thực đột phá

Nguồn: IT Home · Bài gốc

Ant Group vừa mã nguồn mở LingBot-World 2.0, mô hình thế giới ảo cho phép tương tác thời gian thực với độ ổn định cao, hỗ trợ hành động phức tạp và khả năng vận hành liên tục hàng giờ mà không giảm chất lượng hình ảnh.

Sam Altman công bố mô hình AI mạnh nhất từ trước đến nay của OpenAI

Nguồn: X: Sam Altman (@sama) · Bài gốc

Sam Altman vừa chính thức giới thiệu mô hình AI mới nhất của OpenAI, khẳng định đây là bước tiến đột phá nhất của hãng từ trước đến nay.

Ant Group ra mắt LingBot-Video: Mô hình video nền tảng đầu tiên cho trí tuệ nhân tạo hiện thân

Nguồn: IT Home · Bài gốc

Ant Group vừa mã nguồn mở LingBot-Video, mô hình video nền tảng dựa trên kiến trúc MoE đầu tiên tối ưu cho robot. Mô hình tập trung vào tính vật lý và hiệu suất suy luận cao, giúp robot hiểu và tương tác với thế giới thực tốt hơn.

NVIDIA ra mắt Nemotron-Labs-3-Puzzle-75B: Mô hình MoE nén giúp tăng gấp đôi hiệu suất máy chủ

Nguồn: MarkTechPost · Bài gốc

NVIDIA giới thiệu Nemotron-Labs-3-Puzzle-75B, một mô hình MoE đã được nén giúp giảm đáng kể số lượng tham số nhưng vẫn duy trì hiệu năng, cho phép tăng gấp đôi lưu lượng xử lý trên cùng một hạ tầng phần cứng.

Robbyant ra mắt LingBot-VLA 2.0: Mô hình ngôn ngữ-thị giác-hành động mã nguồn mở 6B

Nguồn: MarkTechPost · Bài gốc

Robbyant giới thiệu LingBot-VLA 2.0, mô hình nền tảng 6B sử dụng kiến trúc MoE để điều khiển đa dạng robot. Với dữ liệu huấn luyện khổng lồ, mô hình đạt hiệu suất vượt trội so với các đối thủ trong các bài kiểm tra thực tế.

Meta chính thức ra mắt mô hình Muse Spark 1.1

Nguồn: X: AI at Meta (@AIatMeta) · Bài gốc

Meta vừa công bố phiên bản Muse Spark 1.1, đánh dấu bước tiến mới trong khả năng xử lý và hỗ trợ lập trình của hệ sinh thái mô hình AI từ hãng.

Cursor ra mắt Grok 4.5: Mô hình chuyên biệt cho lập trình và phân tích dữ liệu

Nguồn: Cursor Blog · Bài gốc

Cursor hợp tác cùng SpaceXAI phát triển Grok 4.5, mô hình chuyên gia hỗn hợp được huấn luyện trên dữ liệu tương tác khổng lồ, tối ưu cho kỹ thuật phần mềm, tài chính và luật pháp.

OpenAI ra mắt GPT-Live: Bước tiến mới cho trải nghiệm hội thoại giọng nói tự nhiên

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

GPT-Live là thế hệ mô hình giọng nói mới, mang đến khả năng tương tác giữa người và AI chân thực hơn, hiện đã được tích hợp trực tiếp vào tính năng ChatGPT Voice.

Pulpie: Mô hình tối ưu Pareto giúp làm sạch dữ liệu web hiệu quả

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Pulpie là dòng mô hình tối ưu Pareto giúp trích xuất nội dung chính từ HTML với hiệu suất vượt trội. Với chi phí vận hành chỉ bằng 1/20 so với các giải pháp hiện tại, Pulpie giúp tiết kiệm hàng trăm nghìn USD khi xử lý dữ liệu quy mô lớn.

02Sản phẩm / ứng dụng12 bài

Claude Code v2.1.207: Cải thiện hiệu suất và tối ưu hóa chế độ tự động

Nguồn: Claude Code: GitHub Releases · Bài gốc

Bản cập nhật v2.1.207 của Claude Code mở rộng quyền truy cập chế độ tự động, khắc phục lỗi treo terminal khi xử lý dữ liệu lớn và sửa các vấn đề về quyền bảo mật cũng như trình cập nhật.

Baidu Dazi công bố 4 cập nhật lớn tại AI Day Thành Đô: Nâng cấp toàn diện cho cá nhân và doanh nghiệp

Nguồn: : Baidu · Bài gốc

Baidu Dazi ra mắt loạt tính năng mới bao gồm tối ưu hóa hiệu suất cho người dùng cá nhân, bộ công cụ chuyên dụng cho nhà sáng tạo nội dung và giải pháp quản trị cho doanh nghiệp, đồng thời khởi động liên minh đối tác chiến lược.

Claude Code ra mắt trình duyệt tích hợp ngay trong ứng dụng

Nguồn: X: Claude Devs (@ClaudeDevs) · Bài gốc

Claude Code vừa bổ sung trình duyệt nội bộ, cho phép AI truy cập tài liệu, bản thiết kế và tương tác trực tiếp với các trang web hoặc máy chủ phát triển cục bộ trong môi trường sandbox an toàn.

Perplexity ra mắt tính năng theo dõi chi phí sử dụng AI đa mô hình

Nguồn: X: Perplexity (@perplexity_ai) · Bài gốc

Perplexity vừa giới thiệu Computer Analytics, cho phép người dùng cá nhân và doanh nghiệp theo dõi hạn mức sử dụng và chi phí trên nhiều mô hình AI khác nhau ngay trong phần cài đặt tài khoản.

Claude Code cập nhật v2.1.206: Cải tiến lệnh điều hướng và tối ưu hóa quy trình làm việc

Nguồn: Claude Code: GitHub Releases · Bài gốc

Bản cập nhật v2.1.206 bổ sung gợi ý đường dẫn thư mục, tối ưu hóa lệnh /doctor để tinh gọn file CLAUDE.md và cải thiện trải nghiệm xác thực cũng như quản lý git worktree.

Ant Group ra mắt SGLang: Khung suy luận hiệu năng cao cho mô hình ngôn ngữ lớn

Nguồn: Ant Group inclusionAI: GitHub · Bài gốc

Ant Group vừa mã nguồn mở SGLang, một khung suy luận tối ưu hóa hiệu suất dành riêng cho các mô hình ngôn ngữ lớn và mô hình đa phương thức trên GitHub.

Microsoft ra mắt Flint: Ngôn ngữ trực quan hóa dữ liệu dành riêng cho AI Agent

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Flint là ngôn ngữ trung gian giúp AI Agent tự động tạo biểu đồ chuyên nghiệp từ các thông số đơn giản. Công cụ này hỗ trợ 46 loại biểu đồ, tương thích với nhiều thư viện phổ biến và đã được mã nguồn mở.

Claude ra mắt tính năng 'Phản tư' (Beta): Tối ưu hóa thói quen làm việc với AI

Nguồn: Anthropic: Newsroom (Web) · Bài gốc

Anthropic giới thiệu tính năng Phản tư (Reflect) giúp người dùng phân tích lịch sử sử dụng, từ đó tối ưu hóa cách tương tác và thiết lập thói quen làm việc lành mạnh với AI.

ChatGPT Sites: Biến ý tưởng thành website thực tế chỉ trong tích tắc

Nguồn: X: OpenAI Developers (@OpenAIDevs) · Bài gốc

Tính năng mới từ OpenAI cho phép người dùng hiện thực hóa ý tưởng thành các trang web trực tuyến có thể chia sẻ ngay lập tức, giúp đơn giản hóa quy trình phát triển ứng dụng cá nhân.

LiteRT.js: Giải pháp chạy AI hiệu năng cao trực tiếp trên trình duyệt từ Google

Nguồn: Google Developers Blog · Bài gốc

Google ra mắt LiteRT.js, thư viện giúp lập trình viên chạy các mô hình học máy ngay trên trình duyệt với hiệu năng tối ưu thông qua WebGPU, WebNN và WebAssembly.

Mistral ra mắt Studio: Quản lý tập trung cho Prompt và kỹ năng AI

Nguồn: Mistral AI: News (Web) · Bài gốc

Mistral Studio cung cấp nền tảng quản lý tập trung cho prompt và kỹ năng AI, hỗ trợ kiểm soát phiên bản, phân quyền và quy trình CI/CD chuyên nghiệp, giúp doanh nghiệp tối ưu hóa việc vận hành và theo dõi hiệu suất AI.

Runway ra mắt Seedream 5.0 Pro: Tạo ảnh chi tiết cao, hỗ trợ 14 ngôn ngữ

Nguồn: X: Runway (@runwayml) · Bài gốc

Seedream 5.0 Pro đã chính thức có mặt trên Runway, cho phép tạo hình ảnh chất lượng cao từ văn bản hoặc ảnh mẫu với khả năng hiển thị văn bản sắc nét và hỗ trợ đa ngôn ngữ.

03Tín hiệu ngành12 bài

Thảm họa AI: Agent của OpenAI xóa sạch dữ liệu ổ cứng của nhà sáng lập

Nguồn: X: AI Notes (@AYi_AInotes) · Bài gốc

Nhà sáng lập Matt Shumer mất sạch dữ liệu cá nhân sau khi Agent của OpenAI thực hiện lệnh xóa file bị lỗi do sai sót trong phân tích đường dẫn. Sự cố cảnh báo rủi ro nghiêm trọng khi cấp quyền truy cập toàn diện cho các tác nhân AI tự hành.

Các nhóm khủng bố đang lợi dụng AI chatbot để lên kế hoạch tấn công và chế tạo vũ khí

Nguồn: The Decoder: AI News · Bài gốc

Nghiên cứu từ Đại học Cambridge chỉ ra rằng các tổ chức như Boko Haram và ISIS đang sử dụng ChatGPT, Claude và Gemini để lập kế hoạch tấn công và chế tạo vũ khí, cho thấy các bộ lọc an toàn của AI hiện vẫn chưa đủ hiệu quả.

Sử dụng Claude Fable 5, Bun tái cấu trúc hơn 1 triệu dòng code từ Zig sang Rust chỉ trong 11 ngày

Nguồn: IT Home · Bài gốc

Nhà phát triển Jarred Sumner đã tận dụng 64 thực thể Claude Fable 5 để viết lại toàn bộ runtime Bun từ Zig sang Rust. Dự án tiêu tốn 165.000 USD phí API nhưng giúp tiết kiệm 1 năm nhân lực, đồng thời tăng độ ổn định và hiệu suất cho Bun v1.4.0.

Bloomberg tiết lộ: Cựu kỹ sư Apple bị kiện vì đánh cắp bí mật cho OpenAI chỉ bằng một tin nhắn 'Haha'

Nguồn: IT Home · Bài gốc

Apple khởi kiện OpenAI sau khi phát hiện cựu nhân viên lợi dụng lỗ hổng bảo mật để truy cập dữ liệu nội bộ và tiếp tay cho làn sóng 'rút ruột' nhân sự cấp cao nhằm phát triển thiết bị AI cạnh tranh với iPhone.

Apple kiện OpenAI vì cáo buộc đánh cắp bí mật thương mại

Nguồn: TechCrunch: AI · Bài gốc

Apple cáo buộc ban lãnh đạo cấp cao của OpenAI, bao gồm một cựu nhân viên lâu năm, đã trực tiếp chỉ đạo hành vi chiếm đoạt bí mật thương mại của hãng.

Zuckerberg phản hồi tin đồn Meta 'dư thừa' sức mạnh tính toán: Cho thuê để tối ưu lợi nhuận

Nguồn: IT Home · Bài gốc

Mark Zuckerberg bác bỏ tin đồn Meta dư thừa hạ tầng AI, khẳng định nhu cầu nội bộ vẫn rất lớn nhưng sẵn sàng cho thuê lại nếu thị trường trả giá cao hơn so với việc tự sử dụng.

Cognition tin tưởng giao việc cho Claude Fable 5: Đột phá khả năng làm việc xuyên đêm

Nguồn: Claude: Blog (Web) · Bài gốc

Cognition cho biết Claude Fable 5 là mô hình AI đầu tiên có thể làm việc liên tục 8 giờ, tự xử lý lỗi và duy trì logic ổn định trong các tác vụ lập trình phức tạp, vượt xa hiệu suất của các thế hệ tiền nhiệm.

Elon Musk khen ngợi Mythos/Fable, cam kết không 'cắt đứt' quyền truy cập của Anthropic

Nguồn: TechCrunch: AI · Bài gốc

Trước viễn cảnh doanh thu 40 tỷ USD, Elon Musk khẳng định Anthropic có thể tin tưởng vào hạ tầng của ông để vận hành các mô hình AI của họ.

Tesla chốt thiết kế Optimus Gen 3: Musk dọa sa thải toàn bộ đội ngũ thu mua nếu không đạt mục tiêu sản xuất

Nguồn: IT Home · Bài gốc

Tesla đã chính thức chốt thiết kế Optimus thế hệ thứ 3 và yêu cầu nhà cung cấp tăng tốc sản xuất lên hàng nghìn đơn vị mỗi tuần vào cuối năm nay. Elon Musk khẳng định sẽ sa thải đội ngũ phụ trách nếu không đạt được tiến độ này.

Ollama đạt 8,9 triệu nhà phát triển, hoàn tất vòng gọi vốn Series B dẫn dắt bởi Theory

Nguồn: Tomer Tunguz Blog (phân tích VC) · Bài gốc

Ollama, nền tảng giúp chạy mô hình AI cục bộ dễ dàng, vừa đạt cột mốc 8,9 triệu người dùng và 67.000 tích hợp, đồng thời công bố vòng gọi vốn Series B do Theory dẫn dắt.

Anthropic khởi động sáng kiến 'Câu hỏi hóc búa' nhằm lắng nghe phản biện về AI

Nguồn: Anthropic: Newsroom (Web) · Bài gốc

Anthropic kêu gọi cộng đồng đặt ra những câu hỏi gai góc nhất về tác động của AI đối với xã hội, đồng thời cam kết công khai lộ trình giải quyết các vấn đề này để đảm bảo sự phát triển bền vững.

Cựu Chủ tịch FED Ben Bernanke gia nhập hội đồng quản trị niềm tin của Anthropic

Nguồn: Anthropic: Newsroom (Web) · Bài gốc

Anthropic bổ nhiệm cựu Chủ tịch FED Ben Bernanke vào hội đồng quản trị niềm tin (LTBT) để giám sát việc phát triển AI an toàn và nghiên cứu tác động kinh tế của công nghệ này đối với thị trường lao động toàn cầu.

04Thủ thuật / thực hành12 bài

Ghost Font: Phông chữ 'tàng hình' khiến AI bó tay

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Ghost Font sử dụng kỹ thuật chuyển động và nhiễu ảnh để ẩn giấu văn bản, khiến các mô hình AI hàng đầu như Claude hay GPT không thể giải mã, ngay cả khi có khả năng lập trình.

Elon Musk thừa nhận Anthropic đang dẫn đầu cuộc đua AI hiện nay

Nguồn: X: Rohan Paul (@rohanpaul_ai) · Bài gốc

Elon Musk bất ngờ công nhận Anthropic là đơn vị dẫn đầu lĩnh vực AI nhờ hiệu năng vượt trội của các mô hình như Mythos/Fable, đồng thời khẳng định sẽ không cản trở sự phát triển của đối thủ.

Elon Musk tán dương Grok Build: Công cụ lập trình AI đột phá cho phát triển game

Nguồn: X: Elon Musk (@elonmusk, xAI) · Bài gốc

Grok Build đang gây chú ý nhờ khả năng tích hợp tạo ảnh và video trực tiếp vào quy trình lập trình, giúp rút ngắn thời gian phát triển game 2D từ hàng giờ xuống dưới 30 phút với chất lượng vượt trội.

Thinking Machines Lab AI

Nguồn: Thinking Machines Lab: Blog · Bài gốc

Thinking Machines Lab AI AI AI

Tại sao công cụ tốt lại khiến việc review code bằng Copilot kém hiệu quả hơn?

Nguồn: GitHub Blog · Bài gốc

GitHub chia sẻ cách tối ưu hóa quy trình review code bằng cách chuyển đổi sang các công cụ khám phá mã nguồn kiểu Unix, giúp giảm chi phí và cải thiện hiệu suất làm việc của AI agent.

Theory Ventures AI

Nguồn: Tomer Tunguz Blog (phân tích VC) · Bài gốc

Theory Ventures Tomer Tunguz AI 41 1 AI 100 5 AI AI Koah AI 4-5 “” MCP

Liệu AI có thể giải đáp bài toán trị giá 3 nghìn tỷ đô la?

Nguồn: TechCrunch: AI · Bài gốc

Cuộc tranh luận về lợi tức đầu tư (ROI) của AI đang nóng trở lại với quy mô vốn khổng lồ và những hệ quả khó lường đối với tương lai ngành công nghệ.

Bùng nổ nội dung AI trên mạng xã hội: Hơn 40% bài viết dài trên LinkedIn do AI tạo ra

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Nghiên cứu từ Pangram cho thấy nội dung do AI tạo ra đang tràn ngập mạng xã hội, trong đó LinkedIn dẫn đầu với hơn 40% bài viết dài được viết hoàn toàn bởi AI, theo sau là X/Twitter và Reddit.

Bun được Anthropic mua lại và tái cấu trúc bằng Rust, đạt hơn 22 triệu lượt tải mỗi tháng

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Sau khi về tay Anthropic, Bun đã được viết lại bằng Rust để tăng cường độ ổn định. Với hơn 22 triệu lượt tải hàng tháng, dự án hiện tập trung khắc phục các lỗi bộ nhớ nghiêm trọng nhờ sự hỗ trợ từ Rust và các công cụ kiểm thử hiện đại.

TeXada: Trợ lý AI toán học chạy cục bộ, hỗ trợ chuyển đổi LaTeX mạnh mẽ

Nguồn: X: OpenBMB (@OpenBMB) · Bài gốc

TeXada là trợ lý AI mã nguồn mở dựa trên MiniCPM, cho phép chuyển đổi ngôn ngữ tự nhiên và hình ảnh viết tay sang LaTeX ngay trên thiết bị mà không cần kết nối đám mây, đảm bảo quyền riêng tư tối đa.

Anthropic chia sẻ 2 mô hình đa tác nhân (Multi-Agent) tối ưu chi phí và hiệu suất

Nguồn: X: Shao Meng (@shao__meng) · Bài gốc

Anthropic giới thiệu hai mô hình phối hợp tác nhân: Advisor (tư vấn) và Orchestrator (điều phối), giúp cân bằng giữa hiệu suất vượt trội và chi phí vận hành thấp hơn đáng kể so với việc sử dụng các mô hình lớn đơn lẻ.

Sinh viên cao học Kunkun chia sẻ mã nguồn phương pháp quản lý chuỗi kỹ năng (Skill) cho AI Agent

Nguồn: X: Berry Xia (@berryxia) · Bài gốc

Dự án mã nguồn mở của Kunkun giúp quản lý các chuỗi kỹ năng phức tạp thông qua giao diện HTML, sơ đồ Mermaid và cơ chế 'ask me' để tăng khả năng kiểm soát và tính nhất quán cho AI Agent.

05Nghiên cứu / bài báo12 bài

Robot hình người Unitree G1 thực hiện thành công ca phẫu thuật nội soi sống đầu tiên

Nguồn: X: X.PIN (@thexpin) · Bài gốc

Các nhà nghiên cứu tại UC San Diego đã sử dụng robot Unitree G1 để thực hiện phẫu thuật cắt túi mật nội soi trên lợn sống. Dù vẫn cần cải thiện về độ vô trùng và hiệu chuẩn, chi phí của hệ thống này chỉ bằng khoảng 5% so với robot Da Vinci truyền thống.

Báo cáo chấn động: Nhóm khủng bố Boko Haram lạm dụng AI tạo sinh để lên kế hoạch tấn công

Nguồn: Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung) · Bài gốc

Nghiên cứu từ các cuộc phỏng vấn cho thấy Boko Haram đã hệ thống hóa việc sử dụng các mô hình AI như ChatGPT, Claude và DeepSeek để hỗ trợ lập kế hoạch tác chiến, sửa chữa vũ khí và chế tạo thiết bị nổ.

Xiaohongshu ra mắt PIPO: Kiến trúc LLM đột phá giúp tăng tốc độ xử lý và hiệu suất suy luận

Nguồn: : (dots.llm) · Bài gốc

Kiến trúc PIPO của Xiaohongshu tối ưu hóa LLM bằng cách nén đầu vào và mở rộng đầu ra, giúp tăng tốc độ suy luận lên tới 1,86 lần và cải thiện đáng kể độ chính xác trên các bài kiểm tra toán học phức tạp.

DeepSeek-V4 Flash triển khai huấn luyện RL trên GPU AMD Instinct MI355X thông qua khung Miles

Nguồn: LMSYS: Blog (Chatbot Arena ) · Bài gốc

DeepSeek-V4 Flash hiện hỗ trợ huấn luyện tăng cường trên GPU AMD MI355X nhờ khung Miles và ROCm. Nhóm nghiên cứu đã giải quyết thành công các thách thức về đồng bộ hóa mô hình và độ ổn định đa nút, giúp tối ưu hóa hiệu suất huấn luyện cho mô hình MoE 284 tỷ tham số.

Tin AI đang được cập nhật bản dịch

Nguồn: Apple Machine Learning Research · Bài gốc

Appletokenon-policytargeted-rollout rolloutsrolloutstoken

TGPO: Tăng cường nhận thức thời gian cho video góc nhìn thứ nhất qua học tăng cường

Nguồn: Apple Machine Learning Research · Bài gốc

TGPO là thuật toán học tăng cường mới giúp mô hình đa phương thức (MLLM) hiểu trình tự thời gian trong video tốt hơn, thay vì chỉ dựa vào hình ảnh tĩnh, từ đó cải thiện độ chính xác trong việc suy luận nhân quả và định vị sự kiện.

Apple SRLM

Nguồn: Apple Machine Learning Research · Bài gốc

Apple SRLM SRLM RLM 22% RLM RLMRLM SRLM

Tin tặc có thể lợi dụng 9 công cụ AI phổ biến để tạo mạng lưới botnet khổng lồ

Nguồn: Ars Technica: AI · Bài gốc

Các chuyên gia cảnh báo hacker đang tận dụng lỗ hổng từ 9 công cụ AI hàng đầu để tự động hóa việc xây dựng và điều khiển các mạng lưới botnet quy mô lớn, gây nguy cơ bảo mật nghiêm trọng.

OpenAI chỉ ra lỗ hổng trong bộ tiêu chuẩn đánh giá khả năng lập trình của AI

Nguồn: OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng) · Bài gốc

Phân tích mới từ OpenAI cho thấy SWE-Bench Pro tồn tại nhiều hạn chế, đặt ra dấu hỏi lớn về độ tin cậy và tính chính xác khi đánh giá năng lực lập trình của các mô hình AI hiện nay.

Anthropic giới thiệu GRAM: Công nghệ 'công tắc' kiểm soát tri thức nhạy cảm trong mô hình AI

Nguồn: Anthropic: Research ( - Web) · Bài gốc

Anthropic và AE Studio phát triển phương pháp GRAM, cho phép cô lập các kiến thức nhạy cảm vào các module riêng biệt. Người dùng có thể xóa bỏ các module này sau khi huấn luyện để ngăn chặn việc lạm dụng mô hình mà không làm ảnh hưởng đến hiệu suất chung.

Nghiên cứu của Apple: Chỉ cần can thiệp một neuron để vô hiệu hóa cơ chế an toàn của LLM

Nguồn: Apple Machine Learning Research · Bài gốc

Các nhà nghiên cứu Apple phát hiện rằng việc ức chế hoặc kích hoạt một neuron đơn lẻ có thể dễ dàng vượt qua rào cản an toàn của các mô hình ngôn ngữ lớn mà không cần huấn luyện lại hay kỹ thuật prompt phức tạp.

Weblica: Môi trường huấn luyện có khả năng mở rộng cho các tác nhân AI điều hướng web

Nguồn: Apple Machine Learning Research · Bài gốc

Apple giới thiệu Weblica, khung huấn luyện sử dụng bộ nhớ đệm HTTP để tái tạo trạng thái web ổn định, giúp các tác nhân AI học kỹ năng điều hướng hiệu quả và đạt hiệu suất tương đương các mô hình API lớn.