smol.ai AI News
85

Tin ngành

Mỹ siết chặt kiểm soát mô hình AI Trung Quốc: Cuộc chiến giữa an ninh và đổi mới

(giờ Việt Nam)

Tóm tắt AI

Mỹ đang cân nhắc hạn chế các mô hình AI mở từ Trung Quốc như Kimi, trong khi các chuyên gia cảnh báo điều này có thể gây hại cho cạnh tranh. Đồng thời, Alibaba và Zhipu tiếp tục đẩy mạnh phát triển các mô hình mã nguồn mở quy mô lớn và hạ tầng chip nội địa.

Bản dịch AI

not much happened today | AINews

một ngày yên ắng.

Tin tức AI từ 18/7/2026 đến 20/7/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm thông tin từ Discord. Trang web của AINews cho phép bạn tìm kiếm tất cả các số đã phát hành. Xin nhắc lại, AINews hiện là một chuyên mục của Latent Space. Bạn có thể tùy chọn đăng ký/hủy đăng ký nhận email theo tần suất mong muốn!

Tóm tắt AI trên Twitter

Cuộc cạnh tranh mô hình mã nguồn mở (Open-Weight), chính sách mô hình của Trung Quốc và địa chính trị mới của AI

Kimi K3, Qwen 3.8 Preview, hạ tầng GLM và đà phát triển của các mô hình mở

Agent Harnesses, RLM và sự chuyển dịch từ tổng quát hóa lấy mô hình làm trung tâm sang lấy hệ thống làm trung tâm

Độ tin cậy dài hạn, định tuyến và hạ tầng cho AI trong sản xuất

Toán học, các bộ tiêu chuẩn đánh giá (benchmarks) và bằng chứng cho thấy các mô hình tiên phong đang vượt qua những ngưỡng năng lực mới

Các tweet hàng đầu (theo mức độ tương tác)

Tóm tắt AI trên Reddit

Tóm tắt từ /r/LocalLlama + /r/localLLM

1. Tiên phong về mô hình mã nguồn mở: Qwen 3.8 và Kimi K3

Hãy chuẩn bị (v)ram của bạn - Qwen3.8 sắp ra mắt! (Hoạt động: 3719): Hình ảnh là đồ họa thông báo trên X/Twitter từ tài khoản Qwen đã xác minh, cho biết Qwen3.8 sắp ra mắt dưới dạng mô hình mã nguồn mở, với thông số tiêu đề là bản phát hành 2.4T tham số. Trong bối cảnh tiêu đề Reddit "Hãy chuẩn bị (v)ram", ý nghĩa kỹ thuật là một mô hình mã nguồn mở 2.4T sẽ vượt xa khả năng suy luận cục bộ của người dùng phổ thông, trừ khi nó được phát hành dưới dạng MoE với các tham số hoạt động nhỏ hơn nhiều, được lượng tử hóa mạnh hoặc đi kèm với các biến thể dày đặc/chưng cất nhỏ hơn. Người bình luận nhìn chung rất hào hứng khi Qwen tiếp tục phát hành các mô hình mã nguồn mở, nhưng cuộc tranh luận/yêu cầu chính là về một hệ thống các mô hình thực tế đầy đủ—đặc biệt là các mô hình dày đặc nhỏ hơn và các biến thể MoE như 256B A32B, 128B A16B, 64B A8B, cộng với các mô hình dày đặc 27B/32B/16B/8B trở xuống—để người dùng cục bộ không bị giới hạn ở các checkpoint quy mô hàng đầu.

Kimi-K3 vẫn chưa hoàn toàn tốt hơn Fable, nhưng chắc chắn đang tiến gần hơn. (Hoạt động: 501): Hình ảnh là biểu đồ xu hướng/đánh giá kỹ thuật (liên kết) cho thấy các mô hình tiên phong đóng vẫn dẫn trước các mô hình mã nguồn mở, nhưng với Kimi-K3 2.8T đang thu hẹp khoảng cách xuống còn khoảng ~1,5 tháng so với các mô hình như Fable 5 trên "chỉ số trí tuệ AI". Bài đăng coi Kimi-K3 là bằng chứng cho thấy việc mở rộng quy mô mô hình mã nguồn mở vẫn hiệu quả—mặc dù đòi hỏi hạ tầng khổng lồ thay vì phần cứng người dùng phổ thông—và đặt câu hỏi tại sao Google/Gemini dường như vắng bóng trong các bước tiến tiên phong gần đây trên biểu đồ. Người bình luận phản bác ý kiến cho rằng sự cường điệu đã quá mức, lập luận rằng việc chỉ chậm hơn vài tháng so với các mô hình đóng vẫn có ý nghĩa chiến lược vì các mô hình mở có thể rẻ hơn, tự lưu trữ, ít bị hạn chế hơn và không chịu sự cắt giảm chi phí hoặc chính sách từ chối từ phía nhà cung cấp. Một số suy đoán rằng Kimi-K3 có thể đã vượt qua Fable trong các lĩnh vực như khoa học sự sống, an ninh, an ninh mạng hoặc lập trình cấp thấp.

2. Rào cản an ninh AI so với Phản ứng sự cố

Kimi K3 vừa sửa 15 lỗi bảo mật nghiêm trọng mà Codex và Fable từ chối vì "rào cản an ninh mạng". Hugging Face: Chúng tôi cũng đã trải qua điều này trong tuần này! Thật đáng sợ khi bị chặn bởi rào cản khi bạn là người phòng thủ trong khi biết những kẻ tấn công có khả năng đang vượt qua chúng (Hoạt động: 2235): Hình ảnh là ảnh chụp màn hình một chuỗi thảo luận trên X/Twitter (hình ảnh) lập luận rằng "rào cản an ninh mạng" của AI đang chặn công việc bảo mật phòng thủ hợp pháp: David Sacks tuyên bố Kimi K3 đã sửa 15 lỗi bảo mật nghiêm trọng mà Codex và Fable từ chối hỗ trợ, trong khi Clément Delangue của Hugging Face cho biết họ đã gặp vấn đề tương tự trong sự cố bảo mật tháng 7/2026. Ý nghĩa kỹ thuật là sự bất đối xứng được cho là khi những người phòng thủ phân tích các payload khai thác thực tế hoặc vá các lỗ hổng có thể bị các bộ lọc an toàn từ chối, trong khi những kẻ tấn công có khả năng vượt qua các hạn chế đó hoặc sử dụng các mô hình ít hạn chế/mở hơn. Các bình luận coi đây là sự đánh đổi về chính sách và bảo mật: một số lo ngại chính phủ có thể phản ứng bằng cách cấm các mô hình AI nước ngoài/nguồn mở, trong khi những người khác lập luận rằng các rào cản quá rộng có thể làm tê liệt phản ứng sự cố và các biện pháp đối phó phòng thủ trong các tình huống rủi ro cao.

Báo cáo sự cố bảo mật của HuggingFace: "kẻ tấn công không bị ràng buộc bởi bất kỳ chính sách sử dụng nào, trong khi công việc pháp y của chính chúng tôi lại bị chặn bởi các rào cản" (Hoạt động: 1660): Hugging Face đã báo cáo một vụ xâm nhập hạ tầng sản xuất mà họ cho biết được thực hiện từ đầu đến cuối bởi một hệ thống tác nhân AI tự trị và được phát hiện bởi tính năng phát hiện bất thường có sự hỗ trợ của AI thông qua phân loại LLM trên dữ liệu đo lường bảo mật. Trong quá trình phản ứng sự cố, các API mô hình tiên phong thương mại được cho là đã chặn các câu lệnh pháp y chứa payload khai thác, các artifact C2 và lệnh tấn công, buộc nhóm phải chạy GLM 5.2 cục bộ; điều này vừa vượt qua các rào cản của nhà cung cấp vừa giữ dữ liệu/thông tin xác thực của kẻ tấn công bên trong hạ tầng của HF. Người bình luận coi đây là bằng chứng cho thấy các quy trình bảo mật doanh nghiệp cần các mô hình tiên phong cục bộ/mã nguồn mở hoặc chế độ truy cập tin cậy cho các API thương mại, vì các bộ lọc an toàn chung có thể chặn phản ứng sự cố hợp pháp. Một vài bình luận suy đoán về thời điểm liên quan đến các bản phát hành K3/Qwen sắp tới, nhưng không có bằng chứng kỹ thuật.

3. Công cụ AI cục bộ: Tinh chỉnh AMD và Agent Harnesses

Unsloth hiện đã hỗ trợ AMD! (Hoạt động: 659): Hình ảnh là thông báo sản phẩm kỹ thuật về việc hỗ trợ AMD của Unsloth (hình ảnh), hiển thị thương hiệu Unsloth/AMD và giao diện "Fine-tuning Studio" tối màu với một phiên huấn luyện trực tiếp, màn hình theo dõi GPU/VRAM và các chỉ số trên Radeon RX 9070 XT. Bài đăng cho biết Unsloth hiện hỗ trợ GPU/CPU AMD trên Windows, Linux, WSL và macOS, bao gồm Radeon RX 9000/7000, Instinct MI350/MI300 và Strix Halo/Ryzen AI Max, với các cài đặt tự động ROCm/Triton/bitsandbytes/PyTorch/llama.cpp qua curl, PowerShell hoặc uv pip install "unsloth[amd]". Các khả năng được tuyên bố bao gồm suy luận cục bộ, tinh chỉnh, RL, triển khai, xuất GGUF/safetensors/LoRA và giảm tới 70% VRAM cho huấn luyện / 80% VRAM cho RL, với chi tiết hơn trong tài liệu Unsloth AMD. Người bình luận nhìn chung tích cực nhưng nêu lên những lo ngại kỹ thuật về việc liệu AMD có còn mức sử dụng VRAM cao hơn/vấn đề OOM so với Nvidia do các phụ thuộc hoặc kernel hay không. Một người dùng Strix Halo báo cáo rằng bản phát hành mới "hoạt động ngay lập tức" so với nhánh xem trước cũ vốn có nhiều vấn đề.

Vậy chuyện gì đã xảy ra với OpenClaw? (Hoạt động: 980): Chuỗi thảo luận đặt câu hỏi tại sao OpenClaw nhanh chóng mất đi sự quan tâm sau khi nổi lên mạnh mẽ, với người đăng bài chỉ ra việc giới thiệu định giá dựa trên mức sử dụng và các dự án tác nhân/harness cạnh tranh là những điểm chuyển hướng có thể xảy ra. Giải thích kỹ thuật nhất được đưa ra là OpenClaw có cửa sổ phát hành tồi tệ từ khoảng tháng 4 đến tháng 6, nơi "gần như mọi bản phát hành đều làm hỏng thứ gì đó", trong khi Hermes được coi là ổn định và đầy đủ tính năng hơn, khiến người dùng cần quy trình tác nhân đáng tin cậy phải chuyển sang. Người bình luận hoài nghi về chu kỳ cường điệu: một bình luận hàng đầu cho rằng sự phổ biến của OpenClaw được thúc đẩy bởi việc tạo dựng uy tín giả để nâng cao hồ sơ và triển vọng việc làm của tác giả, trong khi một người khác coi sự suy giảm này là một thất bại đơn giản về độ tin cậy/bảo trì so với Hermes.

Tóm tắt Subreddit AI ít kỹ thuật hơn

/r/Singularity, /r/Oobabooga, /r/MachineLearning, /r/OpenAI, /r/ClaudeAI, /r/StableDiffusion, /r/ChatGPT, /r/ChatGPTCoding, /r/aivideo, /r/aivideo

1. Làn sóng mô hình mã nguồn mở Trung Quốc và phản ứng dữ dội từ chính sách Hoa Kỳ

TIN MỚI: Qwen 3.8 sắp ra mắt. Cơn bão mã nguồn mở từ Trung Quốc vẫn tiếp tục. (Hoạt động: 1616): Hình ảnh là ảnh chụp màn hình một thông báo được cho là từ tài khoản Qwen X/Twitter đã xác minh về Qwen3.8, tuyên bố Qwen3.8-Max-Preview với 2.4T tham số có sẵn thông qua các dịch vụ của Alibaba như Token Plan/Qoder, với mã nguồn mở "sớm" và các liên kết định giá riêng cho quốc tế/Trung Quốc. Nếu chính xác, ý nghĩa kỹ thuật là một bản phát hành LLM mã nguồn mở rất lớn khác của Trung Quốc, nhưng bối cảnh bài đăng/bình luận chưa cung cấp chi tiết kiến trúc, số lượng tham số hoạt động, điểm chuẩn, độ dài ngữ cảnh, giấy phép hoặc trọng số có thể tải xuống. Các bình luận chủ yếu là sự cường điệu và đùa cợt: một người coi đó là một phần của làn sóng mã nguồn mở nhanh chóng của Trung Quốc sau "Kimi K3", trong khi người khác đùa rằng RTX 5070 + 32GB DDR4 đã "sẵn sàng", ngầm hiểu rằng một mô hình 2.4T sẽ đòi hỏi hạ tầng máy chủ/đa GPU nghiêm túc thay vì phần cứng người dùng phổ thông.

Kimi tạm dừng đăng ký mới và ưu tiên tài nguyên tính toán cho các thành viên hiện tại do nhu cầu tăng vọt. (Hoạt động: 2456): Hình ảnh là ảnh chụp màn hình Kimi.ai thông báo trên X/Twitter rằng nhu cầu Kimi K3 đã vượt quá công suất GPU hiện có, vì vậy công ty tạm thời dừng đăng ký mới và ưu tiên tài nguyên tính toán cho người dùng trả phí hiện tại: hình ảnh. Bài đăng cũng cho biết Kimi đang bổ sung công suất và có kế hoạch chia các gói thành viên tương lai thành các tầng riêng biệt cho việc sử dụng Kimi chung và quy trình làm việc lập trình, ngụ ý việc định giá/phân bổ tài nguyên cụ thể theo khối lượng công việc khi nhu cầu suy luận tăng lên. Người bình luận nhìn chung coi việc tạm dừng này là một giải pháp thay thế tích cực cho việc âm thầm làm giảm chất lượng dịch vụ thông qua lượng tử hóa thấp hơn, giảm hạn ngạch hoặc giới hạn tốc độ. Một người dùng trích dẫn hiệu suất OpenRouter kém — độ trễ khoảng 11 giây và 16 token/giây — làm bằng chứng cho thấy nhu cầu đã gây áp lực lên công suất suy luận của Kimi K3.

Chính quyền Trump xem xét cấm các mô hình AI tiên tiến của Trung Quốc (theo Axios). Động thái giảm tốc? (Hoạt động: 1004): Axios báo cáo rằng chính quyền Trump đang xem xét các hạn chế hoặc lệnh cấm đối với các mô hình AI tiên tiến của Trung Quốc, đặc biệt là trong bối cảnh các hệ thống mã nguồn mở của Trung Quốc như Kimi (Axios). Người bình luận kết nối điều này với áp lực chính sách AI rộng lớn hơn của Hoa Kỳ từ các phòng thí nghiệm mô hình đóng—trích dẫn các báo cáo vận động hành lang của các nhà lãnh đạo như Demis Hassabis và Dario Amodei để có quy định chặt chẽ hơn—trong khi các nhân vật như David Sacks được cho là lập luận rằng các quy tắc như vậy sẽ làm chậm sự đổi mới. Mối quan tâm chính sách kỹ thuật chính trong các bình luận là việc cấm các mô hình Trung Quốc có thể hoạt động như chủ nghĩa bảo hộ cho các phòng thí nghiệm đóng của Hoa Kỳ như OpenAI và Anthropic, đồng thời đẩy việc sử dụng mô hình mã nguồn mở vào một thị trường đen không thể thực thi. Một số người bình luận mô tả động thái này là sự chiếm dụng quy định hoặc chính sách "giảm tốc" có thể làm suy yếu khả năng cạnh tranh AI của Hoa Kỳ thay vì cải thiện an ninh.

David Sacks nói rằng các rào cản AI của Hoa Kỳ đang làm cho các mô hình của Mỹ kém cạnh tranh hơn sau khi Kimi K3 của Trung Quốc sửa 15 lỗi bảo mật mà Codex và Fable từ chối (Hoạt động: 1907): Hình ảnh là ảnh chụp màn hình David Sacks lập luận trên X rằng "rào cản an ninh mạng" AI của Hoa Kỳ đang gây hại cho khả năng cạnh tranh vì Kimi K3 của Trung Quốc được cho là đã sửa 15 lỗi bảo mật nghiêm trọng mà Codex và Fable từ chối giải quyết. Về mặt kỹ thuật, bài đăng coi hành vi từ chối an toàn trong các tác vụ mã/an ninh mạng là một chế độ thất bại giống như điểm chuẩn: các mô hình có thể từ chối khắc phục lỗ hổng ngay cả khi tác vụ mang tính phòng thủ, có khả năng làm cho các mô hình ít hạn chế hoặc mã nguồn mở hữu ích hơn cho việc bảo trì phần mềm an toàn. Các bình luận phần lớn đồng ý với mối lo ngại về khả năng cạnh tranh, lập luận rằng các rào cản hạn chế có thể bảo vệ các thị trường tư vấn an ninh mạng hiện tại và rằng các mô hình Trung Quốc/mã nguồn mở có thể vượt qua các hệ thống của Hoa Kỳ nếu chúng vẫn có năng lực hơn trong các tác vụ kỹ thuật bảo mật thực tế.

Người đứng đầu bộ phận tương lai chiến lược của OpenAI nói rằng sự thống trị của mô hình mã nguồn mở là chủ nghĩa cộng sản AI (Hoạt động: 1846): Hình ảnh là một đồ họa trích dẫn chính trị/chính sách phi kỹ thuật (hình ảnh) được cho là của Dean W. Ball, Trưởng bộ phận Tương lai Chiến lược tại OpenAI, coi sự thống trị của mô hình mã nguồn mở là "giảm tốc" và cảnh báo rằng AI được coi là hàng hóa công cộng do nhà nước cung cấp có thể trở thành "chủ nghĩa cộng sản AI". Ý nghĩa của bài đăng mang tính ngữ cảnh hơn là liên quan đến điểm chuẩn hoặc triển khai: nó làm nổi bật những căng thẳng giữa các phòng thí nghiệm AI tiên phong đóng và các hệ sinh thái mô hình mã nguồn mở/nguồn mở, đặc biệt là xung quanh rủi ro quy định, các mô hình mã nguồn mở Trung Quốc và liệu hạ tầng AI nên được kiểm soát tư nhân hay giống như hàng hóa công cộng. Người bình luận nhìn chung chỉ trích, giải thích trích dẫn này là bằng chứng cho thấy OpenAI "sợ nguồn mở" và chế giễu sự trớ trêu của việc OpenAI phản đối AI mở. Một phản đối lặp đi lặp lại là việc gọi AI hàng hóa công cộng là phản địa đàng dường như không nhất quán với các tiện ích công cộng khác như điện.

2. Các tuyên bố tiên phong về Khoa học và Toán học AI

Có vẻ như giả thuyết Jacobian vừa được Fable chứng minh là sai (Hoạt động: 2860): Bài đăng liên kết đến một video trên X tuyên bố Fable đã tìm thấy một phản ví dụ cho giả thuyết Jacobian—tức là, một bản đồ đa thức với định thức Jacobian khác không/hằng số ở mọi nơi nhưng không thể đảo ngược: x.com/i/status/2079028340955197566. Một người bình luận kỹ thuật hàng đầu cho biết phản ví dụ được cho là này đặc biệt đơn giản: một hàm đa thức 3 biến với các hệ số nguyên một chữ số, và việc xác minh là "hoàn toàn tầm thường" bằng tay hoặc gần như tức thời trong CAS; tuy nhiên, đoạn trích Reddit không bao gồm đa thức thực tế, vì vậy tuyên bố này không thể được kiểm chứng độc lập chỉ từ văn bản chuỗi thảo luận. Người bình luận chia rẽ giữa sự kinh ngạc rằng một phản ví dụ đơn giản như vậy chưa được tìm thấy bằng tìm kiếm vét cạn/máy tính trước đó, sự tò mò về việc liệu một tác nhân Fable có thể tự động tấn công nhiều bài toán mở hay không, và sự hoài nghi/bối rối từ những người không chuyên yêu cầu giải thích toán học.

AI chỉ dự đoán từ tiếp theo!! (Hoạt động: 1234): Hình ảnh là một meme/hoạt hình phi kỹ thuật chế giễu tiêu đề "AI chỉ dự đoán từ tiếp theo!!": một người dùng yêu cầu AI đưa ra phản ví dụ cho giả thuyết Jacobian, và AI đưa ra một biểu thức bản đồ đa thức dày đặc tuyên bố định thức Jacobian là -2. Theo ngữ cảnh, nó đùa rằng các LLM hiện đại có thể tạo ra các kết quả đầu ra trông có vẻ toán học nâng cao mặc dù chỉ là các trình dự đoán từ tiếp theo, nhưng hình ảnh không thiết lập một phản ví dụ thực tế hoặc kết quả kỹ thuật nào. Các bình luận phần lớn coi "nó chỉ dự đoán từ tiếp theo" là đúng về mặt kỹ thuật nhưng mang tính giản lược, so sánh nó với việc nói máy tính "chỉ là các công tắc đèn chỉ vào nhau". Những người khác nhấn mạnh sự tiến bộ nhanh chóng của AI và kỳ vọng các hệ thống hiện tại sẽ là những hệ thống chậm nhất/ít năng lực nhất mà chúng từng có.

Sử dụng Claude như một phần thưởng (Hoạt động: 916): Hình ảnh là thông báo của Anthropic cung cấp cho các nhà nghiên cứu tới 50.000 đô la tín dụng sử dụng Claude cho các dự án nhắm vào việc chữa trị các bệnh hiếm gặp, được coi là lời kêu gọi tập trung đầu tiên trong chương trình AI for Science của Anthropic. Trong bối cảnh tiêu đề bài đăng, "Sử dụng Claude như một phần thưởng", ý nghĩa kỹ thuật là khoản tài trợ dường như chủ yếu là tín dụng sử dụng API/mô hình thay vì tài trợ tiền mặt trực tiếp, có khả năng hỗ trợ đánh giá tài liệu, tạo giả thuyết, phân tích dữ liệu hoặc tự động hóa quy trình làm việc với Claude. Các bình luận về hình ảnh chủ yếu hoài nghi hoặc mỉa mai, đặt câu hỏi liệu 50.000 đô la tín dụng có ý nghĩa gì đối với nghiên cứu y sinh và đùa về việc "bộ lọc sinh học"/an toàn của Claude hạn chế tính hữu ích cho công việc chữa bệnh.

Các Discord về AI

Thật không may, Discord đã chặn quyền truy cập của chúng tôi hôm nay. Chúng tôi sẽ không mang nó trở lại dưới hình thức này nhưng chúng tôi sẽ sớm ra mắt AINews mới. Cảm ơn bạn đã đọc đến đây, đó là một chặng đường tốt đẹp.

AI Trung QuốcChính sách AIMô hình mởAn ninh công nghệAlibaba
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ smol.ai AI News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.