Phát hành mô hình
CHỦ ĐỀ · TRANG 3

Phát hành mô hình

Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.

3.595 bài thu thập350 tinh chọncập nhật đến 28/09 02:09

  1. Hugging Face Daily PapersT3 · 22/09 · 08:00

    SteerDuplex: Mô hình hội thoại giọng nói song công có khả năng tùy biến linh hoạt

    SteerDuplex là mô hình hội thoại song công (full-duplex) đột phá, cho phép người dùng điều chỉnh linh hoạt tông giọng, phong cách và tốc độ nói thông qua các hướng dẫn trực tiếp, giúp tương tác tự nhiên và thông minh hơn.

  2. OpenRouter: AnnouncementsT3 · 22/09 · 07:51

    OpenRouter phân tích cách NVIDIA Nemotron 3.5 Lightning tối ưu hóa tác vụ cho AI Agent

    OpenRouter giới thiệu Nemotron 3.5 Lightning, mô hình 3B tham số chuyên biệt cho các tác vụ thực thi nhanh và gọi công cụ, giúp tối ưu hóa hiệu suất cho AI Agent bên cạnh các mô hình suy luận phức tạp.

  3. ArenaT3 · 22/09 · 04:21

    Xiaomi ra mắt MiMo-V2.6-Pro: Lọt Top 10 bảng xếp hạng lập trình WebDev

    Xiaomi vừa trình làng hai mô hình toàn năng MiMo-V2.6-Pro và Flash. Trong đó, MiMo-V2.6-Pro đạt 1628 điểm trên bảng xếp hạng Code Arena, đứng thứ 10 chung cuộc và thứ 3 trong nhóm mô hình mã nguồn mở.

  4. Clément Delangue (Hugging Face CEO)T3 · 22/09 · 04:13

    Xiaomi ra mắt mô hình MiMo-V2.6-Pro: Đứng đầu bảng xếp hạng Artificial Analysis

    Xiaomi vừa trình làng MiMo-V2.6-Pro, mô hình mã nguồn mở đạt 46 điểm trên bảng xếp hạng Artificial Analysis, chính thức soán ngôi vị dẫn đầu trong phân khúc mô hình mở.

  5. WeChat: Xiaomi MiMoT3 · 22/09 · 03:41

    Xiaomi ra mắt và mã nguồn mở dòng MiMo-V2.6: Bước tiến mới trong tự cải thiện mô hình AI

    Xiaomi chính thức công bố và mã nguồn mở dòng MiMo-V2.6, bao gồm hai phiên bản Pro và Flash, đánh dấu bước ngoặt quan trọng trong việc ứng dụng kỹ thuật tự cải thiện đệ quy (RSI) để mở rộng quy mô học tăng cường.

  6. Artificial Analysis bài đầy đủ (Web)T3 · 22/09 · 02:41

    Đánh giá Grok 4.7: Lọt Top 4 bảng xếp hạng trí tuệ, năng lực lập trình bứt phá mạnh mẽ

    Grok 4.7 đạt 46 điểm trên bảng xếp hạng Artificial Analysis, chính thức lọt vào Top 4 mô hình thông minh nhất. Đặc biệt, khả năng lập trình của Grok Build đã tăng vọt lên 56 điểm, khẳng định vị thế cạnh tranh trực tiếp với các đối thủ hàng đầu như Claude và GPT.

  7. Tomer Tunguz Blog (phân tích VC)T3 · 22/09 · 00:03

    Tomer Tunguz: AI chuyên biệt thay thế lệnh 'if-then', giảm chi phí vận hành tới 200 lần

    Tomer Tunguz chỉ ra rằng các bộ ra quyết định chuyên biệt như Jev và SemIf đang thay thế các lệnh logic 'if-then' truyền thống, giúp tăng độ chính xác lên gấp đôi và giảm chi phí vận hành từ 76 đến 209 lần so với các mô hình AI tạo sinh thông thường.

  8. JiQiZhiXinT2 · 21/09 · 23:45

    Đột phá AI: Giảm 50% chi phí huấn luyện với mô hình 'Dự đoán khái niệm' từ Shanghai AI Lab

    Nhóm nghiên cứu từ Shanghai AI Lab và ĐH Giao thông Thượng Hải giới thiệu mô hình NCP-ArchPreview, thay thế dự đoán từ ngữ (NTP) bằng dự đoán khái niệm (NCP), giúp tăng tốc độ hội tụ gấp 1,95 lần và cải thiện hiệu suất suy luận đáng kể.

  9. Fireworks AI (Web)T2 · 21/09 · 23:00

    Fireworks AI ra mắt Specialized Intelligence Index: Chuẩn đo lường năng lực AI chuyên sâu

    Fireworks AI giới thiệu Specialized Intelligence Index (SII), bộ chỉ số đánh giá hiệu suất các mô hình AI trên 7 lĩnh vực thực tế như y tế, luật, tài chính và lập trình, giúp người dùng so sánh chính xác giữa các mô hình nguồn mở và đóng.

  10. JiQiZhiXinT2 · 21/09 · 19:45

    Đột phá: Mô hình 7B từ UIUC và startup Thanh Hoa đánh bại GPT-5.6 nhờ tự chưng cất trên thị trường dự báo

    Các nhà nghiên cứu giới thiệu Social World Model, cho phép AI liên tục cập nhật kiến thức từ dữ liệu thị trường thời gian thực, giúp mô hình 7B vượt qua các siêu AI như GPT-5.6 và Claude Opus 5 trong việc dự đoán biến động xã hội.

  11. QbitAIT2 · 21/09 · 14:46

    Đưa GPT-6 Astra vào cơ thể robot: Đại học Thanh Hoa và InnoGrit ra mắt dự án mã nguồn mở RPent

    Dự án RPent đánh dấu bước tiến mới trong việc hiện thực hóa các tác nhân trí tuệ nhân tạo có khả năng thực hiện công việc thực tế trong thế giới vật lý thông qua cơ thể robot.

  12. QwenT2 · 21/09 · 10:07

    Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint

    Qwen-Image-2.1 là mô hình 7B mới từ Alibaba, hỗ trợ tạo và chỉnh sửa ảnh linh hoạt với tối đa 10 ảnh tham chiếu. Mô hình tích hợp sẵn LLM tăng cường gợi ý, hỗ trợ ComfyUI và có bản demo trực tuyến trên Hugging Face.

  13. Hugging Face Daily PapersT2 · 21/09 · 09:15

    Khi AI đánh giá AI: Nguy cơ 'sụp đổ tư duy khoa học' và giải pháp khắc phục

    Nghiên cứu chỉ ra rằng việc dùng AI để đánh giá bài báo khoa học tạo ra vòng lặp phản hồi, làm giảm tính đa dạng và gây ra hiện tượng 'sụp đổ tư duy'. Nhóm tác giả đề xuất TrustReviewer như một giải pháp để duy trì chất lượng đánh giá khách quan.

  14. OpenRouter: AnnouncementsT2 · 21/09 · 07:00

    Mô hình ra quyết định Jev của TypeSafe chính thức có mặt trên OpenRouter

    Mô hình Jev (phiên bản 1.13) từ TypeSafe hiện đã khả dụng thông qua OpenRouter Decisions API, cho phép các nhà phát triển tích hợp khả năng ra quyết định chuyên sâu vào ứng dụng.

  15. JiQiZhiXinT2 · 21/09 · 05:45

    EMNLP 2026: ToolLoop - Đột phá trong tổng hợp dữ liệu sử dụng công cụ cho LLM thông qua cơ chế tự phản hồi

    ToolLoop tối ưu hóa việc tạo dữ liệu huấn luyện cho LLM bằng cách chia nhỏ quy trình thành ba giai đoạn: lấy mẫu hàm, tạo câu hỏi ngược và tạo lệnh gọi công cụ, kết hợp cơ chế tự phản hồi để đảm bảo độ chính xác cao hơn so với phương pháp lọc truyền thống.

  16. JiQiZhiXinT2 · 21/09 · 05:45

    Qwen-Image-2.1: Đỉnh cao mới của mô hình tạo ảnh mã nguồn mở

    Alibaba vừa ra mắt Qwen-Image-2.1, mô hình tạo ảnh mã nguồn mở 7B mạnh mẽ nhất hiện nay. Với khả năng chỉnh sửa cục bộ, tạo ảnh trong suốt và độ chính xác cao, đây là công cụ đắc lực cho thiết kế chuyên nghiệp và thương mại điện tử.

  17. Fireworks AI (Web)CN · 20/09 · 23:00

    Fireworks AI ra mắt FireRouter: Tương lai của AI không nằm ở một mô hình duy nhất

    Fireworks AI giới thiệu FireRouter, giải pháp tối ưu hóa hiệu suất bằng cách điều hướng tác vụ thông minh qua 18 mô hình khác nhau, dựa trên phân tích từ 113 bài kiểm tra DeepSWE v1.1.

  18. JiQiZhiXinCN · 20/09 · 20:45

    CausalWM: Khi 'Chuỗi tư duy nhân quả' giúp mô hình thế giới đạt đỉnh cao mới

    Aether AI ra mắt CausalWM, mô hình thế giới 16B tham số sử dụng 'Chuỗi tư duy nhân quả' để hiểu cơ chế vận động vật lý thay vì chỉ dự đoán hình ảnh, xuất sắc dẫn đầu bảng xếp hạng TriWorldBench.

  19. PandailyCN · 20/09 · 10:15

    DeepSeek-V4.1-Flash ra mắt: Mô hình MoE 552B, cửa sổ ngữ cảnh 1 triệu token và nén KV siêu cấp

    DeepSeek-V4.1-Flash là mô hình MoE Encoder-Decoder 552 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token cùng công nghệ nén KV cực mạnh, hiện đã có mặt trên API dưới tên deepseek-flash.

  20. WeChat: StepFun (Step)CN · 20/09 · 09:20

    Step 5 Preview: Bước tiến mới từ StepFun với mô hình mã nguồn mở 600B tham số

    StepFun vừa ra mắt mô hình flagship Step 5 Preview sử dụng kiến trúc MoE, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và khả năng xử lý đa phương thức. Với hiệu suất vượt trội và chi phí vận hành chỉ bằng 1/8 so với Claude 3 Opus, đây là đối thủ đáng gờm trong nhóm mô hình mã nguồn mở.

Phát hành mô hình — Chủ Đề AI · Trang 3 | AIHOT.vn