Phát hành mô hình
CHỦ ĐỀ · TRANG 5

Phát hành mô hình

Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.

3.593 bài thu thập350 tinh chọncập nhật đến 28/09 04:45

  1. QbitAIT5 · 17/09 · 17:00

    Đột phá từ Zhipu AI: Đường lối phát triển mô hình tự tiến hóa RSI chính thức lộ diện

    Giáo sư Đường Kiệt vừa công bố thành quả đầu tiên của dự án RSI, đánh dấu cột mốc quan trọng khi các mô hình GLM bắt đầu có khả năng tự tham gia vào quá trình xây dựng và tối ưu hóa chính mình.

  2. PandailyT5 · 17/09 · 15:15

    Light Origins ra mắt mã nguồn mở LightNav-0: Bộ não điều hướng đa năng cho robot

    LightNav-0 là mô hình điều hướng dựa trên Qwen3-VL-4B, được huấn luyện qua quy trình Real2Sim2Real với hơn 4.000 giờ dữ liệu VLA, đạt hiệu suất dẫn đầu trên 10 bảng xếp hạng điều hướng đơn thị giác.

  3. Hugging Face Daily PapersT5 · 17/09 · 13:30

    XConf: Nâng cao độ tin cậy của mô hình ngôn ngữ thông qua kinh nghiệm thực tế

    XConf là phương pháp ước tính độ tin cậy mới, không chỉ dựa vào suy luận hiện tại mà còn truy xuất các bài học từ những trải nghiệm giải quyết vấn đề trong quá khứ để đánh giá chính xác hơn khả năng thành công của mô hình.

  4. QbitAIT4 · 16/09 · 21:15

    ZDTaichu 5.0-9B: Mô hình AI đa phương thức nội địa Trung Quốc dẫn đầu thế giới về trí tuệ không gian

    ZDTaichu 5.0-9B vừa ra mắt đã gây ấn tượng mạnh khi giành vị trí dẫn đầu trong 8/9 bài kiểm tra năng lực không gian, chính thức gia nhập nhóm các mô hình đa phương thức hàng đầu thế giới.

  5. Mustafa Suleyman (Microsoft AI CEO)T4 · 16/09 · 21:13

    CEO Microsoft AI cảnh báo về tư tưởng 'quyền lợi cho mô hình AI'

    Mustafa Suleyman phản đối việc coi AI là thực thể có cảm xúc hay nỗi đau, khẳng định việc trao 'quyền' cho AI sẽ khiến công tác kiểm soát và căn chỉnh mô hình trở nên bất khả thi.

  6. Hugging Face Daily PapersT4 · 16/09 · 17:30

    Giải mã kiến trúc AI: Khi hỏi mô hình như một đứa trẻ lại hé lộ bí mật kỹ thuật

    Nghiên cứu cho thấy việc đặt câu hỏi dưới góc độ 'giải thích cho học sinh' giúp các mô hình AI hàng đầu bộc lộ cấu trúc kiến trúc cốt lõi một cách nhất quán và ổn định hơn so với các cách hỏi thông thường.

  7. PandailyT4 · 16/09 · 15:15

    Shanghai AI Lab ra mắt Atria Dawn Preview: Mô hình tác tử MoE 744 tỷ tham số

    Shanghai AI Lab vừa công bố Atria Dawn Preview, mô hình tác tử MoE 744 tỷ tham số dựa trên GLM-5.2 với cửa sổ ngữ cảnh 256K, đạt điểm số ấn tượng 53.8 trên AutomationBench cho các tác vụ nghiên cứu và kỹ thuật phức tạp.

  8. JiQiZhiXinT4 · 16/09 · 15:15

    GPT-6 Sol sắp lộ diện? OpenAI chuẩn bị cho tuần lễ ra mắt bùng nổ

    OpenAI đang gây xôn xao khi các lãnh đạo cấp cao xác nhận sẽ có loạt bản cập nhật lớn trong tuần này. Nhiều người dùng báo cáo đã được trải nghiệm sớm GPT-6 Sol với tốc độ vượt trội, làm dấy lên đồn đoán về một bước tiến mới trong khả năng suy luận và hiệu suất của mô hình.

  9. JiQiZhiXinT4 · 16/09 · 15:15

    Đừng để AI Agent 'tự biên tự diễn': Bí quyết cân bằng giữa tư duy nội tại và công cụ ngoại vi

    Tổng hợp từ 600 nghiên cứu, bài viết đề xuất khung lý thuyết 'Theory of Agent' giúp tối ưu hóa việc phân bổ năng lực cho AI Agent, tránh tình trạng lạm dụng công cụ hoặc suy diễn sai lệch.

  10. JiQiZhiXinT4 · 16/09 · 15:15

    DM0.5 thống trị RoboColiseum: 'Vua' mới của các bảng xếp hạng robot thông minh

    Mô hình DM0.5 tiếp tục khẳng định vị thế dẫn đầu khi quét sạch 4 bảng xếp hạng tại RoboColiseum, nâng tổng số chiến thắng lên 6 trên 6 cuộc thi đánh giá robot khác nhau, chứng minh khả năng thích nghi vượt trội trong mọi môi trường.

  11. JiQiZhiXinT4 · 16/09 · 15:15

    Nghiên cứu từ Thanh Hoa: Chỉ cần một bài toán để huấn luyện mô hình ngôn ngữ lớn?

    Nhóm nghiên cứu từ ĐH Thanh Hoa phát hiện On-Policy Distillation (OPD) có thể đạt 70% hiệu suất dù chỉ huấn luyện trên một mẫu dữ liệu duy nhất, cho thấy thuật toán hiện tại vẫn chưa khai thác hết tiềm năng của dữ liệu.

  12. Hugging Face Daily PapersT4 · 16/09 · 14:00

    StepAudio 3: Bước tiến đột phá trong mô hình AI hội thoại thời gian thực

    StepAudio 3 giới thiệu cơ chế 'Think-While-Speaking' cho phép AI suy luận chuyên sâu song song với việc phản hồi bằng giọng nói, tạo ra trải nghiệm hội thoại tự nhiên, mượt mà và có độ trễ cực thấp.

  13. QbitAIT4 · 16/09 · 11:00

    Vidu S2 tung ba tính năng đột phá: Tương tác thời gian thực, chỉnh sửa video trực tiếp và hỗ trợ video không gian

    Vidu S2 vừa cập nhật ba tính năng mạnh mẽ, cho phép người dùng tương tác trực tiếp, chỉnh sửa video theo thời gian thực và khám phá định dạng video không gian đầy ấn tượng.

  14. PandailyT4 · 16/09 · 09:00

    Xiaomi mã nguồn mở mô hình thế giới Robotics-U0 cho robot thông minh

    Xiaomi vừa công bố mã nguồn mở Robotics-U0, mô hình nền tảng thế giới tự hồi quy với quy mô lên tới 38 tỷ tham số, giúp tăng tốc độ xử lý gấp 83 lần và dẫn đầu bảng xếp hạng WorldArena về khả năng mô phỏng cảnh quan robot.

  15. Hugging Face Daily PapersT4 · 16/09 · 09:00

    Gavel: Tối ưu hóa điều hướng kỹ năng cho LLM mà không cần nhồi nhét ngữ cảnh

    Gavel là phương pháp mới giúp LLM tự chọn kỹ năng phù hợp thông qua các ánh xạ tuyến tính thay vì nhồi nhét metadata vào ngữ cảnh, giúp mở rộng thư viện kỹ năng mà không làm giảm hiệu suất của mô hình.

  16. Hugging Face Daily PapersT4 · 16/09 · 05:15

    Vidu S2: Bước tiến mới trong tạo video tương tác, chỉnh sửa thời gian thực và không gian 3D

    Vidu S2 giới thiệu khả năng tạo avatar kỹ thuật số và chỉnh sửa video thời gian thực với độ phân giải 720p, hỗ trợ thay đổi trang phục, bối cảnh và tạo video không gian linh hoạt.

  17. ArenaT4 · 16/09 · 04:21

    Bảng xếp hạng Image-to-WebDev cập nhật: GPT-6 Astra dẫn đầu với 1733 điểm

    Arena vừa cập nhật bảng xếp hạng Image-to-WebDev với sự góp mặt của 4 mô hình mới. GPT-6 Astra (Max) xuất sắc giành vị trí quán quân với 1733 điểm, vượt xa các đối thủ như Claude Fable 5.1 và Muse Spark 1.3.

  18. Hugging Face Daily PapersT4 · 16/09 · 02:15

    Never Give Up: Tối ưu hóa học tăng cường cho LLM bằng cách tập trung vào các bài toán khó

    Nghiên cứu chỉ ra rằng RL hiện nay thường lãng phí tài nguyên vào các bài toán dễ. Phương pháp Never Give Up (NGU) đề xuất cơ chế lấy mẫu thích ứng, giúp phân bổ lại tài nguyên tính toán để giải quyết hiệu quả các bài toán khó mà mô hình chưa làm tốt.

  19. Google DeepMind: BlogT4 · 16/09 · 00:17

    Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói

    Google DeepMind vừa giới thiệu Gemini 3.8 Live và bản Extended Thinking, tập trung vào khả năng đối thoại giọng nói thời gian thực và xử lý các tác vụ phức tạp.

  20. WeChat: ShengShu (Vidu - Video)T3 · 15/09 · 22:11

    Vidu S2 ra mắt: Bước tiến mới trong tạo hình Avatar và chỉnh sửa video thời gian thực

    Shengshu Technology giới thiệu Vidu S2 với hai mô hình chuyên biệt: Vidu S2-Avatar cho tương tác kỹ thuật số và Vidu S2-Editing cho chỉnh sửa video, đồng thời mở rộng sang lĩnh vực video không gian cho kính VR.

Phát hành mô hình — Chủ Đề AI · Trang 5 | AIHOT.vn