Phát hành mô hình
Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.
3.594 bài thu thập350 tinh chọncập nhật đến 28/09 02:09
- QbitAIT3 · 15/09 · 18:30
Đột phá mô phỏng phân tử: AI biến phản ứng hóa học thành phim với 100.000 nguyên tử trên một GPU
Startup Molecular Heart (Phân Tử Chi Tâm) vừa giải quyết bài toán hóc búa trong mô phỏng phân tử, cho phép quan sát phản ứng hóa học ở quy mô lớn với tốc độ và độ chính xác vượt trội.
- QbitAIT3 · 15/09 · 15:15
Nghiên cứu mới từ Meta: Chưng cất mô hình Byte giúp phá vỡ giới hạn hiệu năng
Meta vừa công bố phương pháp chưng cất mô hình mới giúp các mô hình Byte vượt qua giới hạn hiệu suất truyền thống, mở ra hướng đi đột phá cho việc tối ưu hóa AI.
- WeChat: StepFun (Step)T3 · 15/09 · 14:40
StepAI ra mắt dòng mô hình âm thanh StepAudio 3: Thống trị bảng xếp hạng toàn cầu của Artificial Analysis
StepAI vừa trình làng bộ 5 mô hình StepAudio 3 bao gồm Realtime, ASR, TTS, Gen và Music, hiện đã sẵn sàng trải nghiệm trên nền tảng mở của hãng.
- Hugging Face Daily PapersT3 · 15/09 · 11:45
Realtime-Venus: Hệ thống tương tác song công thời gian thực với cơ chế ủy quyền bất đồng bộ
Realtime-Venus là hệ thống tương tác đa phương thức sử dụng mô hình 9B, cho phép duy trì hội thoại liên tục trong khi thực hiện các tác vụ phức tạp ở chế độ nền nhờ cơ chế ủy quyền bất đồng bộ.
- Hugging Face Daily PapersT3 · 15/09 · 10:30
ZGCM-1: Mô hình nền tảng 7B mã nguồn mở tối ưu cho toán học và tìm kiếm tác tử
ZGCM-1 là mô hình 7B đột phá, kết hợp tư duy nội tại với công cụ bên ngoài để vượt qua giới hạn dung lượng tham số. Với kiến trúc FP8 và quy trình huấn luyện hiệu quả, mô hình hỗ trợ ngữ cảnh 256K, cho phép tác tử tự vận hành và tối ưu hóa dữ liệu.
- QbitAIT3 · 15/09 · 10:15
7 nghiên cứu sinh đào tạo mô hình 7B từ con số 0 chỉ trong 3 tháng: Công khai toàn bộ mã nguồn và dữ liệu
Một nhóm nghiên cứu sinh đã huy động hàng trăm AI Agent để tự động hóa quy trình phát triển, đánh dấu bước tiến mới trong việc dùng AI để tạo ra AI.
- MarkTechPostT3 · 15/09 · 07:36
DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh
DeepSeek-V4.1-Flash là mô hình MoE đa phương thức mới với 748B tham số, nổi bật nhờ khả năng xử lý 1 triệu token và giảm dung lượng KV Cache xuống chỉ còn 890 byte mỗi token, tối ưu hiệu suất vượt trội so với các thế hệ trước.
- JiQiZhiXinT3 · 15/09 · 03:15
Giải mã GPT-6 Astra: Sebastian Raschka phân tích sâu về kiến trúc Transformer vòng lặp và tư duy ẩn
Chuyên gia Sebastian Raschka làm rõ tranh cãi về kiến trúc 'Transformer vòng lặp' trên GPT-6 Astra, khẳng định công nghệ này không làm giảm khả năng giám sát tư duy của AI như đồn đoán.
- ArenaT3 · 15/09 · 00:51
DeepSeek-V4.1-Flash (Max) vươn lên vị trí thứ 3 trên bảng xếp hạng Agent Arena
DeepSeek-V4.1-Flash (Max) đạt vị trí thứ 3 trong nhóm mô hình mã nguồn mở trên Agent Arena với hiệu suất tăng 4,87% và chi phí tối ưu chỉ 0,07 USD mỗi tác vụ, vượt xa các đối thủ về hiệu quả kinh tế.
- SiliconFlowT2 · 14/09 · 23:36
SiliconFlow ra mắt mô hình mã nguồn mở Hy4: 770 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token
SiliconFlow vừa phát hành mô hình Hy4 (bản preview) với 770 tỷ tham số, hỗ trợ 1 triệu token ngữ cảnh và giấy phép Apache 2.0, tối ưu cho lập trình và phân tích dữ liệu phức tạp.
- QbitAIT2 · 14/09 · 18:00
Khám phá RSI: Mô hình thế giới mới từ Shengshu giúp robot tự tiến hóa
Shengshu giới thiệu mô hình thế giới RSI, cho phép robot tự học hỏi và tiến hóa thông qua tương tác thực tế, mở ra bước tiến mới trong khả năng tự chủ của robot.
- WeChat: Xiaohongshu Tech (dots.llm)T2 · 14/09 · 17:00
Tiểu Hồng Thư mã nguồn mở Iris: Mô hình Search Agent vượt trội ở phân khúc 35B và 397B
Đội ngũ AllSpark của Tiểu Hồng Thư vừa công bố mã nguồn mở cho Iris, mô hình Search Agent chuyên dụng. Hiện tại, trọng số và mã đánh giá đã được phát hành, các dữ liệu huấn luyện sẽ sớm được cập nhật.
- TechNodeT2 · 14/09 · 13:00
Z.ai huy động thành công 5 tỷ USD để phát triển mô hình GLM thế hệ mới
Z.ai vừa hoàn tất vòng gọi vốn 5 tỷ USD thông qua phát hành cổ phiếu và trái phiếu chuyển đổi. Khoản đầu tư này sẽ được dùng để phát triển mô hình nền tảng GLM, hệ thống tự huấn luyện và nâng cấp hạ tầng tính toán quy mô lớn.
- QbitAIT2 · 14/09 · 11:30
Đột phá AI vật lý từ Trung Quốc: PhysBrain 1.5 dẫn đầu bảng xếp hạng mã nguồn mở toàn cầu
PhysBrain 1.5 vừa thiết lập cột mốc mới trong lĩnh vực trí tuệ không gian, khẳng định vị thế ngang hàng với các mô hình tiên tiến như GPT-6 Astra bằng cách giải quyết thành công bài toán vòng lặp vật lý phức tạp.
- Hugging Face Daily PapersT2 · 14/09 · 09:15
PLC-DPO: Tối ưu hóa ưu tiên bằng cách hiệu chỉnh nhãn hậu nghiệm cho dữ liệu nhiễu
PLC-DPO cải thiện phương pháp DPO truyền thống bằng cách tự động nhận diện và hiệu chỉnh các nhãn dữ liệu bị nhiễu, mập mờ hoặc sai lệch, giúp mô hình AI học từ phản hồi của con người chính xác và ổn định hơn.
- OpenRouter: AnnouncementsT2 · 14/09 · 07:00
Hướng dẫn OpenRouter: Tự động đánh giá đầu ra của AI Agent bằng phương pháp LLM-as-a-judge
OpenRouter chia sẻ cách sử dụng mô hình AI làm giám khảo để chấm điểm tự động cho các phản hồi của AI Agent, giúp kiểm soát chất lượng các câu trả lời mở mà phương pháp kiểm thử truyền thống không làm được.
- JiQiZhiXinCN · 13/09 · 17:00
Khi nào AI sẽ ngừng 'suy nghĩ quá mức'?
Bài viết phân tích vấn đề LLM tiêu tốn tài nguyên do suy nghĩ quá mức, đồng thời đề xuất các giải pháp tối ưu hóa chi phí và hiệu suất suy luận thông qua cơ chế tự điều chỉnh.
- JiQiZhiXinCN · 13/09 · 17:00
Chi phí suy luận giảm 96%, hiệu năng vượt trội: Khi mô hình nhỏ biết tự 'cầu cứu' AI lớn
Pyromind giới thiệu PyroDash, giải pháp cho phép các mô hình nhỏ tự quyết định thời điểm cần gọi mô hình lớn hỗ trợ. Cách tiếp cận này giúp cắt giảm chi phí vận hành tới 96% mà vẫn duy trì, thậm chí cải thiện độ chính xác so với việc chỉ dùng mô hình lớn.
- QbitAICN · 13/09 · 15:30
Đột phá mô hình điều hướng: Một thuật toán 'cân' mọi loại robot trong hơn 2.000 môi trường giả lập
Startup Liangyuan giới thiệu hướng đi mới cho AI vật lý, cho phép mô hình điều hướng zero-shot vận hành linh hoạt trên bốn loại hình robot khác nhau mà không cần huấn luyện lại.
- MarkTechPostCN · 13/09 · 13:09
Kỹ thuật tối ưu ngữ cảnh cho AI Agent: Giải pháp chống tràn bộ nhớ và mất mục tiêu
Bài viết phân tích 4 cơ chế then chốt giúp AI Agent xử lý các tác vụ dài hạn hiệu quả, bao gồm quản lý ngân sách ngữ cảnh, nén dữ liệu, duy trì trạng thái công việc và bộ nhớ xuyên phiên.