01/09

Thứ Ba · 2 tin

29/08

Thứ Bảy · 1 tin
Perplexity@perplexity_ai
Sản phẩmĐiểm AI 47/100

Mô hình GLM 5.3 chính thức cập bến Perplexity

GLM 5.3 is now available in Perplexity Computer. Built for long-context, multimodal agent workloads…

DịchGLM 5.3 đã có mặt trên Perplexity, được tối ưu hóa cho các tác vụ đa phương thức và xử lý ngữ cảnh dài. Mô hình này đã vượt qua phiên bản tiền nhiệm trong bài kiểm tra WANDR về khả năng nghiên cứu chuyên sâu có dẫn chứng.

28/08

Thứ Sáu · 2 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 52/100

UrbanGround: Sandbox mô phỏng đô thị thực tế để kiểm thử trí tuệ nhân tạo không gian

UrbanGround là sandbox đầu tiên dựa trên dữ liệu 3D toàn cảnh Hong Kong, cho phép kiểm thử khả năng điều hướng và nhận thức của các mô hình MLLM trong môi trường đô thị thực tế. Kết quả cho thấy AI hiện nay vẫn gặp khó khăn trong việc duy trì định hướng và lập kế hoạch dài hạn.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 66/100

Aphanta: Khung chẩn đoán tự động giúp tối ưu hóa chỉnh sửa ảnh bằng mô hình đa phương thức

Aphanta là khung chẩn đoán tự động giúp đánh giá và cải thiện hiệu quả của các công cụ chỉnh sửa ảnh trong quy trình suy luận đa phương thức, giúp tăng đáng kể độ chính xác của các tác vụ phức tạp.

27/08

Thứ Năm · 3 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 48/100

Video-IFBench: Bộ tiêu chuẩn mới đánh giá khả năng tuân thủ chỉ dẫn của mô hình AI đa phương thức trong hiểu video

Video-IFBench là bộ tiêu chuẩn đánh giá chuyên sâu khả năng tuân thủ chỉ dẫn của các mô hình đa phương thức (MLLM) khi xử lý video, thông qua 1.500 mẫu thử nghiệm với độ phức tạp cao. Kết quả cho thấy các mô hình hiện nay vẫn gặp khó khăn lớn với các yêu cầu đa ràng buộc và cấu trúc phức tạp.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 49/100

MA-VLA: Mô hình ngôn ngữ-thị giác-hành động đột phá cho robot đa cánh tay

MA-VLA là khung làm việc mới giúp điều phối nhiều cánh tay robot thông qua việc phân tách nhiệm vụ thành các hành động nguyên tử, cho phép robot thực hiện các tác vụ phối hợp phức tạp ngay cả với những kịch bản chưa từng gặp.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 28/100

Qwen Live EP2: Cách đưa các tác nhân AI đa phương thức vào thực tế

The best of Qwen Live EP2, in under two minutes. What does it take for multimodal AI to get to work? …

DịchTóm tắt những điểm chính từ Qwen Live EP2 về các điều kiện cần thiết để AI đa phương thức có thể thực hiện công việc thực tế, cùng tầm nhìn về tương lai của các tác nhân AI có khả năng nhìn, nghe và hành động.

26/08

Thứ Tư · 3 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Flash: Mô hình MoE đa phương thức hiệu năng cao với chi phí tối ưu

⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weigh…

DịchAlibaba giới thiệu Qwen3.8-Flash, mô hình MoE 125B với kiến trúc Qwen4 tiên tiến, chỉ kích hoạt 6B tham số mỗi token. Với chi phí huấn luyện bằng 1/9 bản tiền nhiệm và giá API cực rẻ, đây là bước tiến lớn về hiệu suất và khả năng xử lý ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
TechNode
Mô hìnhĐiểm AI 88/100

Cùng sự kiệnAlibaba sắp mở mã nguồn Qwen3.8-Flash-Next, hé lộ kiến trúc Qwen4 thế hệ mới

Alibaba chuẩn bị ra mắt Qwen3.8-Flash-Next, một mô hình đa phương thức dạng Mixture-of-Experts dựa trên kiến trúc Qwen4, nhằm giúp cộng đồng lập trình viên làm quen trước khi phiên bản chính thức trình làng.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 44/100

Từ góc nhìn đến hành động: Kính thông minh định hình nền tảng AI thế hệ mới

Bài nghiên cứu đề xuất khung phân loại L0-L5 cho kính thông minh, định vị thiết bị này như một nền tảng AI thế hệ thứ nhất kết nối nhận thức con người với các hành động kỹ thuật số và vật lý.

25/08

Thứ Ba · 1 tin

24/08

Thứ Hai · 1 tin

23/08

Chủ Nhật · 1 tin

22/08

Thứ Bảy · 2 tin
JiQiZhiXin
Sản phẩmĐiểm AI 92/100

Cùng sự kiệnDeepSeek chính thức ra mắt mô hình đa phương thức DeepSeek-V4-Flash-Vision-Exp

DeepSeek vừa bổ sung khả năng xử lý hình ảnh vào nền tảng API với phiên bản thử nghiệm DeepSeek-V4-Flash-Vision-Exp, đánh dấu bước tiến mới trong hệ sinh thái mô hình của hãng.

Cùng sự kiện, bài đại diện «DeepSeek ra mắt mô hình đa phương thức thử nghiệm V4-Flash-Vision-Exp»
The Decoder: AI News
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnDeepSeek ra mắt mô hình thị giác V4-Flash-Vision-Exp, thách thức hiệu năng của Opus 4.8

DeepSeek vừa giới thiệu mô hình đa phương thức V4-Flash-Vision-Exp với khả năng suy luận văn bản mạnh mẽ và hiệu suất tiệm cận Opus 4.8 trong các bài kiểm tra tác tử AI. Mô hình hỗ trợ API linh hoạt, cho phép xử lý tới 600 ảnh mỗi yêu cầu với chi phí tối ưu.

Cùng sự kiện, bài đại diện «DeepSeek ra mắt mô hình đa phương thức thử nghiệm V4-Flash-Vision-Exp»

21/08

Thứ Sáu · 4 tin
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 23/100

Lộ diện Ox Alpha: Cuộc đua mới về AI đa phương thức thế hệ tiếp theo

Got confirmation on what the Ox Alpha model is. Can't disclose anything yet, but I can confirm it'…

DịchMô hình Ox Alpha vừa được xác nhận là một bước tiến đột phá, hứa hẹn thay đổi hoàn toàn cục diện về khả năng của các tác nhân AI đa phương thức trong tương lai gần.

IT Home
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnDeepSeek ra mắt mô hình đa phương thức V4-Flash-Vision-Exp trên nền tảng API

DeepSeek vừa trình làng mô hình thị giác máy tính V4-Flash-Vision-Exp với khả năng hiểu hình ảnh vượt trội, tiệm cận hiệu suất của Opus-4.8. Dịch vụ đã sẵn sàng trên API với cơ chế tính phí theo token linh hoạt, hỗ trợ đa dạng phương thức truyền tải hình ảnh.

Cùng sự kiện, bài đại diện «DeepSeek ra mắt mô hình đa phương thức thử nghiệm V4-Flash-Vision-Exp»
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 54/100

OpenRouter ra mắt Ox Alpha: Mô hình ẩn danh tối ưu cho lập trình và tác vụ tự động

🥷 New stealth model: Ox Alpha Ox Alpha is a frontier model built for efficient coding, sustained a…

DịchOpenRouter vừa giới thiệu Ox Alpha, mô hình AI mới hỗ trợ cửa sổ ngữ cảnh 1 triệu token, xử lý đa phương thức (văn bản, hình ảnh, video) và được tối ưu hóa cho lập trình cũng như vận hành tác vụ tự động.

AI at Meta@AIatMeta
Sản phẩmĐiểm AI 53/100

Meta ra mắt WildArtifactBench: Bộ khung đánh giá mới cho tác nhân đa phương thức

Today we're also previewing WildArtifactBench, an internal evaluation framework designed to assess a…

DịchMeta giới thiệu WildArtifactBench, bộ khung đánh giá sử dụng hệ thống Elo và đánh giá từ con người để đo lường hiệu suất của các tác nhân đa phương thức trong môi trường thực tế thay vì các đáp án cứng nhắc.

18/08

Thứ Ba · 2 tin
ModelBest OpenBMB@OpenBMB
Hướng dẫnĐiểm AI 28/100

MiniCPM-o 4.5: Bước tiến mới của mô hình AI đa phương thức với khả năng tương tác thời gian thực

Great walkthrough of MiniCPM-o 4.5 by @LearnOpenCV! Unlike traditional turn-based multimodal system…

DịchMiniCPM-o 4.5 là mô hình mã nguồn mở 9B đột phá, hỗ trợ tương tác toàn song công (full-duplex) cho phép xử lý đồng thời video, âm thanh và phản hồi giọng nói theo thời gian thực, mang lại trải nghiệm AI tự nhiên hơn.

15/08

Thứ Bảy · 1 tin

14/08

Thứ Sáu · 1 tin
Kim@kimmonismus
Mô hìnhĐiểm AI 51/100

Cùng sự kiệnRedNote ra mắt dots3-note: Mô hình AI đa phương thức 280B với hiệu suất vượt trội

Nice: RedNote just open-sourced dots3-note Preview, a 280b multimodal MoE built for agents that oper…

DịchRedNote vừa công bố bản xem trước của dots3-note, mô hình MoE 280B chỉ kích hoạt 16B tham số, hỗ trợ cửa sổ ngữ cảnh 512K cùng khả năng xử lý đa phương thức từ văn bản, hình ảnh đến video và âm thanh.

Cùng sự kiện, tinh chọn hiển thị «Tiểu Hồng Thư ra mắt dots3-note Preview: Mô hình 280B tối ưu cho tác vụ Agent và đa phương thức»

13/08

Thứ Năm · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 46/100

MBA-Bench: Bộ tiêu chuẩn đa phương thức đầu tiên đánh giá năng lực tư duy kinh doanh của AI

MBA-Bench là bộ tiêu chuẩn đột phá với 30.000 mẫu dữ liệu đa phương thức, giúp huấn luyện và đánh giá các tác nhân AI trong việc phân tích và sáng tạo ý tưởng kinh doanh dựa trên các tín hiệu hình ảnh thực tế.

Tổng 25 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (48 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI đa phương thức” — Trang 2 | AIHOT.vn