25/09

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

OmniEcho: Bước tiến mới trong khả năng hiểu âm thanh không gian cho robot tự hành

OmniEchoBench là bộ tiêu chuẩn mới giúp đánh giá khả năng nhận diện âm thanh không gian và điều hướng đa phương thức cho các tác nhân AI trong môi trường thực tế, kết hợp cùng mô hình OmniEcho giúp robot hiểu sâu hơn về sự tương quan giữa âm thanh và hình ảnh.

24/09

Thứ Năm · 1 tin

17/09

Thứ Năm · 1 tin
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 43/100

Collov Labs ra mắt NewEyes: Trợ lý AI thị giác thông minh cho kính Meta

There is an awkward compute problem hiding inside AI glasses: the agent should always be available, …

DịchNewEyes là trợ lý AI thị giác trên kính Meta, sử dụng kiến trúc lai giữa thiết bị và đám mây để tối ưu hóa hiệu suất. Người dùng có thể tương tác rảnh tay thông qua cơ chế "nhìn, hỏi, làm" trong các hoạt động hàng ngày như nấu ăn hay phối đồ.

12/09

Thứ Bảy · 1 tin

10/09

Thứ Năm · 1 tin
Pandaily
Mô hìnhĐiểm AI 85/100

Ant Group ra mắt mô hình đa phương thức Ling-3.0-flash-VL với khả năng phản hồi thị giác

Ant Group và inclusionAI vừa mã nguồn mở Ling-3.0-flash-VL, mô hình MoE 124B với khả năng xử lý thị giác chuyên sâu, tối ưu cho các tác vụ điều khiển giao diện, lập trình front-end và y tế.

Thêm 1 nguồn khác đưa tinX: Ant Ling (@AntLingAGI)

08/09

Thứ Ba · 1 tin

07/09

Thứ Hai · 1 tin

06/09

Chủ Nhật · 1 tin

01/09

Thứ Ba · 1 tin
Alibaba Cloud@alibaba_cloud
Sản phẩmĐiểm AI 25/100

Alibaba Cloud trình diễn hệ sinh thái AI thị giác Qwen-Image 3.0 và Wan 3.0 tại Thái Lan

From a single prompt to a finished film. No studio. No crew. Just AI. We're walking through the full…

DịchAlibaba Cloud ra mắt bộ công cụ AI thị giác toàn diện: Qwen-Image 3.0 hỗ trợ tạo ảnh đa ngôn ngữ, Wan 3.0 tạo video 30 giây sống động và WonderClip tự động hóa quy trình từ kịch bản đến hậu kỳ.

26/08

Thứ Tư · 1 tin

25/08

Thứ Ba · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

WorldToken: Mô hình hóa trình tự ưu tiên thời gian cho học bắt chước ở robot

WorldToken tối ưu hóa việc học của robot bằng cách hợp nhất dữ liệu đa phương thức thành một 'world token' duy nhất, giúp mô hình Transformer xử lý trình tự hiệu quả hơn. Phương pháp này đạt tỷ lệ thành công ấn tượng 59,45% trên 23 tác vụ RoboCasa phức tạp.

24/08

Thứ Hai · 1 tin
cb_doge@cb_doge
Hướng dẫnĐiểm AI 37/100

Grok Build: Điều khiển hiệu ứng hình ảnh thời gian thực bằng cử chỉ tay

Grok Build is incredible 🔥 I just built this interactive visual that I can control with my hands. …

DịchGrok Build cho phép người dùng tương tác trực tiếp với các hiệu ứng hình ảnh thông qua camera máy tính, biến cử chỉ bàn tay thành công cụ điều khiển sáng tạo đầy ấn tượng.

23/08

Chủ Nhật · 1 tin

19/08

Thứ Tư · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 26/100

EditBridge: Giải pháp chỉnh sửa ảnh siêu phân giải 4K tốc độ cao bằng mô hình khuếch tán

EditBridge tối ưu hóa việc chỉnh sửa ảnh độ phân giải cao bằng cách chuyển đổi từ bản thấp phân giải, giúp giữ trọn chi tiết gốc. Công nghệ này tăng tốc xử lý lên đến 8,4 lần, cho phép chỉnh sửa ảnh 4K chỉ trong 61 giây.

18/08

Thứ Ba · 2 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 52/100

StreamOPD: Giải pháp hậu huấn luyện tối ưu hóa hiểu video trực tuyến với cơ chế cổng tín hiệu không gian-thời gian

StreamOPD giới thiệu phương pháp hậu huấn luyện không cần bộ nhớ suy luận, giúp cải thiện đáng kể hiệu suất hiểu video trên các bộ dữ liệu chuẩn, tiệm cận kết quả của các mô hình lớn hơn.

Tổng 16 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (36 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI thị giác” | AIHOT.vn