Hugging Face Daily Papers
85

Nghiên cứu

TimeLens2: Bước tiến mới trong định vị thời gian video bằng mô hình ngôn ngữ đa phương thức

(giờ Việt Nam)

Tóm tắt AI

TimeLens2 giải quyết thách thức xác định chính xác thời điểm diễn ra sự kiện trong video bằng cách xử lý các khoảng thời gian dưới dạng tập hợp, giúp mô hình đa phương thức hiểu sâu hơn về ngữ cảnh và thời lượng video.

Bản dịch AI

Tác giả: Yuhan Zhu, Changlian Ma, Xiangyu Zeng, Xinhao Li, Zhiqiu Zhang, Songze Li, Jun Zhang, Tianxiang Jiang, Yuandong Yang, Ziang Yan, Zikang Wang, Xinyu Chen, Haoran Chen, Shaowei Zhang, Limin Wang

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Yuhan Zhu [xem email] [v1] Chủ nhật, 19 tháng 7 năm 2026 22:04:33 UTC (15.315 KB)

AIVideoAIMultimodalComputerVisionNghiên cứu
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.