Nghiên cứu
VideoCoCo: Bước đột phá từ CUHK và USTC giúp video AI tuân thủ quy luật vật lý
(giờ Việt Nam)
Tóm tắt AI
VideoCoCo thay đổi cách tạo video bằng cách sử dụng mã nguồn làm 'chuỗi suy nghĩ' để mô phỏng các quy luật vật lý, giúp video chân thực và logic hơn thay vì chỉ dựa vào dự đoán pixel đơn thuần.
Bản dịch AI
LLM, tạo video, AI agent, và các đơn vị phát triển (Embodied AI) đều đã sẵn sàng! Hội nghị AI tạo sinh Trung Quốc sẽ diễn ra tại Bắc Kinh từ ngày 18-19 tháng 4.
"Tiểu não" và robot đa năng với thực thể vật lý. Sự kết hợp này sẽ thay đổi sâu sắc... các dòng mô hình tạo sinh như PLUG, mPLUG, GPT tiếng Trung, v.v. Tham gia nhiều đánh giá quốc tế và...
AINLPer
Bài báo đa phương thức | CUA-Suite: Bộ dữ liệu trình diễn video được gắn nhãn thủ công quy mô lớn dành cho tác nhân sử dụng máy tính (1/20 bài) · 27 tháng 3
Và trên tiêu chuẩn hỏi đáp video độ phân giải cao dài hạn mới được đề xuất là HLVid, sử dụng AutoGaze... khả năng tương tác trả về vị trí vật thể 3D khi có đầu vào ngôn ngữ tự nhiên và trạng thái robot. Chúng tôi...
Hạt bụi chói lọi trong không gian vũ trụ bao la vô tận
Tác phẩm mới từ Đại học Công nghệ Nam Trung Hoa & StepFun: Để AI vẽ tranh trước tiên hãy viết mã! CoCo "vượt xa" trong việc tạo sinh có cấu trúc.
Tư duy "Code as Chain of Thought" (Mã là chuỗi suy nghĩ) mà CoCo đề xuất vô cùng khéo léo, nó biến những tưởng tượng mơ hồ thành... Mô hình này có thể truyền cảm hứng cho các nghiên cứu tiếp theo trong nhiều lĩnh vực cần thiết như tạo 3D, tạo video, tạo GUI...
AI Zhi Xiao Long
31/3 - 4/4 | Hiểu và tạo sinh thị giác đa phương thức: Từ biểu đồ đến tạo mã; VLM hướng dẫn tri thức, tạo tài sản 3D; tạo DiTMask, phân đoạn hình ảnh.
Các cấu trúc được tạo ra thường mang tính ngẫu nhiên, hoặc vi phạm logic vật lý (ví dụ: mặt sau của chiếc cốc không có tay cầm), hoặc hoàn toàn tách rời khỏi ý định sáng tạo của người dùng. Sự ra đời của Know3D nhằm mục đích...
Tiền cảnh nghiên cứu AI
Đại học Carnegie Mellon đề xuất CSC-Tracker | Một mô hình biểu diễn phân cấp thị giác mới dùng cho theo dõi đa mục tiêu.
Tác giả đã áp dụng cấu trúc phân cấp thị giác được đề xuất trong theo dõi đa mục tiêu video để tránh... Tuy nhiên, mô hình này không thể tạo ra các biểu diễn phân biệt ở cấp độ thực thể, mặc dù nó nhận diện ở cấp độ ngữ nghĩa...
Tin nhanh học thuật hàng ngày trên arXiv
Bài báo đa phương thức | SkyRééls-V4: Mô hình tạo, sửa chữa và chỉnh sửa video-âm thanh đa phương thức (1/20 bài) · 3 tháng 3
Multi-modal Video-Audio Generation, Inpainting and Editing model: Nhắm vào các tác vụ tạo, sửa chữa và chỉnh sửa video-âm thanh kết hợp, bài viết này đề xuất SkyRéé...
Hạt bụi chói lọi trong không gian vũ trụ bao la vô tận
Nửa sau của khởi nghiệp cho người cao tuổi: Từ "thích ứng lão hóa" đến "thích ứng tâm lý", định nghĩa mô hình mới cho thị trường nghìn tỷ.
Chúng tôi định nghĩa bước nhảy vọt của mô hình này là từ "thích ứng lão hóa" sang "thích ứng tâm lý".... Trong đó, chúng tôi không chỉ lần đầu tiên đề xuất khung lý thuyết "thích ứng tâm lý" một cách hoàn chỉnh, mà quan trọng hơn là...
Bản dạ khúc bất động sản
Đại học Nhân dân Trung Quốc + Xiaohongshu công bố trọng điểm! OmniGAIA phá vỡ trần đa phương thức, định nghĩa lại tác nhân toàn phương thức (Omni-modal agent).
Ngoài ra, bài viết còn đề xuất OmniAtlas, một bộ công cụ tuân theo mô hình suy luận tích hợp, có khả năng... tạo mô tả cảnh, sự kiện, âm thanh môi trường phi giọng nói ở cấp độ phân đoạn và toàn bộ video; lớp âm thanh...
AcademicDaily
Giải thưởng AI thường niên của Synced năm 2019 chính thức được công bố: Quan tâm đến những người tiên phong khởi nghiệp, tập trung vào các trường hợp sản phẩm.
Dựa trên sáu tiêu chí đánh giá, Synced đã xem xét hơn 200 hồ sơ từ các doanh nghiệp tham gia... Modi Video, tạo video ngắn tiếp thị cho người bán chỉ bằng một cú nhấp chuột; tiếp thị tự động trên WeChat...
Synced
CVPR 2022 | 30 bài báo của Phòng thí nghiệm Tencent YouTu được chọn, bao gồm các lĩnh vực như nhận diện ngữ nghĩa văn bản trong cảnh, tái tạo khuôn mặt 3D, phát hiện mục tiêu, phân đoạn cảnh video và chèn khung hình video.
Để giảm thiểu vấn đề này, một mô hình dựa trên tạo sinh đặc trưng đã được đề xuất để tổng hợp các lớp không nhìn thấy... Mô hình mới phát hiện DeepFake trong video: Học sự không nhất quán về không gian và thời gian. Phản hồi "..." ở hậu đài.
Phòng thí nghiệm Tencent YouTu
1 2 3 Trang tiếp theo
Tìm thấy khoảng 24 kết quả
Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.