Video AI
Tạo và hiểu video bằng AI: Mô hình text-to-video, công cụ biên tập video và cuộc cách mạng điện ảnh sáng tạo.
748 bài thu thập40 tinh chọncập nhật đến 27/09 22:00
- JiQiZhiXinT6 · 04/09 · 20:15
DeepLeap trình làng mô hình DELE-w0.5: Hướng đi mới cho robot mà không cần tạo video
Startup DeepLeap giới thiệu mô hình thế giới DELE-w0.5, loại bỏ việc tạo video tốn kém để tập trung vào khả năng tái cấu trúc hành vi, giúp robot thích nghi linh hoạt với các tình huống thực tế chưa từng được huấn luyện.
- Google DeepMind: BlogT4 · 02/09 · 00:30
Google DeepMind ra mắt tính năng hiểu video thông minh cho Gemini
Google DeepMind cập nhật khả năng xử lý video thông minh cho dòng Gemini Flash, giúp mô hình tự động quét các phân đoạn quan trọng. Công nghệ này giúp giảm 88% lượng token, tiết kiệm 66% chi phí và tăng 7% độ chính xác so với phương pháp xử lý khung hình cố định truyền thống.
- QbitAIT3 · 01/09 · 19:15
MiniMax tạo video trong 3 giây: Bước ngoặt thương mại hóa AI thời gian thực
MiniMax vừa ra mắt công nghệ tạo video siêu tốc chỉ trong 3 giây, mở ra tiềm năng ứng dụng thương mại hóa trực tiếp cho các nội dung AI thời gian thực.
- Runway: News (Web)T3 · 01/09 · 00:03
Runway ra mắt Solaris: Mô hình thế giới đầu tiên tạo giao diện tương tác theo thời gian thực
Runway giới thiệu Solaris, mô hình tiên phong trong dòng Interface World Models, cho phép tạo giao diện người dùng theo thời gian thực và phản hồi trực tiếp các thao tác như nhấp chuột hay kéo thả mà không cần thông qua mã nguồn.
- JiQiZhiXinT2 · 31/08 · 22:00
Trải nghiệm thực tế: Dùng 'Qwen Creation' tạo phim ngắn AI với dàn Agent chuyên nghiệp
Alibaba vừa ra mắt nền tảng 'Qwen Creation' tích hợp mô hình Wan 3.0 và hệ thống đa Agent, cho phép người dùng tự động hóa quy trình sản xuất video từ kịch bản đến hậu kỳ, giải quyết bài toán nhất quán trong sáng tạo nội dung AI.
- WeChat: MiniMaxT2 · 31/08 · 07:40
Ra mắt website livestream AI 24/7 vận hành bởi MiniMax H3 Max
MiniMax đã tích hợp mô hình H3 Max vào nền tảng mở, cho phép các nhà phát triển tạo ra các kênh livestream Twitch và truyền hình AI hoạt động liên tục 24/7.
- JiQiZhiXinT6 · 28/08 · 13:45
ECCV 2026 Oral: MAVIN - Bước tiến mới giúp AI 'đạo diễn' video đa góc quay theo kịch bản
MAVIN là mô hình tiên phong cho phép AI tạo video đa góc quay với khả năng kiểm soát chặt chẽ về thời gian, đồng bộ âm thanh và nhất quán nhân vật, giải quyết bài toán khó trong việc kể chuyện bằng video dài.
- LMSYS: Blog (nhóm Chatbot Arena)T6 · 28/08 · 00:57
MiniMax-H3 trên 8x H200: Tăng tốc không mất dữ liệu lên tới 1,95 lần
Nhóm SGLang Diffusion thử nghiệm MiniMax-H3 trên 8 GPU NVIDIA H200, đạt tốc độ nhanh gấp 1,95 lần so với Diffusers mà không làm giảm chất lượng hình ảnh.
- Google DeepMind: BlogT5 · 27/08 · 23:12
Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI
Google giới thiệu Gemini 1.1 Flash với khả năng kiểm soát video nâng cao, hỗ trợ mở rộng bối cảnh lên tới 40 giây, tạo chuyển cảnh mượt mà và xuất video độ phân giải 4K cho nhà phát triển.
- Hugging Face Daily PapersT5 · 27/08 · 12:45
JoyAI-Echo-1.5: Bước tiến mới trong tạo video dài và thế giới ảo tương tác
JoyAI-Echo-1.5 là hệ thống tạo video và âm thanh đột phá, giúp duy trì tính nhất quán của nhân vật trong các video dài và cho phép tương tác thời gian thực trong môi trường 3D.
- OpenRouter: AnnouncementsT4 · 26/08 · 01:27
Hướng dẫn tích hợp API tạo video trên OpenRouter: Một mã nguồn cho mọi mô hình
OpenRouter ra mắt API tạo video đồng nhất, cho phép lập trình viên dễ dàng tích hợp các mô hình như Seedance, Veo hay Wan thông qua quy trình POST và polling đơn giản.
- WeChat: MiniMaxT5 · 20/08 · 07:36
MiniMax Design ra mắt: Bước tiến từ xử lý pixel đến thấu hiểu ý đồ và ngữ nghĩa
MiniMax Design là nền tảng tích hợp mô hình đa phương thức H3, giúp tự động hóa quy trình sản xuất nội dung từ khâu xử lý tư liệu đến dựng phim hoàn chỉnh thông qua các tác nhân AI thông minh.
- Sky Computing LabT5 · 20/08 · 04:04
FastMetal: Tạo video ngay trên Mac chỉ trong 30 giây mà không cần GPU rời
FastMetal mang mô hình FastWan-QAD lên chip Apple Silicon, cho phép tạo video 480P chỉ trong 30 giây với 3.9GB RAM mà không cần CUDA hay điện toán đám mây.
- JiQiZhiXinT4 · 19/08 · 19:00
DreamWorld: Đột phá tạo video 3D nhất quán nhờ tích hợp hình học không gian
HiDream.ai giới thiệu DreamWorld, mô hình khuếch tán video sử dụng tiền đề hình học 3D để giải quyết tình trạng biến dạng vật thể và thiếu nhất quán khi thay đổi góc quay, giúp tạo ra thế giới ảo ổn định hơn.
- QbitAIT2 · 17/08 · 16:15
Bước ngoặt cho mô hình thế giới: Tạo video 24FPS kèm âm thanh nổi 48kHz theo thời gian thực
Công nghệ mô hình thế giới vừa đạt cột mốc mới khi hỗ trợ tạo video đồng bộ âm thanh chất lượng cao theo thời gian thực và sắp sửa được công bố mã nguồn mở hoàn toàn.
- Hugging Face Daily PapersT2 · 17/08 · 10:00
Đối phó với video AI giả mạo các cuộc khủng hoảng thực tế: Đánh giá hệ thống về khả năng phát hiện
Nghiên cứu giới thiệu RA-Bench, bộ dữ liệu quy mô lớn để kiểm tra khả năng phát hiện video AI giả mạo trong các tình huống khủng hoảng thực tế, nhằm ngăn chặn nguy cơ lan truyền thông tin sai lệch.
- JiQiZhiXinCN · 16/08 · 15:00
VideoCoCo: Bước đột phá từ CUHK và USTC giúp video AI tuân thủ quy luật vật lý
VideoCoCo thay đổi cách tạo video bằng cách sử dụng mã nguồn làm 'chuỗi suy nghĩ' để mô phỏng các quy luật vật lý, giúp video chân thực và logic hơn thay vì chỉ dựa vào dự đoán pixel đơn thuần.
- HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)T7 · 15/08 · 07:00
MOSS-VL: Dòng mô hình ngôn ngữ thị giác mã nguồn mở đột phá với khả năng tương tác thời gian thực
MOSS-VL là dòng mô hình ngôn ngữ thị giác tiên phong tích hợp khả năng vừa quan sát vừa phản hồi theo thời gian thực. Nhờ cơ chế chú ý chéo, mô hình đạt hiệu suất vượt trội trên các bài kiểm tra luồng dữ liệu, dẫn đầu các giải pháp mã nguồn mở hiện nay.
- IT HomeT4 · 12/08 · 14:13
Ra mắt mô hình LTX-2.5: Tạo video 10 giây 720p chỉ trong 6,8 giây, tích hợp sẵn ComfyUI
LTX-2.5 mang đến khả năng tạo video 720p kèm âm thanh với tốc độ ấn tượng và chi phí tối ưu, đồng thời hỗ trợ tích hợp sâu vào ComfyUI. Các tổ chức có doanh thu dưới 10 triệu USD/năm có thể sử dụng miễn phí.
- RunwayT4 · 12/08 · 02:17
Runway ra mắt Seedance 2.5: Hỗ trợ 50 nhân vật tham chiếu và video 30 giây đồng bộ nhạc
Seedance 2.5 chính thức có mặt trên Runway, cho phép tạo video dài tới 30 giây khớp với âm nhạc và hỗ trợ tham chiếu đồng thời 50 nhân vật độc đáo.