Wan 3.0 is now on @Scenario_gg! 🚀 30-second generation, synchronized audio, and multimodal inputs…
DịchMô hình Wan 3.0 của Alibaba hiện hỗ trợ tạo video dài 30 giây với âm thanh đồng bộ và khả năng xử lý đa phương thức phức tạp. Người dùng có thể trải nghiệm ngay thông qua nền tảng Model Studio và Qwen Cloud.
Wan 3.0 is now live on @RunningHub_ai Native 30-second generation, multimodal references, and stron…
DịchAlibaba vừa đưa mô hình Wan 3.0 lên nền tảng RunningHub, hỗ trợ tạo video 30 giây với độ nhất quán thời gian cao và khả năng xử lý đa phương thức mạnh mẽ thông qua Web UI hoặc API.
Wan 3.0 is now live on @runware on D0 🎬 More richer visual details, consistent references, and mor…
DịchWan 3.0 chính thức có mặt trên Runware D0, hỗ trợ tạo video 30 giây từ văn bản với khả năng tùy biến cao thông qua nhiều hình ảnh, video và âm thanh tham chiếu, cùng chế độ suy luận phức tạp.
Ideas in, 30 seconds of footage out - no stitching. Wan3.0 is on @Segmind_ai, via PixelFlow or API …
DịchMô hình Wan3.0 của Alibaba Cloud đã có mặt trên nền tảng Segmind, cho phép tạo video dài tới 30 giây với độ phân giải 1080p và hỗ trợ đa phương thức đầu vào như văn bản, hình ảnh, âm thanh.
Wan3.0 is now live on @fal. One pass, 30 seconds, no stitching. Feed it text, images, audio, video…
DịchMô hình Wan3.0 của Alibaba Cloud đã có mặt trên fal, hỗ trợ tạo video 30 giây nguyên bản mà không cần ghép nối. Công cụ này xử lý đa phương thức từ văn bản, hình ảnh đến tài liệu, đồng thời cải thiện đáng kể khả năng mô phỏng chuyển động thực tế.
Wan 3.0 is now available on @envato! 🚀 More consistent references, richer visual details, and more…
DịchMô hình Wan 3.0 của Alibaba Cloud đã chính thức có mặt trên nền tảng Envato, giúp nâng cao độ nhất quán và chi tiết hình ảnh cho video AI. Người dùng hiện có thể truy cập thông qua API tại Model Studio và Qwen Cloud.
Wan3.0 is now live on @magnific. Text, images, web content in - 30-second cinematic video out. Mor…
DịchMô hình Wan 3.0 đã có mặt trên Magnific, cho phép người dùng tạo video dài 30 giây với chất lượng điện ảnh từ văn bản, hình ảnh hoặc nội dung web. Các nhà phát triển có thể truy cập thông qua API tại Model Studio và Qwen Cloud.
Mô hình Wan3.0 của Alibaba chính thức ra mắt với khả năng tạo video dài 30 giây và hỗ trợ đầu vào từ các định dạng tài liệu như PDF, PPT, DOC. Dịch vụ hiện đã mở API với mức giá cạnh tranh và nhiều cải tiến về độ nhất quán hình ảnh.
InfinityEdit giải quyết bài toán chỉnh sửa video theo thời gian thực cho các luồng dữ liệu không giới hạn, cho phép áp dụng các yêu cầu chỉnh sửa liên tục mà không cần xử lý toàn bộ clip tĩnh từ trước.
SemComp-Bench giới thiệu phương pháp đánh giá video dựa trên kết quả thực tế thay vì chỉ tập trung vào hình ảnh, đảm bảo AI hiểu đúng ngữ nghĩa và hoàn thành mục tiêu tác vụ thay vì chỉ sao chép ngoại hình.
Meta vừa giới thiệu Muse Video, mô hình AI mới cho phép tạo video dài 10 giây với khả năng hiểu bối cảnh tốt, dù vẫn còn hạn chế về đồng bộ âm thanh và các chuyển động phức tạp.
EXCLUSIVE 🔥: Early look at the first outputs of the Muse Video model from Meta AI. > Muse Video i…
DịchMeta vừa hé lộ những kết quả đầu tiên từ mô hình tạo video Muse, hiện đang trong giai đoạn thử nghiệm kín. Điểm nhấn của Muse là khả năng hỗ trợ âm thanh gốc (giọng nói và nhạc) ngay từ đầu và cơ chế kiểm soát bản quyền nghiêm ngặt.
V-RAE là kiến trúc autoencoder mới giúp cải thiện khả năng tạo video bằng cách tận dụng các mô hình nền tảng thị giác có sẵn, thay vì chỉ tập trung vào tái tạo điểm ảnh đơn thuần.
EG-FM cải tiến mô hình Flow Matching bằng cách sử dụng quỹ đạo tạo ảnh từ thô đến tinh thông qua bộ lọc nhiệt, giúp tái tạo chi tiết ảnh sắc nét mà không cần thay đổi kiến trúc hay dữ liệu huấn luyện.
HiFi-BRep giới thiệu khung làm việc đột phá giúp loại bỏ nhiễu trong thiết kế CAD, cho phép dự đoán đồng thời hình học và cấu trúc liên kết với độ chính xác vượt trội so với các phương pháp hiện nay.
Alibaba chính thức phát hành HappyShrimp 1.0, mô hình AI cho phép người dùng chuyển đổi cảm xúc, ký ức hoặc câu chuyện thành các bản nhạc hoàn chỉnh chỉ bằng câu lệnh văn bản.
Kunlun Wanwei vừa trình làng Mureka V9.5, mô hình tạo nhạc AI thế hệ mới với khả năng xử lý giọng hát tự nhiên, hòa âm tinh tế và độ chính xác cao, đặc biệt tối ưu cho các tác phẩm mang âm hưởng truyền thống Trung Hoa.
MegaParts là khung tạo mô hình 3D tự hồi quy mới, sử dụng bộ mã hóa hình học nén để xử lý các vật thể phức tạp lên tới 300 bộ phận mà vẫn đảm bảo hiệu suất và độ chi tiết cao.
MiniMax giới thiệu MiniMax-Music3, mô hình AI tạo nhạc mã nguồn mở cho phép tạo các bản nhạc stereo 32kHz dài tới 5 phút dựa trên lời bài hát và mô tả cấu trúc chi tiết.
all of the recent proc gen art, video editing and 3d game demos recently have made me update towards…
DịchDựa trên các tiến bộ gần đây trong lập trình nghệ thuật và chỉnh sửa video, các mô hình LLM đang cho thấy tiềm năng sáng tạo vượt trội hơn so với các mô hình khuếch tán truyền thống.
Alibaba vừa trình làng HappyShrimp 1.0, mô hình AI cho phép tạo bài hát hoàn chỉnh từ mô tả văn bản. Công cụ này khắc phục tốt các lỗi về giọng hát và nhịp điệu, hỗ trợ đa dạng phong cách âm nhạc từ Lo-fi đến R&B.
PixVerse vừa công bố bản cập nhật mô hình AI tạo video mới, tập trung vào việc cải thiện độ chân thực của chuyển động và khả năng kiểm soát chi tiết theo yêu cầu người dùng.
Precise editing is one of the best features of Grok Imagine. It automatically split my image into 4…
DịchGrok Imagine cho phép tự động tách hình ảnh thành 47 phân đoạn riêng biệt, giúp người dùng chỉnh sửa chi tiết từng phần mà vẫn giữ nguyên bố cục gốc của bức ảnh.
Seedance 2.5 in 1080p is now live on Runway. Early access starts today, bringing sharper detail at h…
DịchRunway vừa chính thức cập nhật phiên bản 1080p cho mô hình Seedance 2.5, mang đến chất lượng hình ảnh sắc nét và chi tiết hơn. Người dùng hiện đã có thể trải nghiệm sớm tính năng này ngay trên nền tảng.
MiniMax vừa trình làng Music3, mô hình AI có khả năng tạo các bản nhạc dài 5 phút với cấu trúc phức tạp, giữ vững nhịp điệu và chất giọng ổn định nhờ kiến trúc tự hồi quy phân tầng.
DịchTính năng Grok Imagine của xAI khiến người dùng kinh ngạc khi tự động tạo ra các đoạn hoạt họa chất lượng cao mà không cần yêu cầu cụ thể về văn bản, thể hiện khả năng hiểu ngữ cảnh thông minh.
Waitlist is open for tonight for our H3 x @magnific showcase but that doesn't mean you're out. Regi…
DịchMiniMax tổ chức buổi trình diễn trực tiếp mô hình H3 và Magnific tại văn phòng Magnific ở San Francisco. Người dùng vẫn có thể đăng ký danh sách chờ và gửi tác phẩm sáng tạo để có cơ hội được trình chiếu tại sự kiện.
Thanks for Huggingface team @multimodalart, day 0 support open weight music model!
DịchMiniMax vừa phát hành mã nguồn mở cho mô hình MiniMax Music 3, kết hợp LLM 8B và DiT 2.7B để tạo ra các bản nhạc hoàn chỉnh từ văn bản và lời bài hát. Người dùng có thể chạy mô hình trên GPU tiêu dùng thông qua Diffusers hoặc ComfyUI.
StateFlow là giải pháp đột phá giúp chuyển đổi nội dung 2D thành thế giới 3D nhất quán, cho phép chỉnh sửa cục bộ và tối ưu hóa góc quay mà không cần tái tạo toàn bộ cảnh, tối ưu cho sản xuất phim và game.