Sản phẩm
Fal ra mắt H3 Max Live: Bước ngoặt tạo video AI thời gian thực
(giờ Việt Nam)
Tóm tắt AI
Công nghệ mới từ Fal cho phép tạo video chất lượng cao với tốc độ nhanh hơn cả thời gian xem thực tế, mở ra kỷ nguyên mới đầy hứa hẹn cho nội dung AI.
Bản dịch AI
![[AINews] Fal’s H3 Max Live breaks the infinite videogen barrier](https://substackcdn.com/image/fetch/$s_!hV5N!,w_1200,h_675,c_fill,f_jpg,q_auto:good,fl_progressive:steep,g_auto/https%3A%2F%2Fpbs.substack.com%2Fmedia%2FHQ7UHClW4AA2I6L.jpg)
Trong suốt lịch sử của Generative Media, về cơ bản bạn luôn phải thiết kế xoay quanh một thực tế bất tiện là việc tạo hình ảnh và video rất tốn thời gian — ngay cả khi bạn sử dụng các mô hình nhất quán (consistency models) để rút ngắn thời gian tạo từ 30 giây xuống còn 1 giây, bạn vẫn chỉ có được video với tốc độ tối đa là 1 FPS… thấp hơn nhiều so với mức chấp nhận được đối với sự chú ý của người tiêu dùng thông thường.
Fal đã lấy bản phát hành H3 của Minimax từ tháng trước, đầu tiên là hậu huấn luyện (post-trained) để cải thiện cả về chi phí lẫn chất lượng, sau đó tối ưu hóa cho công cụ suy luận nội bộ của họ để đạt tốc độ nhanh gấp 35 lần so với endpoint chính thức… dẫn đến việc vượt qua điểm kỳ dị của video vô tận:

fal@fal
Giới thiệu H3 Max. Việc tạo video trực tiếp (Live Video) giờ đây đã nhanh hơn thời gian thực. Một chương trình phát sóng vô tận nơi mỗi khung hình được tạo ngay lập tức và mỗi cảnh quay đều được điều hướng bởi khung chat. Hãy gõ!prompt và nó sẽ xuất hiện trên màn hình chỉ trong vài giây.

11:31 CH · 29 thg 8, 2026 · 379K Lượt xem
91 Trả lời · 160 Đăng lại · 1.9K Lượt thích
Điều này lần đầu tiên được Ethan Mollick chú ý:

Ethan Mollick@emollick
Một ranh giới trong lĩnh vực AI video đã bị vượt qua. Trong các thử nghiệm của tôi chỉ với giao diện web, H3 Max hiện có thể tạo ra video AI với chất lượng khá cao trong thời gian ít hơn cả thời gian bạn xem nó. Đây là thời gian thực kể từ khoảnh khắc tôi nhấn nút "generate" (và cũng bao gồm cả việc tăng cường prompt).
9:03 CH · 27 thg 8, 2026 · 87.2K Lượt xem
45 Trả lời · 58 Đăng lại · 893 Lượt thích
Sau đó, các nhân viên của fal đã thương mại hóa nó thành một luồng phát sóng Twitch vô tận:

Rehan Sheikh@rehan_shei
Minimax H3 Max đã tạo video nhanh hơn cả tốc độ bạn xem, vì vậy tôi đã kết nối nó với một buổi livestream trên Twitch! Giờ đây bạn có thể xem "interdimensional cable" vô tận - liên kết đến luồng phát bên dưới.
2:37 SA · 29 thg 8, 2026 · 5.75M Lượt xem
616 Trả lời · 1.03K Đăng lại · 13.3K Lượt thích
và sau đó là sự bùng nổ:

@levelsio@levelsio
Được rồi, tôi đã xây dựng xong! 🍰 Infinite Slop levels.io/infinite-slop. Một luồng phát trực tiếp vô tận và tương tác được tạo bởi AI về những nội dung "slop" kéo dài mãi mãi. Bất cứ điều gì bạn viết trong khung chat sẽ được tạo tiếp theo và AI sẽ cố gắng kết nối nó với video trước đó để tạo ra một…
@levelsio @levelsio
Hôm nay là một khoảnh khắc rất lịch sử đối với việc tạo video AI. Giờ đây bạn có thể tạo video AI nhanh hơn cả tốc độ bạn xem. Trước đây, giả sử mất 2-5 phút để tạo 15 giây video. @fal đã tạo ra một biến thể Minimax H3 đã qua hậu huấn luyện có tên là Max, nhanh gấp 50 lần so với…
5:34 CH · 29 thg 8, 2026 · 1.98M Lượt xem
812 Trả lời · 535 Đăng lại · 6.7K Lượt thích
với việc Twitch/Youtube ngay lập tức gỡ bỏ Fal khỏi nền tảng, nên Fal đã tự xây dựng dịch vụ video trực tiếp kiểu “twitch plays pokemon” của riêng họ:
Nếu bạn xem luồng phát này dù chỉ vài giây, bạn có thể nhận ra đây hoàn toàn là "slop" - sẽ chẳng có ai thực sự xem mớ hỗn độn đầy ảo giác này với cốt truyện không rõ ràng và hình ảnh chất lượng thấp được tinh chỉnh bằng RL.
Tuy nhiên… đây là mức tệ nhất mà nó từng có. Nếu bạn chưa rút ra được bài học rằng những kỹ sư và doanh nhân giỏi nhất luôn xây dựng cho tương lai sắp tới, và bằng chứng tồn tại của video "đủ tốt" với tốc độ nhanh hơn thời gian thực là hoàn toàn khả thi, thì bạn đang không nắm bắt được tình hình trong cuộc chơi lớn về cách dẫn đầu trong lĩnh vực AI.
Tin tức AI từ 29/8/2026 - 31/8/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm Discord nào. Trang web của AINews cho phép bạn tìm kiếm tất cả các số báo cũ. Xin nhắc lại, AINews hiện là một phần của Latent Space. Bạn có thể chọn nhận/hủy nhận email theo tần suất!
Phát hành mô hình, Điểm chuẩn tác nhân (Agent Benchmarks) và Cạnh tranh mã nguồn mở (Open-Weight)
Muse Code của Meta thoát khỏi giai đoạn beta với SDK và các gói đăng ký: Meta đã đưa Muse Code vào trạng thái khả dụng chung, định vị nó như một tác nhân lập trình cho các tác vụ lớn hơn với SDK xem trước dành cho nhà phát triển để nhúng các tác nhân tùy chỉnh, kết nối công cụ, truyền phát tiến độ và tiếp tục phiên làm việc. Chi tiết ra mắt đến từ @finkd, cùng với các thông tin tiếp theo về SDK và gói đăng ký hàng tháng; @alexandr_wang đã quảng bá cho bản phát hành này. Riêng biệt, Ollama cho biết họ đã hỗ trợ bộ công cụ Muse Code.
Trọng số DeepSeek V4 Flash Vision hiện đã mở: Một số bài đăng đã chỉ ra việc phát hành trọng số DeepSeek-V4-Flash-Vision-Exp, với @teortaxesTex lưu ý rằng mô hình này bổ sung khả năng thị giác ngang hàng với Moonshot và GLM, và @zizhpan đã liên kết trực tiếp đến các trọng số. Thông tin tiếp theo từ @teortaxesTex cho thấy DeepSeek có thể đang cam kết phát hành tất cả các checkpoint.
GLM-5.3 Flash tỏ ra đặc biệt mạnh mẽ về hiệu suất/chi phí tác nhân: Trên Agent Arena, @arena báo cáo GLM-5.3-Flash đứng thứ 19 chung cuộc, thứ 4 trong số các mô hình mở, với mức cải thiện ròng +4.6% qua hơn 9K phiên thực tế và chi phí trung bình là $0.12/tác vụ. Phân tích tín hiệu bao gồm +15.3% Thành công được xác nhận và không có vấn đề ảo giác công cụ nào trong luồng thảo luận. Vals cũng nhấn mạnh vào dòng GLM-5.3 rộng hơn, bao gồm 95.4% trên SWE-bench, 78.1% trên Vibe Code Bench, ngữ cảnh 1M và tối đa 128k token đầu ra trong các ghi chú điểm chuẩn.
Qwen3.8-Flash-Next tham gia cùng đấu trường, nhưng xếp dưới GLM-5.3 Flash: @arena xếp Qwen3.8-Flash-Next ở vị trí thứ 24 chung cuộc, thứ 7 trong số các mô hình mở, với mức cải thiện ròng +2.4% qua hơn 8.7K phiên. Theo phân tích tín hiệu, nó nổi bật hơn ở khả năng Thành công được xác nhận (+12.3%) so với khả năng điều hướng hoặc tỷ lệ khen-chê.
Hy4 Preview của Tencent Hunyuan dường như đang tiến vào nhóm tác nhân hàng đầu của Trung Quốc: Một bài tổng hợp dài từ @ZhihuFrontier mô tả Hy4 Preview là mô hình MoE 770B mã nguồn mở với 49B tham số hoạt động và ngữ cảnh >1M, nhấn mạnh vào những cải tiến trong lập trình, độ ổn định của tác nhân và ứng dụng thực tế trong văn phòng/nghiên cứu. Điểm đáng chú ý về kỹ thuật không chỉ là khả năng mà còn là sự tăng tốc tổ chức: bảy tuần sau Hy3, Tencent được cho là đã thu hẹp phần lớn khoảng cách thông qua hậu huấn luyện, tinh chỉnh chính sách tác nhân và độ ổn định tốt hơn.
Cơ sở hạ tầng tác nhân, Bộ công cụ và Kỹ thuật ngữ cảnh
Bài viết được AI dịch và tổng hợp tự động từ Latent Space. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.