Sản phẩm
Bùng nổ ứng dụng video AI: Meitu mở ra dư địa tăng trưởng mới
(giờ Việt Nam)
Tóm tắt AI
Từ hình ảnh sang video, Meitu đã tìm thấy một mô hình kinh doanh sinh lời hiệu quả hơn trong kỷ nguyên AI.
Bản dịch AI
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
26/08/2026 18:18:10 Nguồn: QbitAI
Từ hình ảnh đến video, Meitu đã tìm ra một công việc kinh doanh sinh lời hơn
Sự bùng nổ của các ứng dụng video là một sự kiện mang tính hiện tượng trong ngành AI trong năm qua.
Từ Higgsfield, Flova, LibTV cho đến Firefly của Adobe, hay "Kaipai" (Khai Phách) và MVLAND của Meitu, các công ty khởi nghiệp và những "ông lớn" trong lĩnh vực thị giác máy tính đang thu hút sự chú ý hoặc được định giá lại từ thị trường nhờ vào các công cụ và nền tảng sáng tạo video.
Điểm chung của các ứng dụng video này là việc sắp xếp các năng lực mô hình thành quy trình làm việc (workflow), xây dựng nền tảng sáng tạo và hệ sinh thái nội dung dưới dạng Agent (tác nhân), canvas vô hạn và các Skills (kỹ năng), nhằm giúp người dùng xuất ra kết quả chất lượng cao một cách hiệu quả hơn. Điều này đã truyền thêm niềm tin cho thị trường vào lớp ứng dụng, đồng thời cũng báo hiệu rằng các ứng dụng video đang bước vào giai đoạn đào thải khốc liệt.
Thâm nhập vào đường đua ứng dụng video, làm thế nào để xây dựng hệ thống phòng thủ thông qua bố cục sản phẩm và chiến lược độc đáo đã trở thành một bài toán mới cho các đơn vị trong lĩnh vực thị giác.

Không so mô hình mà so quy trình làm việc, ứng dụng video AI bùng nổ
Khi năm 2026 đi được một nửa chặng đường, xu hướng dẫn dắt trong ngành AI lại thay đổi.
Với sự tiến hóa và hội tụ của các năng lực mô hình, thị trường dần hình thành một sự đồng thuận: người dùng quan tâm đến kết quả chứ không phải nguồn gốc. Video được tạo ra bởi mô hình nào không quan trọng, quan trọng là hiệu suất, chất lượng và khả năng kiếm tiền.
Sự thật đằng sau điều này là "mô hình nuốt chửng ứng dụng" đã không xảy ra, mối quan hệ giữa lớp mô hình và lớp ứng dụng đang dần tiến tới sự phối hợp. Nói cách khác, mô hình cung cấp công nghệ nền tảng, còn ứng dụng cung cấp nền tảng và quy trình làm việc để mang lại kết quả ổn định và nhất quán cho người dùng. Về mô hình kinh doanh, các công ty mô hình kiếm tiền từ việc bán sức mạnh tính toán, còn các công ty ứng dụng kiếm tiền từ việc bán hiệu quả.
Tất nhiên, không loại trừ khả năng các nhà sản xuất mô hình đa năng vẫn có thể trực tiếp tham gia cạnh tranh với các công ty ứng dụng. Tuy nhiên, nhìn vào nửa đầu năm 2026, sự bùng nổ của đường đua thị giác AI, đặc biệt là các công cụ video AI, đã mở ra không gian tưởng tượng cho lớp ứng dụng. Những ứng dụng này biến sản phẩm thành nền tảng sáng tạo có thể trực tiếp xuất ra kết quả cho người dùng bằng cách sắp xếp năng lực mô hình thành quy trình làm việc, sau đó xây dựng hệ thống sản xuất nội dung AI thông qua Agent, canvas vô hạn và các Skills.
Trên thị trường sơ cấp, các công cụ sáng tạo video như Higgsfield, Flova, LibTV đang rất được săn đón. Tháng 8, nền tảng tạo hình ảnh và video AI Higgsfield đã hoàn tất vòng gọi vốn Series B trị giá 400 triệu USD; tháng 6, công ty mẹ của LibTV là Yanyu Technology đã hoàn tất vòng gọi vốn B+ trị giá gần 300 triệu USD.
Xét về đối trọng, thị trường thứ cấp quan sát các ứng dụng video này chủ yếu tập trung vào những tên tuổi hàng đầu trong lĩnh vực hình ảnh. Ví dụ, Firefly do Adobe ra mắt là "trạm làm việc sáng tạo AI tất cả trong một" dành cho người sáng tạo, bao phủ hình ảnh, video, âm thanh, thiết kế và quy trình làm việc của Agent. Trong số các công ty Trung Quốc, Meitu đã thâm nhập vào đường đua ứng dụng video nhờ vào hàng loạt sản phẩm như Wink, Kaipai, Vmake Labs và MVLAND.
Chuyên biệt hơn, tập trung hơn, sâu sắc hơn
Khác với Higgsfield hay Firefly, các ứng dụng video AI của Meitu đại diện cho một tư duy sản phẩm và chiến lược khác: chuyên biệt hơn, tập trung hơn và sâu sắc hơn.
Chiến lược này dường như đã được định hình từ khi làn sóng AI bắt đầu. Sản phẩm video đầu tiên mà Meitu ra mắt vào năm 2022 là Wink, đã nhanh chóng nổi lên nhờ các tính năng chuyên biệt như phục hồi chất lượng hình ảnh và làm đẹp video.
Kaipai và Vmake Labs ra mắt năm 2023 đã giúp Meitu thực sự thâm nhập vào các ứng dụng năng suất sáng tạo video. Kaipai và Vmake Labs lần lượt hướng tới thị trường trong nước và quốc tế, tập trung vào quy trình làm việc của video nói (talking head) và video tiếp thị. Tại Trung Quốc, Kaipai cho phép người dùng tạo video nói hiệu quả thông qua các tính năng như máy nhắc chữ, tạo video bằng một cú nhấp chuột, các mẫu template bắt trend, giúp người dùng trong các ngành giá trị cao như bảo hiểm, giáo dục đào tạo, chăm sóc sức khỏe đạt được khách hàng trực tuyến và nhanh chóng trở thành đơn vị dẫn đầu trong đường đua video nói. Tại Mỹ, Vmake Labs cũng rất phổ biến trong thị trường thể hình và chăm sóc sức khỏe nhờ các video tiếp thị dạng nói.
Tại Meitu Imaging Festival 2026, Kaipai đã ra mắt "Kaipai AI Assistant", thông qua một đội ngũ video AI hoạt động 24/7 gồm nhiều Agent, bao phủ toàn bộ quy trình từ "phân tích tài khoản, chọn chủ đề nội dung, lập kế hoạch kịch bản, đến tạo và chỉnh sửa video", liên tục cung cấp các video nói chất lượng cao cho người dùng.
Tư duy sản phẩm này một mặt rất phù hợp với xu hướng tập trung vào sắp xếp quy trình làm việc và tạo ra giá trị thương mại cho người dùng hiện nay; mặt khác, nó tập trung hơn vào các kịch bản chuyên biệt và người dùng trong ngành, kết hợp với sự tích lũy về thẩm mỹ và kiến thức chuyên môn (know-how) hơn mười năm của Meitu để tích hợp thành quy trình làm việc có thể lặp lại. Thiết kế này giúp kết quả đầu ra có độ chính xác, tính nhất quán và khả năng kiểm soát cao hơn.
Điều thường bị thế giới bên ngoài bỏ qua là Meitu còn có một "con hào" sâu hơn so với các mô hình đa năng hoặc các công ty khởi nghiệp ứng dụng, đó chính là sự hiểu biết về sở thích thẩm mỹ, nhu cầu tinh tế, kết quả chất lượng cao và xu hướng ngành được tích lũy liên tục từ các hành vi tạo, chỉnh sửa, lưu trữ và sử dụng tần suất cao của người dùng. Từ đó, họ có thể phản hồi ngược lại để tinh chỉnh các mô hình chuyên biệt tự phát triển và lặp lại sản phẩm. Nói một cách dễ hiểu hơn, trong các kịch bản chuyên biệt mà các sản phẩm như Kaipai thâm nhập, rất khó có sản phẩm nào hiểu rõ người dùng muốn gì hơn nó.
Hiệu quả kinh doanh của Kaipai và Vmake Labs cũng chứng minh tính khả thi của chiến lược này. Theo báo cáo tài chính mới nhất của Meitu, tính đến tháng 6/2026, MAU của Kaipai tăng hơn 100% so với cùng kỳ năm ngoái, số lượng người dùng đăng ký trả phí tăng hơn 150%, ARR tăng hơn 100%; trong khi đó, ARR của Vmake Labs đạt khoảng 5 triệu USD.
Sự chuyên môn hóa đang trở thành "con hào"
Đối tác của a16z, Anish Acharya, gần đây đã đề cập trong một cuộc phỏng vấn rằng sự chuyên môn hóa đang trở thành một loại "con hào" mới. Giải thích của ông là công nghệ hiện nay đã đủ để các nhóm sản phẩm đạt được mức độ chuyên môn hóa cao cho một nhóm người dùng rất cụ thể. Nói cách khác, sự hiểu biết về người dùng, hệ sinh thái được xây dựng cho người dùng cũng như dữ liệu và quy trình làm việc được tích lũy sẽ trở thành lợi thế mà đối thủ cạnh tranh khó có thể sao chép trong thời gian ngắn.
Giống như trong lĩnh vực hình ảnh, việc thấu hiểu và phục vụ sự thể hiện thị giác của người dùng cũng là bản chất của video. Lộ trình của Meitu là: bắt đầu từ xu hướng ngành là sắp xếp các mô hình thành quy trình làm việc, nhanh chóng khai thác và đưa sản phẩm đi sâu vào các kịch bản chuyên biệt có giá trị cao, liên tục tối ưu hóa thông qua phản hồi của người dùng và mang lại kết quả tốt hơn.
Tiếp nối chiến lược này, vào tháng 6 năm nay, Meitu đã ra mắt một nền tảng sáng tạo AI nguyên bản dành cho video – MVLAND.
Nhìn từ chức năng sản phẩm và quy trình làm việc, sản phẩm này gần như hoàn toàn phù hợp với cách chơi AI Video mới nhất: thông qua Agent phân tích âm nhạc và canvas sáng tạo, chuyển đổi chính xác nhịp điệu và cảm xúc của âm nhạc thành hình ảnh thị giác. Đồng thời, với "đặc trưng Meitu", MVLAND vẫn áp dụng chiến lược kịch bản chuyên biệt: tập trung vào quy trình sáng tạo MV, cung cấp các video âm nhạc chất lượng cao cho các nhạc sĩ, người sáng tạo nội dung, v.v.
MVLAND không chỉ nhanh chóng hoàn thành xác thực PMF (độ phù hợp của sản phẩm với thị trường) mà còn chứng minh năng lực tạo ra các sản phẩm có khả năng chi trả cao của Meitu. Theo tiết lộ của Meitu, MVLAND đã đạt mức tăng trưởng ARR gấp đôi trong vòng ba tháng sau khi ra mắt, đồng thời ARPPU (doanh thu trung bình trên mỗi người dùng trả phí) hàng tháng đạt khoảng 220 nhân dân tệ, gấp 13 lần so với ARPPU tổng hợp của các sản phẩm khác của Meitu trước đây.
Điều này cho thấy, khi sản phẩm thực sự có thể mang lại kết quả chất lượng cao cho người dùng, giúp người dùng giải quyết các vấn đề quan trọng, thậm chí hỗ trợ người dùng đạt được chuyển đổi thương mại, thì sự nhạy cảm về giá của người dùng sẽ giảm đi đáng kể.
Từ sự xuất hiện của Wink năm 2022 đến khi MVLAND ra mắt năm 2026, ấn tượng của thế giới bên ngoài về Meitu cũng dần thay đổi từ "chỉ biết chỉnh sửa ảnh" thành "hóa ra Meitu cũng có thể làm video". Khi video trở thành một trong những xu hướng chắc chắn nhất của ngành AI, sự hiểu biết sâu sắc của Meitu về biểu đạt thị giác đang chuyển từ sức mạnh mềm thành rào cản cứng.
Một công việc kinh doanh kiếm tiền tốt hơn hình ảnh đã được vận hành trơn tru, và không gian tưởng tượng mà video mang lại có lẽ mới chỉ bắt đầu được giải phóng. Đã đến lúc thị trường cần xem xét lại logic định giá đối với Meitu.
Bài viết này do Meitu cung cấp, QbitAI được ủy quyền đăng tải lại, quan điểm thuộc về tác giả gốc.
Bản quyền thuộc về tác giả, không được phép sao chép và sử dụng dưới bất kỳ hình thức nào nếu không có sự cho phép, kẻ vi phạm sẽ bị xử lý theo pháp luật.





Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.