Mô hình
Mô hình tạo thế giới 3D đột phá: Kỷ nguyên tạo dựng bối cảnh chuyên nghiệp đã bắt đầu
(giờ Việt Nam)
Tóm tắt AI
Công nghệ mới cho phép tạo ra các bối cảnh 3D hoàn chỉnh chỉ từ một hình ảnh duy nhất, biến nghiên cứu từ các hội nghị AI hàng đầu thành công cụ thực tế trong quy trình sản xuất.
Bản dịch AI
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
2026-09-03 18:18:36 Nguồn: QbitAI
Từ một hình ảnh đơn lẻ đến khung cảnh hoàn chỉnh, ứng dụng thực tế của bài báo xuất sắc nhất tại hội nghị hàng đầu.
Thật sự quá đỉnh! Tạo hình 3D vừa mới bước một bước dài từ "tạo vật" sang "tạo thế giới"!
Bạn đã xem "Inception" (Kẻ đánh cắp giấc mơ) chưa? Chỉ cần vung tay, người kiến tạo giấc mơ có thể làm các con phố gấp khúc theo quy luật vật lý và các tòa nhà trỗi dậy.
Giờ đây, một cảnh tượng tương tự đã xuất hiện trong lĩnh vực tạo hình 3D:
Chỉ cần tải lên một bức ảnh khung cảnh bất kỳ, sau 2-3 phút, một khung cảnh 3D hoàn chỉnh sẽ được tạo ra trực tiếp.
Chiếc bát trên bàn có thể được nhấc lên riêng biệt, chiếc ghế có thể xoay và di chuyển, những món đồ nội thất không ưng ý cũng có thể được thay thế bất cứ lúc nào...
Khác với những hình ảnh 3D chỉ để ngắm nhìn, ở đây mỗi tài sản đều "sống động".

Hoặc giả, ngoài việc tạo ra bò, chúng ta còn có thể tạo ra ngựa, tạo ra hổ!

Đơn vị thực hiện bước tiến này chính là "ông lớn" trong lĩnh vực tạo hình 3D - Hyper3D. Họ vừa chính thức ra mắt mô hình tạo thế giới WorldGen, đưa công nghệ tạo hình 3D từ các tài sản đơn lẻ lên thành những khung cảnh hoàn chỉnh.
So với khái niệm "mô hình thế giới" rộng lớn trong ngành, định vị của WorldGen cụ thể và rõ ràng hơn—
Không phải tạo ra một thế giới chỉ để xem, mà là cung cấp các khung cảnh 3D có thể tương tác, chỉnh sửa và đưa vào môi trường sản xuất thực tế.
Giống như chơi xếp hình Lego, bạn có thể liên tục thêm các mô-đun vào bên trong, cũng có thể rút ra hoặc thay thế bất kỳ mảnh ghép nào; mỗi mảnh ghép đều đi kèm thuộc tính vật lý riêng. Nếu vô tình rút đi vật đỡ quan trọng, các vật thể xung quanh cũng sẽ bị dịch chuyển hoặc rơi xuống.
Nói một cách đơn giản, mỗi tài sản ở đây không bị khóa chặt vào nền, và các mối quan hệ vật lý giữa các tài sản cũng rất rõ ràng.
Chính vì sự cụ thể đó, nó tiến gần hơn đến công việc thực tế.
Game cần màn chơi, điện ảnh cần phim trường, robot cần môi trường huấn luyện... nhưng giờ đây tất cả đều có thể bắt đầu từ WorldGen, với khả năng tạo hình đủ sức ứng dụng vào các bối cảnh sản xuất thực tế.
Con đường này không phải tự nhiên mà có. Ngay từ năm ngoái, Hyper3D đã giành giải Bài báo xuất sắc nhất tại hội nghị đồ họa quốc tế SIGGRAPH 2025 nhờ công nghệ tạo hình cấp độ khung cảnh tự phát triển mang tên CAST.
Các công ty thương mại cùng nhận giải thưởng trong kỳ đó chỉ có Google và Meta.
Và CAST chính là nền tảng kỹ thuật của WorldGen.

Vì vậy, nếu bước đầu tiên của AI 3D là trả lời câu hỏi vật thể trông như thế nào, thì WorldGen trả lời câu hỏi thứ hai:
Làm thế nào để nhiều vật thể cùng tồn tại với các mối quan hệ không gian và thuộc tính vật lý để tạo thành một khung cảnh.
Một bức ảnh → Một nhóm tài sản → Một khung cảnh.
Phải nói rằng, đại đa số các công nghệ tạo khung cảnh tổng thể hiện nay đều có một nhược điểm chung:
Đẹp nhưng không thực dụng.
Những gì người dùng có thể làm trong khung cảnh đó rất hạn chế, chủ yếu chỉ là đi lại và quan sát. Muốn thay đổi ư? Rất tiếc, chỉ có cách làm lại từ đầu.

Nguồn gốc của vấn đề nằm ở phương thức tạo hình. Theo lời của Ngô Địch (Wu Di), nhà sáng lập kiêm CEO của Hyper3D:
Cách làm truyền thống trực tiếp tạo ra toàn bộ khung cảnh như một mô hình duy nhất, khiến mọi nội dung dễ bị gộp thành một khối không thể tách rời, gây khó khăn cho việc tái sử dụng khung cảnh.
Thay đổi then chốt của WorldGen là phân tách khung cảnh thành các tài sản có thể thao tác riêng biệt, đồng thời bảo toàn các mối quan hệ không gian và vật lý giữa chúng.
Quy trình tạo hình tổng thể khi được tách nhỏ ra như sau:
Truy cập trang web chính thức (https://hyper3d.ai), chọn tạo hình bằng WorldGen.

Tại đây, chúng ta tải lên một bức ảnh chụp một phần căn bếp theo phong cách hoạt hình.
Hệ thống sẽ tự động nhận diện các vật thể chính trong ảnh, hoặc bạn cũng có thể khoanh vùng thủ công để chỉ định phần cần tạo.
Tiếp theo, mỗi vật thể tiền cảnh sẽ được tạo ra như một tài sản độc lập, chỉ mất khoảng 2 đến 3 giây để có bản xem trước.

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.