Nghiên cứu
Đột phá từ ByteDance: Tối ưu hóa mô hình tạo ảnh bằng 'Structured Prompt' thay vì chỉ tăng độ dài văn bản
(giờ Việt Nam)
Tóm tắt AI
Nhóm Seed của ByteDance phát hiện rằng thông tin hình ảnh trong Caption quan trọng hơn độ dài văn bản. Họ đề xuất Structured Prompt giúp cải thiện đáng kể khả năng suy luận và hiểu biết thế giới của các mô hình khuếch tán.
Bản dịch AI
Mô hình văn bản thành hình ảnh (text-to-image) PixArt với chi phí huấn luyện cực thấp đã ra mắt, hiệu quả sánh ngang MJ, chỉ tốn 10% thời gian huấn luyện so với SD.
Chuyên mục Machine Heart, Ban biên tập Machine Heart: Huấn luyện một mô hình văn bản thành hình ảnh sánh ngang MJ, 26... Nhóm nghiên cứu hy vọng PixArt-α có thể cung cấp những hướng đi mới cho cộng đồng AIGC và các công ty khởi nghiệp,...
Machine Heart
Bài báo quan trọng từ nhóm của LeCun & Xie Saining: RAE đã có thể tạo hình ảnh từ văn bản quy mô lớn, tốt hơn cả VAE!
Được đăng lại từ: Machine Heart. Trong bản đồ công nghệ của các mô hình văn bản thành hình ảnh, VAE gần như đã... Nhóm nghiên cứu đã mở rộng một cách hệ thống ý tưởng về "Representational Autoencoder" (RAE), trong ngữ nghĩa đã được đóng băng...
CVer
Bài báo quan trọng từ nhóm của LeCun và Xie Saining: RAE đã có thể tạo hình ảnh từ văn bản quy mô lớn và tốt hơn cả VAE.
Biên tập viên Machine Heart | Panda: Trong bản đồ công nghệ của các mô hình văn bản thành hình ảnh, VAE gần như đã... Nhóm nghiên cứu đã mở rộng một cách hệ thống ý tưởng về "Representational Autoencoder", trong ngữ nghĩa đã được đóng băng...
Thuật toán học máy và Xử lý ngôn ngữ tự nhiên
Đằng sau "Sora phiên bản tiếng Trung" bị hiểu lầm, ByteDance sở hữu những công nghệ gì?
Báo cáo từ Machine Heart, Tác giả: Dan Jiang. Ngay đầu năm 2024, OpenAI đã tạo nên cơn sốt trong lĩnh vực AI tạo sinh... Bài viết này sẽ giới thiệu 9 nghiên cứu từ nhóm Sáng tạo thông minh của ByteDance, liên quan đến văn bản thành...
Machine Heart
Bàn lại về việc tái hiện Sora: Những điều được ngưỡng mộ và bị lãng quên.
Niềm tin vào Scaling Law cùng những đổi mới công nghệ mang tính đột phá đã giúp nó duy trì vị thế dẫn đầu... Là nhóm khám phá công nghệ AI tiên phong và ứng dụng thực tiễn, Diễn đàn Công nghệ AI của Machine Heart một lần nữa...
Turing Education
ChatBot từng bị lu mờ bởi "tôm hùm" (Lobster), liệu đã thực sự lắng xuống?
Ví dụ, nhóm hướng dẫn người dùng tùy chỉnh thêm nhiều bot (chatbot), sau đó nhập chúng vào... Mô hình 2.0 tăng cường khả năng tạo hình ảnh từ văn bản, khả năng đối thoại video và tạo video, các loại...
Whale Tech Stack
Nhật báo tin tức AI, 06-08-2026: Có tin đồn DeepSeek khởi động vòng gọi vốn thứ hai, định giá trước đầu tư khoảng 500 tỷ nhân dân tệ.
ByteDance Seed ra mắt mô hình lớn song công (full-duplex) âm thanh và video nguyên bản SeedRealtime8. Sand... Ban biên tập Machine Heart: Một trong những người từng tin tưởng nhất vào học tăng cường (reinforcement learning), nay lại cho rằng: Tăng cường...
AI Net
Tin nóng 24 giờ | Tại sao con người không có đuôi? Gen nhảy (jumping gene) này đã xóa bỏ đuôi của con người và mang lại những rủi ro bổ sung | Ngủ ngon mới có thể tăng tốc quá trình "giải độc" não! Các tế bào thần kinh giúp loại bỏ chất thải hiệu quả.
arXiv@Machine Heart: "Một bài báo nhìn lại bối cảnh và kỹ thuật của công nghệ tạo video từ văn bản Sora... Nhóm giáo sư phát hiện ra rằng, khi ngủ, không chỉ mạch máu hỗ trợ công việc làm sạch mà các tế bào thần kinh cũng thông qua...
Khoa học vòng quanh (Scientific Circle)
Khả năng hiểu hình ảnh của mô hình khuếch tán (diffusion model) đạt SOTA mới! Nhóm ByteDance và Fudan đề xuất chiến lược "Meta-Prompt" hoàn toàn mới.
Thông qua cơ chế chú ý chéo (cross-attention) để tích hợp gợi ý văn bản vào đặc trưng hình ảnh, từ đó hiện thực hóa việc tạo hình ảnh từ văn bản. Điều này... Nhóm giới thiệu: Nhóm Sáng tạo thông minh là nền tảng công nghệ AI & Đa phương tiện của ByteDance, bao phủ...
Xin Zhi Yuan
Thay trang phục, đổi khuôn mặt, người ảo, video hài hước - máy tính cá nhân đều có thể làm được - Kiểm tra và đề xuất các mô hình lớn AI cục bộ mới nhất hiện nay (tạo ảnh từ ảnh, tạo video từ ảnh).
Từ thời đại SD (Stable Diffusion) tạo ảnh từ văn bản đã chính thức bước sang thời đại tạo ảnh, tạo video, xin chia sẻ một chút kinh nghiệm... Đã nghiên cứu các mô hình lớn cục bộ và thấy không hề kém cạnh, xem qua một số mô hình trong các đánh giá uy tín...
Opsis
12345678 Trang sau
Tìm thấy khoảng 76 kết quả
Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.