Jiqizhixin
85

Nghiên cứu

V-RAE: Bước tiến mới trong việc tối ưu hóa không gian tiềm ẩn cho mô hình tạo video

(giờ Việt Nam)

Tóm tắt AI

Các nhà nghiên cứu từ NUS và Oxford giới thiệu V-RAE, phương pháp sử dụng các mô hình thị giác tiền huấn luyện để xây dựng không gian tiềm ẩn giàu ngữ nghĩa, giúp cải thiện hiệu quả tạo và dự đoán video thay vì chỉ tập trung vào tái tạo pixel truyền thống.

Bản dịch AI

Học thuật | Chỉ vài miếng dán đã khiến mạng thần kinh không nhận diện được biển báo giao thông, Berkeley tạo ra các mẫu đối kháng cho môi trường thực tế

Trích từ BAIR, Machine biên dịch, tham gia: Panda. Nhờ khả năng cảm nhận chi tiết và nhận diện phương hướng... Những kỹ thuật này liên quan đến việc tạo ra các mẫu đối kháng cho một mô hình đã biết theo cách hộp trắng (white-box),...

Machine

Mô hình Trung Quốc của "Lập tâm cho máy móc" và cơ hội tại Trùng Khánh

Thúc đẩy xã hội loài người suy ngẫm lại về "giá trị, văn minh, lòng người". Máy móc cần được lập tâm, con người... (4) Năng lực con người thoái hóa, quá phụ thuộc vào "Machine" khi AI tự nhiên hiểu thiện ác, biết...

Năng lượng của dịch vụ

Cú nhảy vọt cuối cùng của AI: Mô hình thế giới (World Model), không chỉ là "vẽ" nên một thế giới

Mọi người đều bị làm cho bối rối: Tạo video = Mô hình thế giới? Robot = Mô hình thế giới? Tự động... Nó có ba năng lực cốt lõi: Biểu diễn thế giới: Hiểu được trong môi trường có những gì, vật thể ở đâu, mối quan hệ...

Thunder AI (Lôi Điện Trí Tuệ Nhân Tạo)

Khi mô hình thế giới xuất hiện, các AI Trainer nên hiểu lại công việc của mình như thế nào?

Mô hình tạo ra một đoạn video, một robot vươn tay nắm lấy vật thể trên bàn. Với tư cách là một trainer... Năng lực cảm nhận thế giới là nền tảng không thể thiếu của trí tuệ hiện thân (Embodied AI). Dữ liệu từ camera cần phải...

Ai cũng là Product Manager

Cao Tuyết từ BV (Baidu Ventures): Không có gì là bất biến, đó chính là thiên mệnh của đầu tư AI

Đã đầu tư vào các công ty bao gồm Agibot, Westlake AI, Shengshu Technology, Molecular Mind, UDI... Sự tàn khốc nằm ở chỗ, năng lực của bản thân mô hình chắc chắn sẽ ngày càng mạnh hơn, nghĩa là các công ty khởi nghiệp...

Waves (Waves)

Từ "tạo video" đến "hiểu vật lý": VideoWorld 2 giúp mô hình "hiểu" thế giới thực!

Hàm mất mát (loss function) được ánh xạ vào không gian hành động thực tế của robot. Ràng buộc nghiêm ngặt: Trong CALVIN... Việc thô bạo tăng tham số mô hình, chỉ đơn thuần theo đuổi vẻ đẹp cấp độ pixel của video tạo ra không phải là con đường đúng đắn...

Extreme Vision

[Góc nhìn chuyên gia] Một bản kế hoạch kinh doanh hấp dẫn cần viết như thế nào? (Kèm ví dụ)

2. Tỷ lệ cổ phần chuyển nhượng cần được cân nhắc thận trọng, phải để lại đủ không gian khích lệ cho bản thân và đội ngũ... "Nền tảng Internet số 1 về người dùng tạo, chia sẻ và duyệt nội dung video" liệu có rõ ràng hơn không...

Insight Capital

Vượt qua V-JEPA! ThinkJEPA: Sử dụng mô hình lớn để "suy nghĩ" về quỹ đạo, hiện thực hóa dự đoán vật lý dài hạn ổn định hơn

Nó cho phép máy móc có thể dự đoán tương lai thông qua quan sát giống như con người, từ đó thực hiện lập kế hoạch và điều khiển. Những năm gần đây, các mô hình thế giới không gian ẩn (Latent World Model) tiêu biểu là V-JEPA...

PyTorch Chinese (PyTorch)

CVPR 2020 Oral | Giảm độ chính xác của hệ thống nhận diện người (re-ID) SOTA xuống còn 1,4%, Đại học Trung Văn Hồng Kông, DeepBlue AI và các đơn vị khác thách thức tính bền vững của khớp mẫu thị giác

Tác giả chuyên mục Machine: Hongjun Wang, Guangrun Wang, v.v. Hệ thống nhận diện người (re-ID) có mặt ở khắp mọi nơi, có thể tìm kiếm chính xác trong các video được quay từ các camera khác nhau...

Machine

12345678910 Trang sau

Tìm thấy khoảng 123 kết quả

Video GenerationV-RAEAI ResearchLatent SpaceComputer Vision
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.