Nghiên cứu
Fable5 chỉ đạt 3,5% điểm: AI hiện nay biết nhìn ảnh nhưng thiếu tư duy thị giác chủ động
(giờ Việt Nam)
Tóm tắt AI
Nghiên cứu mới chỉ ra rằng các mô hình AI lớn hiện nay vẫn thiếu khả năng 'quan sát chủ động' như con người. Nhóm tác giả giới thiệu ActiveVision, bộ tiêu chuẩn đánh giá khả năng quét, theo dõi và so sánh thuộc tính hình ảnh phức tạp của AI.
Bản dịch AI
Bài viết dài vạn chữ: Tiến sĩ CV tại Đại học Columbia tổng kết 5 năm nghiên cứu, chuẩn bị nhận vị trí Trợ lý Giáo sư tại Đại học Quốc gia Singapore (NUS)
Nguồn đăng lại từ Machine, tác giả trên Zhihu: Mike Shou. Trong bài viết này, Columbia... Thực ra mọi người vẫn chưa định nghĩa rõ vấn đề này; nhớ lại hồi đó thầy hướng dẫn nói, if you can...
Machine
Chiến lượcOffice tích hợp mô hình ngôn ngữ lớn, GPT-4 mở ra kỷ nguyên mới cho AI
ChatGPT có thể chủ động thừa nhận sai lầm, nếu người dùng chỉ ra lỗi sai, mô hình sẽ lắng nghe ý kiến... Năng lực tính toán cần thiết để huấn luyện mô hình GPT-3.5 lên tới 3640 PF-days, tức là một nghìn triệu tỷ phép tính mỗi giây...
Nghiên cứu chiến lược
Robot bốn chân + BIM + mô hình thị giác: "Xe tự lái" cho công trường xây dựng
Họ đã phát triển một hệ thống tự động hóa tích hợp robot bốn chân, BIM và mô hình ngôn ngữ thị giác... Bức tường trên bản vẽ có thể chưa được xây, còn chướng ngại vật không có trên bản vẽ lại có thể chắn ngang đường. Môi trường...
Phòng kỹ thuật gyj
AI của bạn có thể "ra tay" thực hiện? Benchmark CHAIN tiết lộ điểm yếu chí mạng trong suy luận vật lý của các mô hình lớn!
Nhưng nếu bạn thực sự giao các bước mà nó tạo ra cho một robot thực hiện, kết quả sẽ ra sao... Các mô hình ngôn ngữ - thị giác (VLM) mà chúng ta tự hào, trong các bài kiểm tra hỏi đáp thị giác (VQA) tĩnh...
Công nghệ tiên phong AIGC
Hé lộ FutureVLA | Tách biệt thị giác - vận động, hiệu suất robot tăng vọt 21,7%!
Điều này tưởng chừng trực quan, nhưng mô hình sẽ lãng phí lượng lớn năng lực tính toán vào việc dự đoán các chi tiết thị giác không quan trọng... Hành động của robot là liên tục và mượt mà, kiểu dự đoán "nhảy khung hình" này phá hủy nghiêm trọng tính thời gian...
Cộng đồng nghiên cứu trí tuệ hiện thân (Embodied AI)
Trải nghiệm thực tế 5 mô hình lớn mã nguồn mở nhẹ có thể chạy trên laptop: Ngoài Qwen3.5, còn có những "kho báu" này
Sau khi Qwen3.5 trở nên nổi tiếng, nhiều người mới nhận ra: Hóa ra không cần tốn tiền gọi API cho các mô hình lớn... Logic trả lời rõ ràng, gần như không có "vị AI". Tạo mã: Python crawler viết ra...
Trí tuệ nhân tạo và phân tích dữ liệu lớn
Trước khi gia nhập Đại học Quốc gia Singapore, tiến sĩ thị giác máy tính tại Đại học Columbia tổng kết 5 năm sự nghiệp nghiên cứu
Học kỳ đầu tôi còn học máy học, môn mà trước đó tôi chưa từng học một cách hệ thống, sau khi học xong... Vừa làm vừa học, tôi đã làm quen với các mô hình và khung xử lý video, thu hoạch được rất nhiều. Sau cuộc thi...
Đánh giá công nghệ AI
Sương mù, đêm tối, cảm biến mất tác dụng? Mô hình lớn đa phương thức giúp xe tự lái "nhìn" rõ ràng hơn!
Cập nhật không giới hạn các bài báo, tin tức, mã nguồn mở trong lĩnh vực xe tự lái, robot, mô hình lớn... Đây chính là thách thức cốt lõi mà các hệ thống hỏi đáp thị giác cho xe tự lái hiện nay đang phải đối mặt. Các mô hình đa phương thức hiện có...
AI Zhi Xiaolong
Sự thật mới về nuôi dạy con trong thời đại AI: Kỹ năng quan trọng hơn cả bằng cấp mà 90% phụ huynh vẫn chưa biết!
Các loại robot lần lượt xuất hiện, có thể nhảy ngựa, luyện võ, "đấu trí" với trẻ; có thể đồng hành... Cũng có các hình ảnh mô hình 3D tinh xảo do máy tính vẽ. Mỗi trang đều là một tác phẩm thị giác, từng chi tiết...
Hiệu sách Shidian
Mô hình lớn truy xuất đa phương thức Agentic đầu tiên đã xuất hiện! Nhóm nghiên cứu Đại học Thanh Hoa giúp AI vừa suy luận vừa chủ động xem hình, độ chính xác tăng 23%
Để mô hình lớn đa phương thức học cách chủ động sử dụng công cụ thị giác khi truy xuất để xác minh chi tiết, thay vì... 73,5%, cao hơn lần lượt 13 và 10 điểm phần trăm so với U-MARVEL-7B. Điều này kiểm chứng...
DeepTech
1 2 3 4 5 Trang tiếp theo
Tìm thấy khoảng 43 kết quả
Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.