Nghiên cứu & Luận văn
Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.
2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40
- Hugging Face Daily PapersT2 · 07/09 · 22:15
EditVid: Khung chỉnh sửa video thống nhất, không cần huấn luyện với độ chính xác vượt trội
EditVid là giải pháp đột phá cho phép chỉnh sửa video đa dạng từ thay đổi phong cách đến chèn đối tượng mà không cần huấn luyện lại mô hình, đạt hiệu suất vượt trội so với các phương pháp hiện có.
- Hugging Face Daily PapersT2 · 07/09 · 17:15
Giải mã tư duy của LLM: Cấu trúc hình học ẩn sau các chuỗi suy luận
Nghiên cứu này khám phá cách các mô hình ngôn ngữ lớn tổ chức các thao tác suy luận như phân tích mục tiêu và suy diễn trong không gian biểu diễn ẩn, chứng minh rằng các thao tác này có cấu trúc hình học riêng biệt và không phụ thuộc vào từ vựng.
- Hugging Face Daily PapersT2 · 07/09 · 17:15
TFO: Biến mô hình thị giác-ngôn ngữ (VLM) thành hệ thống hiểu âm thanh mà không cần huấn luyện lại
TFO là giải pháp plug-and-play cho phép tích hợp khả năng hiểu âm thanh vào các mô hình VLM đóng băng mà không cần thay đổi kiến trúc hay huấn luyện lại, giúp bảo toàn nguyên vẹn năng lực suy luận thị giác ban đầu.
- Hugging Face Daily PapersT2 · 07/09 · 14:45
HoloWorld: Bước đột phá trong tạo dựng thế giới đô thị 3D đồng nhất từ trong ra ngoài
HoloWorld là khung làm việc tiên phong giúp tạo dựng thế giới đô thị 3D liền mạch, kết nối chi tiết nội thất bên trong với kiến trúc ngoại thất thành một hệ thống thống nhất từ mô tả văn bản.
- JiQiZhiXinT2 · 07/09 · 14:30
MicrosoftArgus: AI Agent tự chủ giải quyết bài toán toán học 20 năm tuổi sau 1.548 giờ nghiên cứu
Microsoft cùng các đối tác giới thiệu Argus, hệ thống Agent đột phá có khả năng tự vận hành nghiên cứu dài hạn trong hàng nghìn giờ mà không cần con người can thiệp liên tục, đánh dấu bước tiến từ 'thực thi' sang 'tự ra quyết định' trong AI.
- Hugging Face Daily PapersT2 · 07/09 · 14:15
τ^τ-Bench: Thước đo thực tế cho khả năng xây dựng AI Agent từ đầu đến cuối
τ^τ-Bench là bộ tiêu chuẩn mới đánh giá khả năng của AI trong việc tự xây dựng các Agent thực tế, dựa trên các điều kiện khắt khe như dữ liệu doanh nghiệp, API sản xuất và giới hạn chi phí, thay vì chỉ giải quyết các bài toán lý thuyết.
- Hugging Face Daily PapersT2 · 07/09 · 10:00
Motion-Omni: Mô hình đối thoại AI tạo lời nói và cử chỉ toàn thân đồng bộ
Motion-Omni là khung làm việc end-to-end cho phép mô hình đối thoại tạo ra lời nói cùng cử chỉ cơ thể (mặt, tay, dáng đi) trực tiếp từ trạng thái ẩn, thay vì phải xử lý tách biệt như các phương pháp truyền thống.
- Hugging Face Daily PapersT2 · 07/09 · 09:15
RISE: Cải thiện mô hình ngôn ngữ thông qua chưng cất chính sách tự suy diễn
RISE là phương pháp mới giúp mô hình tự tạo ra 'giáo viên' từ quá trình huấn luyện RLVR của chính nó. Bằng cách ngoại suy các thay đổi tham số, phương pháp này chuyển đổi các phản hồi thưa thớt thành mục tiêu học tập dày đặc ở cấp độ token mà không cần mô hình bên ngoài.
- Hugging Face Daily PapersT2 · 07/09 · 09:00
Iris: Đột phá mới trong công nghệ tìm kiếm bằng AI
Giới thiệu Iris-mini và Iris-pro, hai tác nhân tìm kiếm thông minh được huấn luyện qua quy trình xây dựng dữ liệu từ cấu trúc siêu liên kết web, giúp giải quyết các truy vấn phức tạp mà mô hình truyền thống thường thất bại.
- Hugging Face Daily PapersT2 · 07/09 · 09:00
WorldSculpt: Kiến tạo thế giới 3D phức tạp từ video thực tế
WorldSculpt giải quyết bài toán tái tạo hàng trăm vật thể trong không gian 3D từ video, ngay cả khi chúng bị che khuất, giúp ứng dụng hiệu quả trong game, AR/VR và robot.
- JiQiZhiXinCN · 06/09 · 20:15
StarVLA ra mắt VLAct: Chỉ với 16 GPU, vượt mặt NVIDIA GR00T N1.6 với dữ liệu ít hơn 80%
Nhóm nghiên cứu StarVLA giới thiệu VLAct, mô hình nền tảng VLM tối ưu hóa khả năng học từ dữ liệu robot, đạt hiệu suất vượt trội trên RoboDojo và RoboCasa dù chỉ dùng 16 GPU và 20% lượng dữ liệu so với các đối thủ.
- JiQiZhiXinCN · 06/09 · 18:15
Từ 'Nhìn thấy người' đến 'Hành động như người': Tổng quan toàn diện về AI lấy con người làm trung tâm trong kỷ nguyên mô hình nền tảng
Nhóm nghiên cứu từ ĐH Bách khoa Hồng Kông công bố bài tổng quan toàn diện về AI lấy con người làm trung tâm, phân loại các khả năng từ nhận diện, mô phỏng đến trí tuệ hiện thân trong kỷ nguyên mô hình nền tảng.
- JiQiZhiXinT7 · 05/09 · 22:15
VLA-Corrector: Giải pháp 40M tham số giúp robot 'tỉnh táo' hơn khi thực hiện hành động
Nhóm nghiên cứu từ ĐH Chiết Giang và Alibaba DAMO Academy đã phát triển VLA-Corrector, một mô hình nhẹ giúp robot phát hiện và sửa lỗi kịp thời trong các khoảng mù hành động, thay vì mù quáng thực hiện chuỗi lệnh cũ.
- JiQiZhiXinT7 · 05/09 · 18:15
Khi AI tự nghiên cứu chính mình: Mechanist mở ra kỷ nguyên khoa học cơ chế trí tuệ máy
Mechanist là dự án tiên phong cho phép AI tự đặt giả thuyết, thiết kế thí nghiệm và kiểm chứng để giải mã cách các mô hình ngôn ngữ lớn học tập và suy luận, thay vì phụ thuộc hoàn toàn vào con người.
- JiQiZhiXinT7 · 05/09 · 14:15
ECCV 2026: ART - Đột phá giới hạn trong công nghệ chuyển đổi trang điểm kỹ thuật số
Nghiên cứu từ vivo và các đại học hàng đầu giới thiệu ART, phương pháp mới giúp chuyển đổi chính xác các kiểu trang điểm phức tạp như kim tuyến hay họa tiết nghệ thuật mà vẫn giữ nguyên cấu trúc khuôn mặt và danh tính người dùng.
- QbitAIT7 · 05/09 · 12:00
Mô hình thế giới 'nghỉ hưu' sau khi huấn luyện: Bí quyết giúp robot làm việc hiệu quả hơn
Một phương pháp huấn luyện đột phá cho phép robot vận hành linh hoạt và thông minh hơn bằng cách tối ưu hóa cách thức mô hình thế giới được áp dụng.
- QbitAIT7 · 05/09 · 08:30
Cựu sinh viên lớp Diêu (Yao Class) dẫn dắt: Claude lần đầu tiên chứng minh thành công Định lý lớn Fermat
Đội ngũ nghiên cứu do các cựu sinh viên lớp Diêu dẫn dắt đã sử dụng Claude để hoàn thiện chứng minh hình thức đầu tiên cho Định lý lớn Fermat, với sự hỗ trợ then chốt từ công cụ Harness.
- Hugging Face Daily PapersT7 · 05/09 · 08:30
RoboTok: Công cụ khai thác dữ liệu từ Internet để huấn luyện robot thao tác khéo léo
RoboTok là hệ thống đột phá giúp trích xuất các video thao tác của con người từ Internet để huấn luyện robot, giải quyết bài toán thiếu hụt dữ liệu thực tế thông qua không gian chuyển động 3D linh hoạt.
- Anthropic: Research (công bố - Web)T7 · 05/09 · 01:58
Claude lập kỳ tích: Tự động chứng minh Định lý Fermat trong 11 ngày
Anthropic công bố Claude đã hoàn thành chứng minh máy tính đầu tiên cho Định lý Fermat chỉ trong 11 ngày, thông qua việc viết 13 triệu dòng mã Lean và xác thực gần 30.000 định lý trung gian.
- JiQiZhiXinT7 · 05/09 · 00:15
Meta công bố HumanCLAW: Đưa mô hình nền tảng vào tầng quyết định của robot
HumanCLAW tách biệt việc ra quyết định cấp cao và điều khiển vận động, giúp đánh giá chính xác khả năng 'trí tuệ hành động' của các mô hình ngôn ngữ thị giác (VLM) trong môi trường vật lý thực tế.