T3 · 01/09

HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

Lucida: Khung mô hình hóa cảnh quan từ thực tế sang mô phỏng thông qua phân tích, tạo và sắp xếp

Lucida là phương pháp mới giúp chuyển đổi cảnh nội thất thực tế thành các tài sản 3D có thể chỉnh sửa riêng biệt. Hệ thống sử dụng quy trình ba bước gồm phân tích, tạo tài sản và dùng VLM để tự động hóa việc sắp xếp vật thể trong môi trường mô phỏng.

Robot họcMô phỏng 3DThị giác máy tínhTái tạo cảnhAI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

NavMCP: Khung kết hợp mô hình nền tảng giúp robot điều hướng thông minh trong thế giới thực

NavMCP là khung làm việc mới kết hợp khả năng suy luận của VLM với mô hình điều hướng (NFM), cho phép robot thực hiện các nhiệm vụ dài hạn mà không cần huấn luyện lại, thông qua sự phối hợp giữa ý định, quan sát và bộ nhớ.

Robot họcMô hình nền tảngĐiều hướngVLMAI thực tế
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

CAST: Khung huấn luyện giám sát dựa trên phản biện giúp tác nhân AI sử dụng công cụ đáng tin cậy hơn

CAST chuyển đổi kết quả nhiệm vụ thành sự giám sát ở cấp độ hành động, giúp tối ưu hóa chiến lược thông qua việc phân tích lý do hiệu quả của các bước thực hiện. Phương pháp này giúp mô hình Qwen3 vượt trội hơn GPT-OSS-120B đáng kể trong các tác vụ thực tế và kịch bản mới.

Tác nhân AILLMHọc máyTự động hóaNghiên cứu AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

BLARM: Tạo hoạt ảnh 3D từ video đơn lẻ bằng cách kết hợp các thành phần chuyển động cứng

BLARM là phương pháp tiên phong cho phép tạo hoạt ảnh 3D từ video đơn lẻ và lưới vật thể tĩnh mà không cần khung xương hay gắn nhãn phức tạp. Công nghệ này sử dụng các thành phần chuyển động cứng tiềm ẩn để tạo ra chuyển động mượt mà, ổn định và chính xác về mặt hình học.

AI 3DĐồ họa máy tínhHoạt ảnhThị giác máy tínhNghiên cứu AI
MarkTechPost
Sản phẩm75

Gradium AI ra mắt mô hình TTS mặc định mới: Tỷ lệ xử lý khó đạt 81%, độ trễ chỉ 216ms

Gradium AI vừa cập nhật mô hình chuyển đổi văn bản thành giọng nói (TTS) mặc định cho nền tảng, giúp cải thiện đáng kể tốc độ phản hồi và độ chính xác mà không làm gián đoạn các giọng nói tùy chỉnh hiện có của người dùng.

TTSAICông nghệ giọng nóiGradiumAICập nhật công nghệ
OpenClaw@openclaw
Sản phẩm75

OpenClaw 2.0 ra mắt: Cải tiến lớn nhất là biến việc cài đặt trở nên... nhàm chán

OpenClaw 2.0 chính thức phát hành với trọng tâm là tối ưu hóa quy trình thiết lập. Đội ngũ phát triển khẳng định việc loại bỏ các rắc rối khi cài đặt sẽ giúp người dùng tập trung hoàn toàn vào những trải nghiệm sáng tạo thú vị hơn.

OpenClawCông cụ AICập nhật phần mềmTrải nghiệm người dùng
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu92

Đề xuất khung L0-L4: Lộ trình giúp mô hình suy luận AI vượt xa sự giám sát của con người

Nghiên cứu giới thiệu khung 5 cấp độ (L0-L4) giúp các mô hình suy luận lớn (LRM) tự tiến hóa mà không cần sự can thiệp của con người, thông qua việc tự động hóa quá trình xác thực và tạo lộ trình học tập.

AI suy luậnTự họcHọc tăng cườngNghiên cứu AISiêu trí tuệ
Charlie Holtz@charlieholtz
Thủ thuật85

Charlie Holtz: Môi trường lập trình đám mây sẽ sớm thay thế thiết lập cục bộ

Charlie Holtz nhận định sự trỗi dậy của các AI Agent đang thúc đẩy mạnh mẽ quá trình chuyển dịch sang môi trường lập trình đám mây. Ông dự đoán trong năm tới, các 'cloud factories' sẽ trở thành tiêu chuẩn giúp các đội ngũ lập trình cộng tác công khai và hiệu quả hơn.

Lập trìnhCloudAI AgentXu hướng công nghệPhát triển phần mềm
Ming-Chi Kuo@mingchikuo
Thủ thuật85

Ming-Chi Kuo: MediaTek và Nvidia nâng tầm hợp tác, chuyển dịch từ thiết kế chip sang hệ thống AI

Chuyên gia Ming-Chi Kuo nhận định việc MediaTek và Nvidia đẩy mạnh hợp tác cho thấy MediaTek đã nâng cấp chiến lược kinh doanh AI từ thiết kế IC/ASIC đơn thuần lên quy mô hệ thống (rack-scale), khẳng định vị thế mới trong chuỗi cung ứng.

MediaTekNvidiaBán dẫnHạ tầng AIMing-Chi Kuo

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (42 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả