T6 · 14/08

HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu82

CW-BASS v2: Giải pháp chọn nhãn giả dựa trên độ bão hòa cho mô hình phân đoạn bán giám sát

CW-BASS v2 giải quyết vấn đề bão hòa độ tin cậy khi dùng DINOv2 làm giáo viên trong phân đoạn bán giám sát, giúp cải thiện đáng kể hiệu suất trên các tập dữ liệu như ADE20K.

thị giác máy tínhhọc bán giám sátphân đoạn ảnhmô hình nền tảngDINOv2
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

H2R-Bench: Bộ tiêu chuẩn đánh giá mô hình thế giới trong việc chuyển đổi video thao tác từ người sang robot

H2R-Bench là bộ tiêu chuẩn mới giúp đánh giá khả năng chuyển đổi video thao tác từ góc nhìn người sang hành động của robot, tập trung vào tính nhất quán về vật lý và kỹ năng thực thi nhiệm vụ.

Robot họcMô hình thế giớiAI tạo sinhHọc máyH2R-Bench
IT Home
Sản phẩm65

Doubao Keyboard trên iOS cập nhật bản 1.5.0: Hỗ trợ đăng nhập và đồng bộ từ điển lên đám mây

Phiên bản 1.5.0 của Doubao Keyboard bổ sung tính năng đăng nhập tài khoản, cho phép đồng bộ từ điển định kỳ lên đám mây để tránh mất dữ liệu khi đổi thiết bị, đồng thời cải thiện trải nghiệm nhập liệu bằng giọng nói.

DoubaoiOSBàn phím AICập nhật ứng dụngĐồng bộ dữ liệu
IT Home
Tin ngành85

Khởi động xây dựng bộ tiêu chuẩn quốc gia về phương pháp thử nghiệm robot hình người tại Vũ Hán

Bộ tiêu chuẩn quốc gia về phương pháp thử nghiệm robot hình người đã chính thức được khởi động tại Vũ Hán với sự tham gia của các doanh nghiệp đầu ngành như Unitree và Xiaomi, nhằm thiết lập 'đề cương thi' chuẩn hóa cho ngành công nghiệp này.

Robot hình ngườiTiêu chuẩn quốc giaUnitreeXiaomiCông nghiệp AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

DreamX-Phi 1.0: Mô hình thế giới video điều khiển bằng hành động cho robot

DreamX-Phi 1.0 là mô hình thế giới video dự đoán trạng thái tương lai dựa trên hình ảnh, lệnh ngôn ngữ và chuỗi hành động. Mô hình tối ưu hóa khả năng điều khiển robot thông qua mã hóa hình học PRoPE và kỹ thuật duy trì tính nhất quán của vật thể.

RobotMô hình thế giớiThị giác máy tínhĐiều khiển robotAI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

Spatial Memory Agent: Tối ưu hóa suy luận không gian cho mô hình VLM mà không cần huấn luyện lại

Spatial Memory Agent (SMA) là khung tự tiến hóa giúp các mô hình VLM đóng băng cải thiện khả năng suy luận không gian thông qua việc đúc kết kinh nghiệm và đánh giá độ tin cậy, đạt hiệu suất vượt trội trên nhiều tiêu chuẩn đánh giá.

VLMThị giác máy tínhSuy luận không gianRobot thông minhHọc máy
Ant Ling (Ling)
Thủ thuật85

Tinh chọnAnt Group và ASystem hiện thực hóa quy trình huấn luyện hậu kỳ cho Agentic RL trên một máy đơn lẻ

Ant Group và ASystem đã kết hợp Ling-3.0-tiny cùng thuật toán GSPO để tối ưu hóa quy trình huấn luyện hậu kỳ cho Agentic RL. Kết quả thử nghiệm trên cờ caro cho thấy hiệu suất mô hình cải thiện rõ rệt, ổn định khả năng gọi công cụ và rút ngắn độ dài phản hồi.

Agentic RLAnt GroupHuấn luyện mô hìnhGSPOAI kỹ thuật
Baidu
Sản phẩm85

Baidu DaZi ra mắt phiên bản di động: Đồng bộ hóa trải nghiệm làm việc giữa điện thoại và máy tính

Ứng dụng Baidu DaZi vừa ra mắt bản di động, cho phép người dùng đồng bộ hóa lịch sử trò chuyện và tệp tin với máy tính. Người dùng có thể điều khiển máy tính từ xa để xử lý tài liệu, bảng tính hoặc mã nguồn ngay trên điện thoại một cách linh hoạt.

BaiduAI di độngNăng suấtĐồng bộ hóaCông cụ AI
Greg Brockman@gdb
Thủ thuật85

Kêu gọi chia sẻ trải nghiệm thực tế: ChatGPT đã giúp bạn tiết kiệm tiền như thế nào?

Greg Brockman từ OpenAI đang tìm kiếm các câu chuyện thực tế về việc sử dụng ChatGPT để cắt giảm chi phí, như phát hiện sai sót hóa đơn hay hủy các gói đăng ký không cần thiết. Hãy chia sẻ trải nghiệm của bạn để cùng cộng đồng tối ưu hóa tài chính cá nhân.

ChatGPTTài chính cá nhânMẹo AITiết kiệmNăng suất
Rohan Paul@rohanpaul_ai
Nghiên cứu88

Nghiên cứu Meta & Oxford: Mô hình đa phương thức chỉ cần 5% dữ liệu tạo ảnh để đạt hiệu suất tối ưu

Nghiên cứu chỉ ra rằng việc cân bằng tỷ lệ dữ liệu ngôn ngữ và hình ảnh giúp mô hình đa phương thức đạt hiệu suất cao hơn dù giảm 5 lần dữ liệu tạo ảnh. Đồng thời, việc đưa hình ảnh vào quá muộn dễ gây ra tình trạng 'lười thị giác', khiến mô hình quá phụ thuộc vào ngôn ngữ.

MetaĐa phương thứcHuấn luyện AIThị giác máy tínhNghiên cứu AI
IT Home
Tin ngành85

Tin đồn: Google DeepMind dừng phát triển mô hình tiên phong, đối mặt làn sóng sa thải lớn

Google DeepMind được cho là sẽ chuyển hướng từ các mô hình tiên phong sang các dòng Flash tối ưu chi phí. Quá trình tái cơ cấu này có thể dẫn đến việc cắt giảm tới 1/3 nhân sự, tập trung vào các vị trí dư thừa không trực tiếp tham gia vào công tác thuật toán.

GoogleDeepMindSa thảiAITin công nghệ

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (70 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả