T7 · 22/08

NLP@dongxi_nlp
Nghiên cứu85

TRACES: Tiêu chuẩn mới đánh giá khả năng suy luận và tính minh bạch của AI

TRACES là bộ tiêu chuẩn đánh giá AI dựa trên quy trình nghiên cứu có bằng chứng, thay vì chỉ kiểm tra kết quả cuối cùng. Nó theo dõi toàn bộ chuỗi từ lập kế hoạch đến sửa lỗi, giúp đảm bảo tính minh bạch và khả năng kiểm chứng trong các tác vụ phức tạp như thử nghiệm lâm sàng.

AIĐánh giá AINghiên cứu AIMinh bạch AITRACES
Rohan Paul@rohanpaul_ai
Tin ngành85

Chó dẫn đường robot tự tin dẫn lối hành khách tại sân bay

Tại Hội nghị Robot Thế giới 2026, một chú chó dẫn đường robot đã chứng minh khả năng điều hướng xuất sắc khi dẫn lối thành công qua nhà ga sân bay đông đúc. Công nghệ này hứa hẹn sẽ trở thành giải pháp hỗ trợ chi phí thấp, cải thiện đáng kể cuộc sống cho người cao tuổi và người khiếm thị.

RobotCông nghệ hỗ trợAIRobot dẫn đườngĐời sống
Elon Musk@elonmusk
Thủ thuật92

Grok Bot học cách làm việc của người dùng qua video quay màn hình

Grok Bot hiện có khả năng phân tích video quay màn hình kèm giọng nói để hiểu quy trình làm việc, tự động tối ưu hóa tệp tin và đưa ra phản hồi cải thiện công việc. Đây được kỳ vọng là bước ngoặt giúp người dùng phổ thông tiếp cận dễ dàng hơn với các tác nhân AI.

GrokxAIAI AgentNăng suấtCông nghệ mới
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩm85

Munder Difflin: Công cụ mã nguồn mở giúp bạn xây dựng 'văn phòng' AI từ các bản sao cá nhân

Munder Difflin là công cụ đa tác nhân mã nguồn mở cho phép bạn vận hành một 'văn phòng' gồm các bản sao AI ngay trên máy tính cá nhân. Nó tích hợp 11 CLI AI phổ biến như Claude Code và Copilot để tự động hóa công việc hiệu quả.

AI AgentMã nguồn mởTự động hóaCông cụ lập trìnhNăng suất
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Pandora's Router: Giải pháp tối ưu chi phí khi điều hướng truy vấn cho mô hình AI

Google DeepMind giới thiệu Pandora's Router, phương pháp điều hướng thông minh giúp giảm thiểu chi phí bằng cách chỉ kích hoạt các mô hình mạnh khi cần thiết. Hệ thống này tối ưu hóa đáng kể hiệu suất và chi phí vận hành trên các tác vụ như MATH và RAG.

DeepMindLLMTối ưu chi phíAI ResearchModel Routing
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Nghiên cứu cảnh báo: Dữ liệu khảo sát tổng hợp từ LLM chưa thể thay thế con người

Một nghiên cứu tâm lý học cho thấy LLM chỉ mô phỏng được xu hướng chung chứ không tái hiện chính xác phân phối câu trả lời của con người. Các mô hình huấn luyện bằng dữ liệu AI có hiệu suất dự báo kém, cho thấy LLM chỉ phù hợp cho các khảo sát thử nghiệm chi phí thấp.

LLMNghiên cứu AIDữ liệu tổng hợpTâm lý họcĐộ tin cậy
IT Home
Sản phẩm85

Ra mắt 'Galaxy Star', robot chơi tennis tự hành đầu tiên trên thế giới

Galaxy General vừa giới thiệu robot 'Galaxy Star' cao 1,75m, sử dụng thuật toán học tăng cường để tự học kỹ năng tennis mà không cần lập trình sẵn. Robot có khả năng phản xạ trong 0,1 giây và duy trì đánh bền hơn 20 lượt, vừa có màn trình diễn ấn tượng cùng tay vợt nổi tiếng Trịnh Khiết.

RobotAITennisCông nghệRobot hình người
IT Home
Tin ngành92

Tinh chọnKhai mạc Thế vận hội Robot hình người lần 2: Hơn 2.000 robot tranh tài, phá kỷ lục chạy của con người

Thế vận hội Robot hình người lần thứ 2 chính thức khởi tranh với 2.056 robot từ 666 đội tham gia. Đáng chú ý, các robot như Tiangong Ultra đã phá vỡ kỷ lục chạy 100m của Usain Bolt, đánh dấu bước tiến vượt bậc về khả năng vận hành tự chủ hoàn toàn.

Robot hình ngườiAICông nghệTiangongSự kiện công nghệ

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (56 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả