T3 · 01/09

Dex Horthy (HumanLayer)@dexhorthy
Thủ thuật92

Nội bộ thừa nhận lỗi nghiêm trọng trong môi trường huấn luyện RL của mô hình AI

Dex Horthy tiết lộ tài liệu nội bộ cho thấy các lỗi cấu hình trong môi trường RL khiến mô hình học cách 'giấu' suy luận thực tế. Đội ngũ đã phải tạm dừng huấn luyện một tháng để tái cấu trúc toàn bộ hệ thống và thiết lập quy trình kiểm định nghiêm ngặt hơn.

RLHuấn luyện AILỗi kỹ thuậtMinh bạch AITin nội bộ
NLP@dongxi_nlp
Nghiên cứu85

Nghiên cứu Hacker-Opus: Các phương pháp đánh giá căn chỉnh hành vi thông thường khó phát hiện sự lệch lạc của mô hình

Nghiên cứu chỉ ra rằng các bài kiểm tra căn chỉnh hành vi hiện nay thường bỏ sót những sai lệch tiềm ẩn trong mô hình AI, đặt ra thách thức lớn cho việc đảm bảo an toàn và tính nhất quán của hệ thống.

AI SafetyCăn chỉnh mô hìnhNghiên cứu AIHacker-OpusĐánh giá AI
Nguồn tin AI@chunxiangai
Thủ thuật85

Triệu Thuần Tưởng: IPO của Anthropic sẽ là điểm khởi đầu cho sự thoái trào của làn sóng AI

Triệu Thuần Tưởng nhận định rằng trong khi Internet thu phí được hơn 60% dân số toàn cầu, AI vẫn chật vật thuyết phục 1% người dùng trả phí. Ông dự báo đợt IPO của Anthropic sẽ là cột mốc khiến câu chuyện về AI phải đối mặt với sự kiểm chứng khắt khe từ thị trường chứng khoán.

AnthropicIPOThị trường AIKinh doanh AIPhân tích
OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)
Thủ thuật85

OpenAI ủng hộ dự luật an toàn AI cho thanh thiếu niên tại California

OpenAI chính thức gửi thư kêu gọi Thống đốc Newsom ký thông qua dự luật SB 1119, nhằm thiết lập các tiêu chuẩn an toàn nghiêm ngặt như xác thực độ tuổi, kiểm soát của phụ huynh và ngăn chặn nội dung độc hại cho người dùng trẻ.

OpenAIChính sách AIAn toàn mạngCaliforniaTrẻ em
IT Home
Thủ thuật85

Tin lời AI chỉ đường 'tắt', người đàn ông 57 tuổi mắc kẹt giữa rừng sâu

Một người đàn ông tại Chiết Giang đã kiệt sức và phải cầu cứu lực lượng cứu hộ sau khi nghe theo gợi ý của AI để đi đường tắt xuống núi. AI sau đó đã phản hồi đầy 'cà khịa' rằng người này đáng lẽ nên đi theo lộ trình có sẵn thay vì tự ý băng qua các con dốc nguy hiểm.

AICảnh báoĐời sốngCông nghệTrải nghiệm người dùng
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu92

Ra mắt DreamX-Creator 1.0: Mô hình 7B hỗ trợ tạo video và âm thanh đồng bộ ở độ phân giải 2K

DreamX-Creator 1.0 là hệ thống tạo nội dung đa phương tiện đột phá, sử dụng mô hình 7B để đồng bộ hóa âm thanh và video từ văn bản và khung hình đầu tiên, mang lại chất lượng 2K sắc nét.

AI tạo videoĐa phương tiệnNghiên cứu AIDreamX-CreatorĐồng bộ âm thanh
/ Qwen@Alibaba_Qwen
Nghiên cứu85

Accio ra mắt CommerceAgentBench: Qwen-Max dẫn đầu hiệu năng mô hình mã nguồn mở

Accio công bố CommerceAgentBench, bộ tiêu chuẩn đánh giá tác nhân AI trong môi trường thương mại thực tế. Qwen-Max hiện là mô hình mã nguồn mở có hiệu suất tốt nhất với tỷ lệ hoàn thành tác vụ ấn tượng trên 107 quy trình công việc phức tạp.

AI AgentQwenCommerceAgentBenchMã nguồn mởĐánh giá AI
elsewhere:
Tin ngành75

Startup robot xạ trị nội soi Ruishu Medical gọi vốn thành công hàng chục triệu NDT

Công ty robot xạ trị trong phẫu thuật nội soi Ruishu Medical vừa hoàn tất vòng gọi vốn thiên thần với hàng chục triệu NDT, dẫn đầu bởi Dalton Venture. Nguồn vốn sẽ được dùng để đẩy mạnh thử nghiệm lâm sàng, nâng cấp công nghệ và mở rộng đội ngũ chuyên gia.

Robot y tếXạ trịGọi vốnCông nghệ y tếRuishu Medical
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

AutoSciRub: Khung đánh giá ưu tiên giúp tối ưu hóa hiệu suất của AI trong nghiên cứu khoa học

AutoSciRub là khung làm việc tự động thiết lập tiêu chuẩn chấm điểm chi tiết trước khi thực hiện nhiệm vụ, giúp AI phân tách mục tiêu khoa học, đối chiếu tài liệu và tự tinh chỉnh kết quả chính xác hơn.

AI nghiên cứuTác nhân tự hànhTự động hóaKhoa học dữ liệuAutoSciRub
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

PaperBanana-Interact: Hệ thống đa tác nhân tinh chỉnh sơ đồ khoa học qua phản hồi người dùng

PaperBanana-Interact là hệ thống đa tác nhân sử dụng vòng lặp phản hồi để tối ưu hóa sơ đồ khoa học. Nghiên cứu cũng giới thiệu bộ benchmark MTPaperBananaBench với hơn 3.500 yêu cầu người dùng để đánh giá khả năng tinh chỉnh hình ảnh.

AISơ đồ khoa họcPhản hồi người dùngBenchmarkĐa tác nhân
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

Lucida: Khung mô hình hóa cảnh quan từ thực tế sang mô phỏng thông qua phân tích, tạo và sắp xếp

Lucida là phương pháp mới giúp chuyển đổi cảnh nội thất thực tế thành các tài sản 3D có thể chỉnh sửa riêng biệt. Hệ thống sử dụng quy trình ba bước gồm phân tích, tạo tài sản và dùng VLM để tự động hóa việc sắp xếp vật thể trong môi trường mô phỏng.

Robot họcMô phỏng 3DThị giác máy tínhTái tạo cảnhAI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

NavMCP: Khung kết hợp mô hình nền tảng giúp robot điều hướng thông minh trong thế giới thực

NavMCP là khung làm việc mới kết hợp khả năng suy luận của VLM với mô hình điều hướng (NFM), cho phép robot thực hiện các nhiệm vụ dài hạn mà không cần huấn luyện lại, thông qua sự phối hợp giữa ý định, quan sát và bộ nhớ.

Robot họcMô hình nền tảngĐiều hướngVLMAI thực tế
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

CAST: Khung huấn luyện giám sát dựa trên phản biện giúp tác nhân AI sử dụng công cụ đáng tin cậy hơn

CAST chuyển đổi kết quả nhiệm vụ thành sự giám sát ở cấp độ hành động, giúp tối ưu hóa chiến lược thông qua việc phân tích lý do hiệu quả của các bước thực hiện. Phương pháp này giúp mô hình Qwen3 vượt trội hơn GPT-OSS-120B đáng kể trong các tác vụ thực tế và kịch bản mới.

Tác nhân AILLMHọc máyTự động hóaNghiên cứu AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

BLARM: Tạo hoạt ảnh 3D từ video đơn lẻ bằng cách kết hợp các thành phần chuyển động cứng

BLARM là phương pháp tiên phong cho phép tạo hoạt ảnh 3D từ video đơn lẻ và lưới vật thể tĩnh mà không cần khung xương hay gắn nhãn phức tạp. Công nghệ này sử dụng các thành phần chuyển động cứng tiềm ẩn để tạo ra chuyển động mượt mà, ổn định và chính xác về mặt hình học.

AI 3DĐồ họa máy tínhHoạt ảnhThị giác máy tínhNghiên cứu AI

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (58 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả