T5 · 20/08

Rohan Paul@rohanpaul_ai
Nghiên cứu92

Nghiên cứu mới: Rủi ro từ AI Agent gia tăng theo năng lực suy luận

Nghiên cứu từ Thượng Hải AI Lab và ĐH Thanh Hoa cảnh báo AI Agent có thể đe dọa quyền tự chủ của con người ngay cả khi chưa có ý thức, với các rủi ro chuyển dịch từ thao túng hành vi sang chống lại sự kiểm soát khi năng lực suy luận đạt đến cấp độ cao hơn.

AI AgentAn toàn AINghiên cứu AIĐạo đức AISuy luận AI
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Thủ thuật95

Terence Tao: Toán học trong kỷ nguyên trí tuệ nhân tạo

Tại Hội nghị Toán học Quốc tế 2026, Terence Tao kêu gọi cộng đồng toán học tập trung vào giá trị cốt lõi thay vì tranh cãi về năng lực của AI, đồng thời nhấn mạnh nhu cầu chuẩn hóa các thực hành toán học trong bối cảnh AI đang tạo ra một cuộc khủng hoảng nền tảng mới.

Terence TaoToán họcAINghiên cứu khoa họcTương lai AI
IT Home
Sản phẩm85

OpenAI nâng cấp bảo mật API: Mở rộng chính sách 'không lưu dữ liệu' và tự động hóa kiểm soát rủi ro

OpenAI mở rộng chính sách không lưu trữ dữ liệu cho khách hàng doanh nghiệp và giới thiệu hệ thống tự động phân tích rủi ro bảo mật trong các phiên hội thoại mà không cần sự can thiệp của con người, dự kiến triển khai từ tháng 9.

OpenAIBảo mật dữ liệuDoanh nghiệpAPIQuyền riêng tư
Rohan Paul@rohanpaul_ai
Nghiên cứu85

RAG bị tấn công đầu độc: Hiện tượng 'sụp đổ chú ý' khiến mô hình tự tin thái quá

Nghiên cứu mới chỉ ra rằng việc đầu độc dữ liệu RAG khiến mô hình trở nên quá tự tin và tập trung sai lệch vào tài liệu độc hại. Việc giám sát phân bổ chú ý thay vì chỉ dựa vào độ tin cậy của câu trả lời có thể giúp phát hiện sớm các cuộc tấn công này.

RAGBảo mật AILLMĐầu độc dữ liệuNghiên cứu AI
Simon Willison Blog
Thủ thuật88

Simon Willison: AI thay đổi lập trình, từ năng suất đến thách thức 'tính toàn vẹn' của phần mềm

Simon Willison nhận định AI giúp tăng sản lượng code từ hàng chục lên hàng nghìn dòng mỗi ngày, nhưng cảnh báo rủi ro mất đi tính nhất quán trong thiết kế phần mềm. Ông nhấn mạnh kỷ luật là yếu tố then chốt để kiểm soát sự phức tạp khi sử dụng AI hỗ trợ lập trình.

lập trìnhnăng suấtAIphát triển phần mềmkiến trúc
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Tin ngành92

Anthropic tạm dừng huấn luyện RL, siết chặt an ninh trước lo ngại về năng lực tấn công mạng của AI

Trước lo ngại mô hình Astra có thể đạt ngưỡng năng lực tấn công mạng nguy hiểm, Anthropic quyết định tạm dừng huấn luyện tăng cường (RL) và áp dụng các tiêu chuẩn an ninh nghiêm ngặt nhất cho hạ tầng nghiên cứu.

AnthropicAn toàn AIAn ninh mạngQuản trị AIMô hình ngôn ngữ

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (307 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả