Jiqizhixin
95

Nghiên cứu

Chấn động giới AI: Nghiên cứu 116 trang tiết lộ cách 'trích xuất' tư duy ẩn của Claude và GPT

(giờ Việt Nam)

Tóm tắt AI

Một nghiên cứu mới chỉ ra lỗ hổng bảo mật nghiêm trọng trên các API mô hình lớn, cho phép kẻ xấu trích xuất toàn bộ chuỗi tư duy (reasoning traces) vốn được các hãng như OpenAI hay Anthropic mã hóa để bảo mật.

Bản dịch AI

Tội lỗi của văn bản dài: Kỹ thuật jailbreak mới từ đội ngũ Claude, từ Llama 2 đến GPT-4 không ai thoát khỏi

Báo cáo từ Machine Heart. Tác giả: Đỗ Vĩ, Trần Bình. Anthropic đã phát hiện một lỗ hổng jailbreak kiểu mới... có hiệu quả với các mô hình của các công ty AI, bao gồm Claude 2.0, GPT-3.5 và GPT-4...

Machine Heart

Andrew Ng: Đừng chỉ chăm chăm vào GPT-5, dùng GPT-4 để tạo ra một Agent có thể đạt được hiệu quả của GPT-5 sớm hơn

Báo cáo từ Machine Heart, Ban biên tập Machine Heart. Tiềm năng của AI Agent có đang bị đánh giá thấp? AI Agent là... Thẳng thắn mà nói, tôi rất mong chờ Claude 4, GPT-5 và Gemini 2.0, cũng như...

Machine Heart

"Ông tổ thuật toán" 88 tuổi kinh ngạc! Claude kết hợp cùng GPT giải quyết bài toán 30 năm, bài báo 14 trang không cần sửa đổi

"Ông tổ thuật toán" 88 tuổi Donald Knuth cập nhật bài báo mới, Claude 4.6 + GPT-5.4 đã cùng nhau giải mã trường hợp chẵn lẻ. Thậm chí, GPT-5.4 còn trực tiếp xuất bản một bài báo dài 14 trang, gây bùng nổ toàn mạng. 88...

New Zhiyuan

Giải mã chuyên sâu bài báo quan trọng của OpenAI: "Nội tâm" của GPT-5 và DeepSeek bị phơi bày, bên ngoài bình tĩnh như không, bên trong hoảng loạn tột độ

(Claude 3.7, GPT-5 và các dòng khác) liệu có khả năng "ngụy trang quá trình suy nghĩ" của chính mình... May mắn thay, bài báo này đã dùng dữ liệu vững chắc để nói với cộng đồng bảo mật rằng: Mọi người đừng hoảng! AI hiện tại...

Tommy Learning Log

Hướng dẫn nhập môn Claude từ 0 đến 1: Sổ tay sử dụng trợ lý AI mạnh nhất năm 2026

Bạn có thể tải lên toàn bộ cuốn sách, bài báo dài, kho mã nguồn lớn cùng một lúc - các AI khác có thể chỉ xử lý được vài chục nghìn từ, nhưng Claude có thể xử lý hàng triệu từ. 2. Khả năng suy luận mạnh mẽ hơn - trong số...

Wo Fei (Tôi bay)

Top 10 bài báo AI tuần này: Các Agent đồng loạt "thức tỉnh", nhân loại bị ARC-AGI-3 nghiền nát với tỷ số 100:1

Claudini: Claude tự thực hiện Red Teaming, đánh bại hơn 30 phương pháp của con người. Bài báo:... Cộng đồng bảo mật có thể trực tiếp sử dụng để xây dựng phòng tuyến. Tóm tắt trong một câu: Hiểu rõ nhất điểm yếu của AI...

Xin chào Wall-E

Các "ông lớn" gây chuyện! AI viết bài báo cũng biết P-hacking, nói rằng nó đã học được các chiêu trò P-hacking của con người, rồi sau đó lại nói là không.

Hôm nay muốn nói về việc AI viết bài báo mà cũng biết P-hacking. Scott... GPT-4o trong quá trình phân loại đã nhận diện thêm được 87 bài báo về Triple-DID (Sai biệt trong sai biệt bậc ba)...

Vòng tròn Kinh tế lượng

Attention is all you need | Tổ tiên của GPT, Claude trông như thế nào? Một bài viết phân tích thấu đáo bài báo đã thay đổi thế giới AI

Bài báo này đã trực tiếp khai sinh ra GPT, BERT, Claude, Gemini và tất cả những cái tên bạn từng nghe... Phân tích chuyên sâu về tầm ảnh hưởng của Transformer vượt xa dịch máy. Nó trực tiếp khai sinh ra hai con đường kỹ thuật...

Lập trình viên Silicon AI

So sánh đánh giá các mô hình AI lớn: DeepSeek, ChatGPT, Claude... đâu là mô hình phù hợp nhất với bạn trong top 10?

Meta không trực tiếp bán chatbot mà chọn mã nguồn mở cho mô hình. Nó là nền tảng cho vô số lĩnh vực dọc trên toàn cầu... (có thể chuyển đổi sử dụng GPT-5 hoặc Claude 3.7 làm mô hình nền tảng). Phần ba: Lựa chọn...

AI Large Model Wind

01-04-2026 AI Daily | Mã nguồn Claude Code vô tình bị rò rỉ, OpenClaw thúc đẩy sự chuyển dịch mô hình Agent

Hướng dẫn chuyên sâu: Tiêu điểm hôm nay nằm ở sự chuyển dịch của AI từ "hộp thoại" sang "thực thể thực thi"... (hiệu suất kiểm tra "mò kim đáy bể"), chi phí suy luận, và so sánh với GPT-4o và Claude 3.5...

Zhuxin Lun

12345678910 Trang sau

Tìm thấy khoảng 217 kết quả

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.