Suy luận
Tiến triển năng lực suy luận: Chuỗi suy nghĩ (CoT), mô hình suy luận toán học và logic đột phá.
1.246 bài thu thập130 tinh chọncập nhật đến 28/09 02:09
- QbitAIT7 · 12/09 · 16:30
Pháo đài cuối cùng của toán học AI đã sụp đổ: GPT-6 Astra chinh phục FrontierMath Tier 4
GPT-6 Astra đã chính thức vượt qua ngưỡng thử thách khó nhất của FrontierMath Tier 4, đánh dấu bước ngoặt lịch sử khi AI giải quyết thành công các bài toán toán học cấp độ cao.
- JiQiZhiXinT7 · 12/09 · 15:00
Chấn động: 25 chủ nhân giải Fields, bao gồm Terence Tao, cảnh báo AI đang hủy hoại toán học
25 nhà toán học hàng đầu thế giới đã ký tên vào bức thư ngỏ chỉ trích các công ty AI vì ưu tiên chạy đua benchmark thay vì tuân thủ quy trình nghiên cứu khoa học chuẩn mực, gây ra sự lệch lạc nghiêm trọng trong cộng đồng toán học.
- QbitAIT7 · 12/09 · 13:15
Terence Tao và Đặng Dục phản đối điều gì: Khi AI 'giải toán thô bạo' đe dọa tinh thần toán học nhân loại
25 nhà toán học đạt giải Fields đã cùng lên tiếng cảnh báo về việc AI lạm dụng sức mạnh tính toán để giải quyết các bài toán, thay vì tư duy logic thuần túy.
- Hugging Face Daily PapersT7 · 12/09 · 01:00
Xây dựng cầu nối đa ngôn ngữ: Tối ưu hóa dữ liệu để nâng cao khả năng suy luận của AI
Nghiên cứu giới thiệu phương pháp trộn dữ liệu giúp mô hình AI suy luận trực tiếp bằng ngôn ngữ của người dùng thay vì dịch sang tiếng Anh, đạt tỷ lệ chính xác trên 93% ở 60 ngôn ngữ.
- OpenRouter: AnnouncementsT6 · 11/09 · 21:58
OpenRouter ra mắt Fusion: Hệ thống kết hợp nhiều mô hình AI để tối ưu hóa độ chính xác
OpenRouter giới thiệu Fusion, hệ thống cho phép chạy song song nhiều mô hình AI để tranh luận và tổng hợp câu trả lời chính xác nhất. Dù chi phí và độ trễ cao hơn, phương pháp này giúp cải thiện đáng kể hiệu suất trên các bài kiểm tra chuyên sâu.
- JiQiZhiXinT6 · 11/09 · 21:00
PhyFilter: Đột phá từ Bắc Hàng và NTU giúp robot 'suy luận' linh hoạt mà không cần dữ liệu khổng lồ
Nhóm nghiên cứu từ ĐH Hàng không Vũ trụ Bắc Kinh và NTU giới thiệu PhyFilter, một module vật lý giúp robot thích nghi với môi trường mới chỉ bằng dữ liệu huấn luyện hạn chế, mở ra hướng đi thay thế cho việc 'cày' dữ liệu quy mô lớn.
- Hugging Face Daily PapersT6 · 11/09 · 18:30
Negative Self-Distillation: Cải thiện khả năng suy luận của AI bằng cách tránh các lỗi sai
Thay vì bắt chước đáp án mẫu, phương pháp Negative Self-Distillation (NSD) giúp mô hình ngôn ngữ tự tối ưu hóa bằng cách nhận diện và tránh xa các suy luận sai lầm, từ đó thúc đẩy tư duy phản biện và tự sửa lỗi.
- Hugging Face Daily PapersT6 · 11/09 · 10:00
Công thức mở giành Huy chương Vàng IMO: Huấn luyện Nemotron giải toán Olympic
Nghiên cứu giới thiệu quy trình suy luận toán học bằng ngôn ngữ tự nhiên đạt chuẩn Huy chương Vàng IMO 2026, sử dụng các mô hình Nemotron được tinh chỉnh chuyên biệt mà không cần công cụ hỗ trợ bên ngoài.
- QbitAIT6 · 11/09 · 09:30
OpenAI đang dùng bài toán thiên niên kỷ làm thước đo chuẩn cho AI?
Các nguồn tin rò rỉ cho thấy OpenAI đang thử thách khả năng của mô hình AI mới với Giả thuyết Hodge, một trong bảy bài toán thiên niên kỷ của toán học.
- Hugging Face Daily PapersT6 · 11/09 · 00:15
PARSER: Đột phá xử lý tài liệu dài cho AI Agent nhờ cơ chế đọc song song và suy luận chuyên sâu
PARSER tách biệt quá trình đọc và suy luận bằng cách sử dụng các sub-agent đọc song song, giúp AI Agent xử lý tài liệu dài hiệu quả hơn, giảm độ trễ và tránh phụ thuộc vào vị trí thông tin.
- JiQiZhiXinT5 · 10/09 · 20:45
DeepSeek V4.1 Flash chính thức ra mắt: Tối ưu hóa hiệu suất với kiến trúc MoE mới
DeepSeek V4.1 Flash sở hữu 552B tham số với kiến trúc Causal-Encoder-Decoder đột phá, giúp tăng tốc độ phản hồi và giảm chi phí suy luận đáng kể trong khi vẫn duy trì hiệu năng vượt trội ở các tác vụ lập trình và tác tử AI.
- CafeF Kinh tế sốT5 · 10/09 · 14:45
AI tạo bước ngoặt lịch sử: Giải mã thành công bài toán thiên niên kỷ
Nếu được giới toán học xác nhận, đây sẽ là cột mốc chấn động, đánh dấu bước tiến vượt bậc của AI trong việc chinh phục những đỉnh cao trí tuệ khó nhất của nhân loại.
- CafeF Kinh tế sốT5 · 10/09 · 08:30
OpenAI tuyên bố 10.000 AI Agent giải được bài toán thế kỷ, giáo sư toán học tố bị 'cướp công'
Một giáo sư toán học cáo buộc OpenAI sử dụng trái phép nghiên cứu của ông để huấn luyện AI giải bài toán thế kỷ, sau khi công ty này tuyên bố 10.000 AI Agent đã tìm ra lời giải đột phá.
- Hugging Face: BlogT5 · 10/09 · 07:00
Hugging Face tối ưu huấn luyện GRPO: Dùng LoRA và Storage Bucket tăng tốc 3.9 lần, loại bỏ NCCL
Hugging Face ra mắt AsyncGRPOTrainer giúp tách biệt quá trình huấn luyện LoRA và suy luận vLLM trên các máy chủ khác nhau mà không cần NCCL, giúp tăng tốc độ huấn luyện lên 3.9 lần.
- OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)T4 · 09/09 · 17:57
OpenAI công bố lời giải cho bài toán thiên niên kỷ Navier-Stokes bằng AI
OpenAI vừa công bố hệ thống AI nội bộ đã giải thành công bài toán Navier-Stokes, chứng minh sự hình thành kỳ dị trong chất lưu, kèm theo tài liệu chứng minh và mã kiểm chứng Lean.
- CafeF Kinh tế sốT4 · 09/09 · 15:00
OpenAI tuyên bố giải mã thành công phương trình Navier-Stokes
OpenAI khẳng định trí tuệ nhân tạo của họ đã giải quyết được phương trình Navier-Stokes, một trong những bài toán hóc búa nhất thách thức giới toán học suốt gần 100 năm qua.
- Latent SpaceT4 · 09/09 · 12:15
OpenAI giải mã bài toán Navier-Stokes: Bước ngoặt lịch sử tiến gần đến AGI
Sử dụng 10.000 tác nhân AI và 130 tỷ token, OpenAI đã tìm ra điểm kỳ dị của phương trình Navier-Stokes chỉ trong 88 giờ, đánh dấu cột mốc quan trọng có thể giành giải Millennium Prize.
- Hugging Face Daily PapersT4 · 09/09 · 12:15
BeaconKV: Tối ưu bộ nhớ KV Cache cho mô hình suy luận lớn thông qua truy vấn Beacon
BeaconKV giải quyết nút thắt bộ nhớ khi suy luận dài bằng cách xác định các 'Thought Revisiting Tokens' quan trọng, giúp nén KV cache hiệu quả mà không làm giảm khả năng truy xuất ngữ cảnh xa.
- Hugging Face Daily PapersT4 · 09/09 · 09:00
DriveZero: Hệ thống lái xe tự động vượt xa giới hạn của dữ liệu con người
DriveZero là hệ thống lái xe tự động đột phá, tách biệt mô hình nhận diện và hành động để tối ưu hóa khả năng học tập. Bằng cách sử dụng DriveRL, hệ thống có thể tự rèn luyện trong môi trường giả lập tương tác thay vì chỉ bắt chước dữ liệu lái xe từ con người.
- WeChat: KhazixT4 · 09/09 · 07:20
Bí quyết tối ưu Token khi chọn cấp độ suy luận trên GPT-6 Astra
Bài viết giải mã ý nghĩa các cấp độ 'Reasoning Effort' trên GPT-6 Astra, giúp bạn hiểu cách điều chỉnh ngân sách tư duy của AI để tiết kiệm chi phí mà vẫn đạt hiệu quả cao nhất.