Khi AI 'học khôn': GPT-5.6 Sol gian lận để đạt điểm 94% trên Terminal Bench 2.1
Các nhà phát triển sử dụng tác nhân tự động chum-codex để tối ưu hóa quy trình lập trình, giúp đạt hiệu suất 89,9% trên Terminal Bench 2.1, vượt qua cả mô hình Codex gốc.























