Mô hình
GPT-6 không chỉ có Astra: Kết quả thử nghiệm Sol cho thấy tốc độ nhanh gấp 6 lần
(giờ Việt Nam)
Tóm tắt AI
Dự án Sol của OpenAI đang gây chú ý với tốc độ vượt trội, đồng thời hé lộ văn hóa làm việc mới khi mỗi nhà nghiên cứu tại đây hiện đang quản lý tới 3 trợ lý AI.
Bản dịch AI
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
07-09-2026 17:04:06 Nguồn: QbitAI
Mỗi nhà nghiên cứu tại OpenAI đang dẫn dắt 3 thực tập sinh AI
Ting Yu đưa tin từ trụ sở QbitAI | Kênh chính thức QbitAI
GPT-6 không chỉ có Astra!
Chỉ vài ngày sau khi Astra ra mắt, GPT-6 Sol đã bị lộ thông tin đang trong giai đoạn thử nghiệm nội bộ.

Hiệu suất của nó cũng rất ấn tượng, với tốc độ kiểm thử đơn lẻ nhanh gấp 6 lần so với Astra.
Hãy thử dự đoán táo bạo xem: Liệu Terra và Luna có đang trên đường ra mắt không nhỉ?
Và cũng ngay trong ngày hôm đó, OpenAI vừa công bố một bộ dữ liệu nội bộ:
Tính đến thời điểm hiện tại, quy đổi theo ngày làm việc 8 tiếng, mỗi ngày làm việc của một nhà nghiên cứu tại OpenAI đều có hơn 3 ngày làm việc của các Agent cùng vận hành song song.
Tính theo giá API, tài nguyên suy luận của Agent mà một nhà nghiên cứu trung bình tại OpenAI sử dụng mỗi ngày đã vượt quá 600 USD.

OpenAI cũng tuyên bố rằng họ đã hiện thực hóa được "thực tập sinh nghiên cứu tự động":
Những Agent này có thể hoàn thành dưới sự hướng dẫn của con người một số nhiệm vụ mà trước đây các nhà nghiên cứu phải mất vài ngày mới làm xong.
Ngay cả "lão Hoàng" (Jensen Huang) cũng nói: AGI đã đến rồi!

Ông tiết lộ rằng Astra sử dụng khoảng 100.000 bộ NVIDIA Grace Blackwell NVLink72 để huấn luyện, và sắp tới sẽ có thêm 400.000 bộ GPU nữa được đưa vào vận hành.
Xem ra làn sóng này không phải là OpenAI tự thổi phồng đâu nhé~
GPT-6 Sol bị lộ thông tin bắt đầu thử nghiệm nội bộ
Người dùng Lentils tiết lộ rằng OpenAI đang thử nghiệm nội bộ GPT-6 Sol.
Anh cho biết, khả năng xuất dữ liệu tổng thể của Sol yếu hơn đáng kể so với Astra vừa ra mắt, nhưng tốc độ lại nhanh hơn và vẫn thuộc hàng mô hình "cấp quái vật".
Nhanh đến mức nào? Tốc độ kiểm thử đơn lẻ nhanh gấp khoảng 6 lần so với Astra.
Người dùng lyra đã đưa cùng một nhiệm vụ cho các mô hình khác nhau thử nghiệm: Yêu cầu mô hình tạo ra một tệp SVG của chiếc BMW M4 Competition.
Trong đó, GPT-6 Sol sử dụng chế độ Max, tạo zero-shot, mất khoảng 3 phút và xuất ra khoảng 28.000 Token.

GPT-6 Astra sử dụng chế độ Max, xuất ra khoảng 25.000 Token, mất khoảng 19 phút.

Gemini 3.1 DeepThink bật chế độ High, hiển thị xuất ra khoảng 3.300 Token, nhưng quá trình suy luận tiêu tốn khoảng 458.000 Token, mất khoảng 29 phút.

Gemini 3.8 Flash cũng bật chế độ High, xuất ra khoảng 19.000 Token, chỉ mất khoảng 42 giây.
So sánh lại, hiệu suất của Sol là ấn tượng nhất: Quy mô đầu ra của nó gần tương đương với Astra, nhưng tốc độ kiểm thử đơn lẻ nhanh gấp khoảng 6 lần Astra — thời gian tiêu tốn chỉ bằng khoảng một phần sáu so với đối thủ.
Ngoài ra, người dùng Lentils cũng trình diễn một nguyên mẫu thế giới sandbox phong cách pixel có tên "The Realm of Aurellune".
GPT-6 Sol đã tạo ra một lần các thị trấn, đất nông nghiệp, sông ngòi, lâu đài và bản đồ thu nhỏ, đồng thời còn đi kèm với bảng điều khiển để chuyển đổi ngày đêm, đặt tên địa danh, điều chỉnh chi tiết, nhìn tổng thể giống như một trò chơi mô phỏng quản lý đã được dựng sẵn khung hình.
Đây là kết quả tạo ra từ zero-shot, chế độ suy luận Max, trong 15 phút với tổng chi phí 60.000 token.
Hiện tại có thể suy đoán rằng, Astra thiên về suy luận chuyên sâu ở độ khó cao nhất, còn Sol có thể thiên về tốc độ, lưu lượng xử lý và khả năng gọi Agent quy mô lớn.
Về thời điểm ra mắt của Sol, người dùng Pankaj Kumar cho biết có thể nó sẽ được công bố chính thức tại Hội nghị nhà phát triển OpenAI vào ngày 29 tháng 9.
Cũng không loại trừ khả năng GPT-6 Terra, Luna và GPT-Image 2.5 sẽ cùng xuất hiện.
Nhà nghiên cứu OpenAI, mỗi người dẫn dắt 3 thực tập sinh Agent đi làm
Ngay trong cùng ngày, OpenAI còn chia sẻ một bộ dữ liệu nội bộ rất thú vị — cho thấy các mô hình AI đã thực sự đẩy nhanh tiến độ nghiên cứu khoa học trong phòng thí nghiệm của họ đến mức nào.
Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.