Latent Space
95

Mô hình

GPT-6 Astra: Bước tiến đột phá nhất của OpenAI trong kỷ nguyên LLM

(giờ Việt Nam)

Tóm tắt AI

GPT-6 Astra thiết lập chuẩn mực mới về khả năng lập trình và điều khiển máy tính. Dù chi phí mỗi token cao hơn, nhưng hiệu suất vượt trội giúp tối ưu hóa chi phí trên mỗi tác vụ, đánh dấu một cột mốc thành công cho dòng mô hình tiên phong của OpenAI.

Bản dịch AI

[AINews] GPT-6 Astra: OpenAI’s biggest LLM launch of all time

Sự kiện ra mắt mới chỉ diễn ra được 9 tiếng, với 36 triệu lượt xem và 164 nghìn lượt thích, đây đã là màn ra mắt thành công nhất của OpenAI kể từ Sora và chắc chắn là vượt xa GPT-4 hay GPT-5.

Bạn có thể đọc những ấn tượng ban đầu của chúng tôi tại đây và chúng tôi sẽ sớm cập nhật thêm thông tin, hãy nhớ đăng ký theo dõi.

Nhìn chung, đây là một lời đáp trả rất đáng hoan nghênh đối với những tiến bộ của Fable và Opus từ Anthropic.

Đến lượt các bạn rồi đấy, SpaceXAI và Google DeepMind.

Tin tức AI từ ngày 2/9/2026 đến 3/9/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm thông tin nào từ Discord. Trang web của AINews cho phép bạn tìm kiếm tất cả các số báo trước đây. Xin nhắc lại, AINews hiện là một chuyên mục của Latent Space. Bạn có thể tùy chọn nhận hoặc hủy nhận email theo tần suất mong muốn!

OpenAI đã ra mắt GPT-6 Astra như một mô hình chủ lực mới, nhưng quá trình triển khai và các cuộc tranh luận xoay quanh nó cũng quan trọng không kém gì bản thân mô hình này.

OpenAI chính thức công bố Astra là “mô hình thông minh và được căn chỉnh tốt nhất của chúng tôi từ trước đến nay”, định vị nó trong các lĩnh vực sử dụng máy tính, kỹ thuật phần mềm, toán học/khoa học, xử lý văn phòng chuyên nghiệp và an ninh mạng thông qua @OpenAI, @OpenAI và @sama.

Công ty cho biết Astra sẽ được triển khai trước cho một nhóm tổ chức giới hạn, sau đó trong vài ngày tới sẽ đến lượt người dùng ChatGPT Plus/Pro/Business/Enterprise, API và AWS, như đã được ghi nhận bởi @OpenAI, @OpenAIDevs và @thsottiaux.

Bản thân buổi ra mắt đã gặp nhiều trục trặc: người dùng gặp tình trạng chậm trễ, bài đăng trên blog bị lỗi/đăng muộn, thời gian truy cập không rõ ràng và sự thất vọng khi nhiều người có ảnh hưởng được truy cập sớm trong khi người dùng trả phí thì không, như phản ánh của @iScienceLuvr, @kimmonismus, @sama, @sama, @sama, @theo và @t3dotcodes.

OpenAI đã cố gắng bù đắp cho sự chậm trễ bằng cách cấp “quyền đặt lại tích lũy” (banked resets) cho mỗi ngày người dùng ChatGPT trả phí không thể truy cập Astra, theo @thsottiaux và @reach_vb.

OpenAI đồng thời phát hành tài liệu về hệ thống/an toàn triển khai, thu hút sự chú ý đặc biệt vì nó mô tả cả việc cải thiện khả năng căn chỉnh (alignment) lẫn việc giảm khả năng giám sát chuỗi suy luận (chain-of-thought), được nhấn mạnh bởi @scaling01, @tomekkorbak, @MicahCarroll và @kaicathyc.

Hồ sơ đánh giá của Astra ngay lập tức gây ra tranh cãi: OpenAI và các bên kiểm thử ủng hộ mô tả đây là một bước nhảy vọt hoặc “giống như AGI”; trong khi các đơn vị tổng hợp độc lập và một số nhà nghiên cứu lập luận rằng dù mức tăng trưởng lớn nhưng không đồng đều, đặc biệt là khi xét đến chi phí và các bài đánh giá không được chọn lọc kỹ lưỡng, ví dụ như @ArtificialAnlys, @arcprize, @fchollet, @EpochAIResearch, @theo và @abacaj.

Những phản ứng tích cực mạnh mẽ nhất tập trung vào khả năng sử dụng máy tính, tạo/tái tạo 3D, xây dựng trò chơi, công việc tri thức dài hạn và suy luận hình thức/khoa học, đến từ sự kết hợp giữa nhân viên OpenAI, tác giả các bài đánh giá, đối tác và người dùng thử nghiệm sớm như @markchen90, @mckbrando, @Dimillian, @theo, @MattShumer_, @skirano, @tomkrcha, @realYunfanYe, @nasqret và @rileybrown.

Những phản ứng tiêu cực mạnh mẽ nhất tập trung vào khả năng giám sát, nhận thức về đánh giá, quản trị phát hành, sự bão hòa của các bộ tiêu chuẩn đánh giá (benchmark) và khả năng rằng những cải thiện về căn chỉnh có thể chỉ là “che đậy” các lỗi cụ thể thay vì giải quyết vấn đề sai lệch mục tiêu cơ bản, đặc biệt là từ @NeelNanda5, @RyanGreenblatt, @RyanGreenblatt, @RyanGreenblatt, @scaling01 và @teortaxesTex.

Định vị công khai của OpenAI kết hợp giữa các tuyên bố về năng lực, tiêu chuẩn đánh giá, triển khai và sản phẩm.

Ngôn ngữ công bố cốt lõi: Astra là “mô hình thông minh và được căn chỉnh tốt nhất từ trước đến nay” và “Bất cứ điều gì bạn có thể làm trên máy tính, Astra đều có thể làm cho bạn. Nhanh chóng.” thông qua @OpenAI.

Các năng lực của mô hình được OpenAI nhấn mạnh:

Khả năng sử dụng máy tính và kỹ thuật phần mềm hiện đại nhất.

“Những đột phá mới” trong toán học và khoa học.

Tài liệu/bảng tính/bài thuyết trình chuyên nghiệp tuân thủ các mẫu/phong cách.

Năng lực an ninh mạng mạnh mẽ hơn với các tính năng giám sát/bảo vệ thông qua @reach_vb, @OpenAIDevs, @OpenAIDevs.

Tính khả dụng:

Triển khai cho các tổ chức giới hạn trước.

Sau đó đến Plus, Pro, Business, Enterprise.

API và AWS trong những ngày tới thông qua @OpenAI, @OpenAIDevs.

Giá cả:

Tiêu chuẩn: 10 USD / 1 triệu token đầu vào, 50 USD / 1 triệu token đầu ra.

Nhanh: 20 USD / 1 triệu token đầu vào, 100 USD / 1 triệu token đầu ra, cho tốc độ nhanh gấp 2,5 lần thông qua @reach_vb.

Các tính năng sản phẩm/runtime được công bố cùng với Astra:

Codex có thể đặt câu hỏi trong khi vẫn tiếp tục công việc độc lập.

Tính năng ngữ cảnh thử nghiệm cho phép Astra ghi chú và tìm kiếm các cửa sổ ngữ cảnh trước đó trong các tác vụ dài.

Các bổ sung cho API phản hồi: gọi hàm bất đồng bộ (async function calling), điều hướng giữa chừng (mid-turn steering) và thay đổi nỗ lực suy luận mà không làm hỏng bộ nhớ đệm thông qua @reach_vb, @nikunjhanda.

Các số liệu đánh giá được OpenAI công bố:

99,9% trên ARC-AGI-3.

98% trên FrontierMath Tier 4.

100% trên ExploitBench.

Nhanh hơn 1,9 lần so với GPT-5.6 Sol trên Mind2Web với các cải tiến từ Codex harness thông qua @reach_vb, @sama.

OpenAI cũng tuyên bố Astra đã “giúp giải quyết các bài toán mở lâu đời trong toán học”, được khuếch đại bởi @OpenAI, @polynoamial và cụ thể hơn là các bài đăng về khoảng cách số nguyên tố (prime-gap) từ @mehtaab_sawhney, @weijie444.

OpenAIGPT-6LLMAI-ModelsCông nghệ mới
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Latent Space. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.