The Decoder: AI News
95

Mô hình

OpenAI công bố mô hình thế hệ mới 'Astra', giải mã thành công 10 bài toán hóc búa

(giờ Việt Nam)

Tóm tắt AI

OpenAI xác nhận mô hình Astra thế hệ mới đã giải quyết được 10 bài toán mở trong toán học và khoa học máy tính lý thuyết, bao gồm cả những vấn đề đã bế tắc suốt một thập kỷ.

Bản dịch AI

OpenAI announces its "next major model" Astra by dropping ten previously unsolved math solutions

Cập nhật:

OpenAI đã công bố báo cáo toán học của mình, chính thức xác nhận tên gọi Astra lần đầu tiên. Công ty cho biết một phiên bản nội bộ của Astra, "dòng mô hình lớn tiếp theo" của họ, đã giải quyết được mười bài toán mở trong lĩnh vực toán học và khoa học máy tính lý thuyết. Các nhà toán học đã không đạt được tiến bộ nào đối với bất kỳ bài toán nào trong số này trong ít nhất một thập kỷ, và trong hầu hết các trường hợp là lâu hơn thế rất nhiều.

Các kết quả bao gồm nhiều lĩnh vực từ hình học chiều cao và lý thuyết mã hóa đến lý thuyết nhóm, độ phức tạp lượng tử, mật mã lưới và tổ hợp cực trị. Một chứng minh đã thiết lập sự tồn tại của các nhóm phi-sofic (non-sofic groups), giải quyết một câu hỏi mở quan trọng trong lý thuyết nhóm.

Thomas Bloom, một nhà toán học tại Đại học Manchester, người điều hành trang erdosproblems.com, đã gọi các kết quả này là "tin lớn" trên X. Ông coi chúng quan trọng hơn phản ví dụ cho giả thuyết khoảng cách đơn vị (unit distance conjecture) được công bố vào tháng 5. "Có lẽ không lớn hơn một chứng minh về khoảng cách đơn vị, nhưng xét về mặt xây dựng, đây là một thành tựu lớn," Bloom viết.

Bloom cũng bác bỏ ý kiến cho rằng AI đang thay thế các nhà toán học, lập luận rằng tuyên bố đó không có nhiều ý nghĩa khi AI dựa trên hơn một thế kỷ lý thuyết toán học, được xây dựng bởi các nhà toán học và được huấn luyện trên tất cả những gì các nhà toán học từng viết.

Noam Brown, một trong những nhà nghiên cứu đứng sau công nghệ suy luận trong thời gian kiểm thử (test-time reasoning) được Astra sử dụng, cho biết trên X rằng OpenAI cũng đã thử và thất bại trong việc giải quyết các bài toán lớn khác. "Đáng buồn là chưa có bài toán nào trong số các Bài toán Thiên niên kỷ (Millennium Prize Problems) được giải quyết," ông viết. Viện Toán học Clay trao thưởng 1 triệu USD cho mỗi bài toán trong số bảy Bài toán Thiên niên kỷ, nhưng chỉ có một bài toán được giải kể từ khi các giải thưởng này được công bố vào năm 2000. Brown nói thêm: "Nhưng chúng tôi cũng không dành quá nhiều thời gian cho mỗi bài toán. Hoàn toàn có thể đẩy mạnh khả năng tính toán trong thời gian kiểm thử hơn nữa." Ông gọi Astra là một "bước tiến lớn cho suy luận khoa học."

Các giải pháp của Astra sẽ tiêu tốn khoảng 2.000 USD theo mức giá API.

OpenAI cho biết các token được sử dụng để tạo ra tất cả mười giải pháp sẽ tiêu tốn khoảng 2.000 USD theo mức giá API của Sol. Sau khi mô hình đưa ra các lập luận, con người đã làm việc cùng với chính mô hình đó để biến chúng thành các bài báo nghiên cứu. Mô hình cũng chính thức hóa từng chứng minh trong Lean, tạo ra các chứng chỉ về tính đúng đắn toán học mà máy có thể kiểm tra được, và OpenAI đã công bố hướng dẫn chi tiết về quy trình suy luận của mô hình cho từng giải pháp.

OpenAI cho biết các nhà nghiên cứu của họ đã hỗ trợ chuẩn bị các bài báo và chính thức hóa các chứng minh, đồng thời công ty chịu trách nhiệm về độ chính xác của chúng. Tuy nhiên, các lập luận toán học thực sự đều đến từ Astra.

Công ty lập luận rằng việc ghi nhận quyền tác giả của con người cho một chứng minh được tạo ra hoàn toàn bởi AI sẽ làm sai lệch cả đóng góp của hệ thống lẫn bản chất công việc trí tuệ thực sự của con người, đồng thời chỉ ra Tuyên bố Leiden về AI và Toán học như một tài liệu tham khảo về cách phân bổ tín nhiệm trong nghiên cứu có sự hỗ trợ của AI.

Bài viết gốc:

OpenAI được cho là đang xây dựng Astra, một dòng mô hình được thiết kế để xử lý các vấn đề trong nhiều giờ hoặc nhiều ngày.

OpenAI đang phát triển một dòng mô hình mới tạm gọi là "Astra", được thiết kế để có khả năng xử lý các tác vụ dài hạn vượt xa bất kỳ sản phẩm nào mà công ty từng phát hành.

CEO Sam Altman đã trình diễn Astra cho các chính trị gia và nhà quản lý tại Washington, D.C. trong tuần này. OpenAI nhấn mạnh khả năng của hệ thống trong việc điều phối nhiều tác nhân (agents) trong thời gian dài để giải quyết các vấn đề đặc biệt khó khăn. Công ty đã chỉ ra các dự án phức tạp và toán học nâng cao là những trường hợp sử dụng tiềm năng. The Information đã báo cáo chi tiết này, trích dẫn ba nguồn tin quen thuộc với các kế hoạch.

Theo báo cáo, Astra sẽ tạo thành một lớp mô hình mới bên cạnh các dòng Sol, Terra và Luna hiện có của OpenAI. Việc liệu nó sẽ được phát hành dưới tên GPT-6 hay một biến thể trong dòng GPT-5, chẳng hạn như GPT 5.7, vẫn chưa được quyết định. Cũng chưa có ngày phát hành cụ thể.

OpenAI cũng có kế hoạch sớm công bố một báo cáo cho thấy cách công ty sử dụng AI tiên tiến nhất của mình để giải quyết mười bài toán toán học chưa từng có lời giải trước đây. Mục tiêu là để chứng minh những gì các mô hình hiện tại của họ đã có thể thực hiện.

Astra sẽ là mô hình đầu tiên được kiểm thử theo khung pháp lý mới của Hoa Kỳ.

Theo The Information, các mô hình này hiện đang trong quá trình thử nghiệm. Chúng dự kiến sẽ là những mô hình đầu tiên trải qua khung pháp lý AI mới theo kế hoạch của chính quyền Trump, yêu cầu các mô hình AI phải được trình lên chính phủ liên bang trước khi phát hành công khai. Chính quyền đặt mục tiêu hoàn thiện khung pháp lý này vào cuối tuần này.

Một câu hỏi quan trọng là liệu các mô hình có thể tránh được việc tích tụ lỗi trong các quy trình làm việc kéo dài và tự sửa lỗi khi một quá trình đi chệch hướng trong khi ngữ cảnh liên tục mở rộng hay không. Đó vẫn là một điểm yếu lớn trong các hệ thống tác nhân (agentic systems) hiện nay. Các thiết lập đa tác nhân như Astra cũng có thể hoạt động kém hiệu quả hơn trong các tác vụ liên kết chặt chẽ như lập kế hoạch, vì chi phí điều phối và lỗi tích tụ có thể triệt tiêu mọi lợi ích đạt được.

Mục tiêu dài hạn là nghiên cứu AI tự chủ.

Những tin đồn về Astra phù hợp với các tuyên bố trước đó từ công ty. Giám đốc Khoa học Jakub Pachocki cho biết trên podcast chính thức của OpenAI vào mùa hè năm ngoái rằng công ty muốn xây dựng các hệ thống AI có thể làm việc trên một vấn đề trong nhiều giờ hoặc nhiều ngày. Các hệ thống hiện tại thường bị giới hạn trong các tác vụ ngắn, nhưng OpenAI muốn các mô hình có khả năng lập kế hoạch, suy luận và thử nghiệm trong những khoảng thời gian dài hơn. Cuối năm ngoái, công ty thậm chí đã đặt ra câu hỏi về cách tư duy đối với các hệ thống có thể giải quyết các tác vụ mà con người cần hàng thế kỷ để hoàn thành.

Đến tháng 3 năm 2028, OpenAI muốn có một nhà nghiên cứu AI hoàn toàn tự chủ có thể tự thực hiện các dự án nghiên cứu, và hệ thống đó cũng sẽ phụ thuộc vào các quy trình AI chạy dài hạn. Ngay từ tháng 9 này, công ty dự định có một hệ thống AI với kỹ năng cấp thực tập sinh nghiên cứu, giúp tăng tốc đáng kể công việc cho các nhà khoa học con người. Astra có thể chính là hệ thống đó.

Pachocki cũng cho biết các hệ thống này sẽ cần nhiều tài nguyên tính toán hơn rất nhiều. Các kế hoạch cơ sở hạ tầng dài hạn của OpenAI phản ánh tham vọng đó. Liệu doanh thu của startup này có tăng trưởng đủ nhanh để tài trợ cho việc xây dựng quy mô lớn đó hay không vẫn là một câu hỏi còn bỏ ngỏ.

Tin tức AI không cường điệu – Được tuyển chọn bởi con người.

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

Đăng ký ngay.

OpenAIAstraAI đột pháToán họcAGI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.