Tin ngành
Tranh cãi về lời giải bài toán thiên niên kỷ của OpenAI: Liệu giới nghiên cứu có còn tin tưởng các phòng thí nghiệm AI?
(giờ Việt Nam)
Tóm tắt AI
Vụ việc nhà toán học Tristan Buckmaster cáo buộc OpenAI gian lận học thuật trong lời giải bài toán thiên niên kỷ đang gây chấn động, làm dấy lên lo ngại về sự minh bạch và tương lai của khoa học mở.
Bản dịch AI

Sau khi nhà toán học Tristan Buckmaster cáo buộc OpenAI có hành vi sai trái, tất cả các bên liên quan hiện đã chính thức lên tiếng. Vụ việc đặt ra những câu hỏi hóc búa cho nền khoa học mở.
Cuộc tranh cãi xung quanh lời giải do AI của OpenAI tạo ra cho các phương trình Navier-Stokes, một trong những Bài toán Thiên niên kỷ của Viện Toán học Clay với giải thưởng trị giá 1 triệu USD, đã thu hút các tuyên bố công khai từ tất cả những người trong cuộc.
Nhà toán học Tristan Buckmaster trước đó đã đưa ra những cáo buộc nghiêm trọng nhắm vào OpenAI. Ông cho rằng sau khi thông tin về nghiên cứu của mình bị rò rỉ, công ty đã gây áp lực lên ông, cố gắng loại bỏ đồng tác giả Levent Alpöge khỏi bài báo vì Alpöge đang làm việc tại Anthropic, đồng thời đe dọa về những hậu quả đối với sự nghiệp của ông. Ngoài ra, còn có nghi vấn rằng OpenAI có thể đã huấn luyện các mô hình của mình dựa trên các bản thảo mà hai nhà nghiên cứu này đã tải lên Codex.
Có một điều không thể tranh cãi. Theo chính lời kể của OpenAI, họ đã nghe tin đồn rằng các mô hình của Anthropic đã giải được một Bài toán Thiên niên kỷ và sau đó đã dồn nguồn lực của mình vào cùng vấn đề đó. Tuy nhiên, ở nhiều điểm khác, các câu chuyện lại có sự khác biệt.
Buckmaster gọi đây là "hành vi sai trái trong học thuật tuyệt đối".
Alpöge và Buckmaster phản bác tuyên bố của OpenAI rằng lời giải của họ khác biệt đáng kể so với lời giải của hai người. Họ cho biết mình đã nhập một phương pháp tương tự vào hệ thống của OpenAI. Theo hiểu biết của Buckmaster, dữ liệu đầu vào đó đã lọt vào tập dữ liệu huấn luyện. Buckmaster coi đây là "hành vi sai trái trong học thuật tuyệt đối".
Các nhân viên của OpenAI cho rằng khả năng OpenAI thực sự huấn luyện trên các lời giải được gửi lên là rất thấp, đặc biệt là nếu hai người này đã tắt tùy chọn loại trừ dữ liệu đầu vào khỏi quá trình huấn luyện. Việc họ có làm như vậy hay không vẫn chưa được công khai. Nhân viên OpenAI, Boaz Barak, cũng bác bỏ ý kiến cho rằng mô hình cần sự trợ giúp từ bên ngoài. "Thật là tự huyễn hoặc khi nghĩ rằng mô hình cần đến điều này. Thực tế, nó đã bắt đầu bằng việc chứng minh một khẳng định mạnh mẽ hơn cả những gì họ làm. Bất kỳ ai từng thấy mô hình này hoạt động đều sẽ không nghĩ rằng nó cần 'gợi ý'."
Trong bài đăng trên blog chính thức, OpenAI thừa nhận khoảng trống về sự chắc chắn: "Mặc dù khó xảy ra, chúng tôi không thể loại trừ khả năng dữ liệu đã được ẩn danh từ quá trình họ sử dụng sản phẩm của chúng tôi đã góp phần cải thiện các mô hình của mình."
Altman ủng hộ Bubeck trong khi Alpöge phản đối.
CEO Sam Altman của OpenAI đã ủng hộ Bubeck trên X, nói rằng đội ngũ của ông đã "hành động với sự chính trực và hào phóng trong suốt quá trình". Ông cho biết đã có đề xuất rằng Buckmaster và Alpöge nên nhận giải thưởng, nhưng đội ngũ của ông lại phải đối mặt với "những cáo buộc đạo văn vô căn cứ".
Altman cũng viết rằng nỗ lực này bắt đầu vì "những tin đồn trên internet vào tuần trước rằng các mô hình của Anthropic đã giải được một bài toán thiên niên kỷ và chúng tôi tò mò liệu mô hình của mình có làm được điều đó hay không".
Alpöge phản bác Altman ở một điểm mấu chốt. Altman viết rằng rất khó để đưa ra lời đề nghị tương tự cho Alpöge vì ông "dù sao cũng không sẵn lòng nói chuyện hay phối hợp với chúng tôi". Alpöge cho biết ông rất muốn làm việc với OpenAI và vấn đề tác giả không quan trọng đối với ông. "Tôi cũng thích ý tưởng các phòng thí nghiệm hợp tác với nhau, và thậm chí còn tốt hơn nếu là vì sự tiến bộ khoa học. Thật đáng tiếc!" Alpöge viết.
Điều này có ý nghĩa gì đối với khoa học mở?
Bất kể ai đúng trong từng chi tiết, vụ việc đặt ra một câu hỏi cơ bản về cách các phòng thí nghiệm AI tương tác với cộng đồng nghiên cứu. Chỉ riêng tin đồn đã đủ để OpenAI dồn nguồn lực khổng lồ vào một vấn đề nghiên cứu trong thời gian ngắn, chạy đua để giải quyết và có khả năng công bố trước. Và không thể loại trừ khả năng công ty đã huấn luyện trên dữ liệu được đưa vào hệ thống của chính mình.
Đối với cả các học giả và các công ty, bài học rút ra rất đơn giản. Bất kỳ ai đưa dữ liệu nghiên cứu vào hệ thống của OpenAI đều có nguy cơ bị chính những phát hiện của mình đánh bại. Việc chọn không tham gia huấn luyện dữ liệu thông qua cài đặt chỉ mang lại sự bảo vệ mong manh, nhất là khi các phòng thí nghiệm AI chưa tạo được niềm tin về các thực tiễn huấn luyện và dữ liệu.
Nhà toán học Terence Tao, một trong những nhà toán học có ảnh hưởng nhất còn sống, cảnh báo trên Mastodon rằng "ngay cả tin đồn về việc ai đó đang nghiên cứu một vấn đề cũng có thể kích hoạt một lượng lớn nỗ lực dựa trên AI để giải quyết nó trước khi dự án nghiên cứu ban đầu có thời gian đạt được tiềm năng đầy đủ".
"Các động lực hiện nay có thể đang hướng tới việc không còn chia sẻ bất kỳ hướng nghiên cứu hứa hẹn nào với cộng đồng rộng lớn hơn, điều này sẽ đảo ngược truyền thống khoa học mở hàng thế kỷ và gây ra thiệt hại nghiêm trọng lâu dài cho tương lai của lĩnh vực này," Tao viết.
Tin tức AI không cường điệu – Được tuyển chọn bởi con người.
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo độc quyền "AI Radar" về các công nghệ tiên phong sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay.
Bài viết được AI dịch và tổng hợp tự động từ The Decoder. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.