Latent Space
92

Sản phẩm

GPT-6 Astra: Kỹ sư AI tự động với chi phí chưa đầy 6 USD mỗi giờ

(giờ Việt Nam)

Tóm tắt AI

Khám phá những bài học thực tế từ việc sử dụng hơn 20 tỷ token của GPT-6 Astra để tối ưu hóa quy trình làm việc và tự động hóa kỹ thuật.

Bản dịch AI

GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour

GPT-6 Astra, siêu mô hình Stargate đầu tiên và được tinh chỉnh nhẹ từ OpenAI, đã ra mắt hôm nay, đánh bại Fable 5.1 một cách thuyết phục trên nhiều chỉ số, bao gồm việc hoàn toàn chinh phục các phiên bản khó nhất của FrontierMath (97,6%) và ARC-AGI-3 (99,9%). Rất nhiều bản demo sẽ tập trung vào các chủ đề quen thuộc như khả năng sử dụng máy tính, chơi Pokemon, sử dụng Blender cho đến các tiêu chuẩn đánh giá về khoa học và an ninh mạng (system card). Greg cho biết AGI đã xuất hiện, còn Jakub khẳng định đây chính là Thực tập sinh Nghiên cứu AI Tự động mà ông hằng mong đợi.

Chúng tôi không đủ chuyên môn để bàn luận về những khía cạnh đó, nhưng chúng tôi đã có quyền truy cập sớm và thử nghiệm nó với mọi tác vụ thực tế mà chúng tôi có thể nghĩ ra. Sau khi tiêu tốn hơn 20 tỷ token của Astra, chúng tôi có thể xác nhận phát hiện đáng ngạc nhiên nhất: GPT-6 Astra thuộc một lớp mô hình mới có khả năng trở thành những Kỹ sư AI độc lập thực thụ. Giờ đây, chúng có thể giúp bạn lựa chọn và huấn luyện mô hình, gắn nhãn dữ liệu (vừa hỗ trợ bạn gắn nhãn, vừa sử dụng nhãn của bạn cho học chủ động, giống như SAM), duy trì hiệu suất đường ống (pipeline), đo đạc và đọc nhật ký (log), triển khai và gỡ lỗi toàn bộ hệ thống trong một lần, phân bổ nhiệm vụ, điều khiển và đánh giá các tác nhân phụ (bao gồm cả các tác nhân chạy những mô hình khác), đồng thời duy trì tính nhất quán trên hàng tỷ token của một luồng tác nhân duy nhất.

Chúng tôi đã từng viết về lợi ích to lớn của việc nâng cao kỳ vọng đối với các mô hình LLM. Trải nghiệm này đã khiến chúng tôi trở nên tham vọng hơn bao giờ hết. Trong tháng qua, chúng tôi đã chuyển từ việc kêu gọi mọi người tham gia cuộc thi “Kill My SaaS” đầy thú vị, sang việc xây dựng hàng tá công cụ nội bộ/cá nhân, bao gồm 4 công cụ SaaS trước đây phải trả phí, thiết kế lại hoàn toàn trang web cá nhân, tạo ra một phiên bản thay thế chưa hoàn thiện nhưng có đầy đủ chức năng cho GitHub + Vercel, huấn luyện AI chơi một trò chơi cờ bàn chiến thuật có số nước đi hợp lệ gấp 10.000 lần so với cờ vây, tiết kiệm hàng chục nghìn đô la trong việc quản lý tài chính cá nhân, tái bản cuốn sách cũ của tôi với âm thanh sách nói được đồng bộ và các ấn bản vật lý, cùng nhiều dự án tham vọng khác mà chúng tôi sẽ sớm ra mắt.

Con số 6 đô la mỗi giờ nghe có vẻ đáng ngạc nhiên, nhưng đó chính xác là những gì chúng tôi thấy trong quá trình thử nghiệm - 33 token mỗi giây với mức giá tối đa 50 đô la cho mỗi triệu token. Với việc Astra sử dụng token hiệu quả hơn Sol và Fable (đã được Artificial Analysis xác nhận độc lập), điều này thường có nghĩa là Astra đồng thời cũng là mô hình nhanh-và-thông minh nhất mà bạn có thể mua (giả sử độ trễ bản xem trước của chúng tôi duy trì được khi ra mắt chính thức), ngoại trừ Spark 1.3.

Tất nhiên, nếu bạn chỉ sử dụng Astra ở chế độ Ultra, bạn sẽ tiêu tốn nhiều hơn 6 đô la mỗi giờ… vì nó thực sự quá giỏi trong việc xử lý song song.

Đây về cơ bản là những gì tôi sẽ trả cho một Kỹ sư AI cấp dưới để thực hiện. Và tôi đã chi khoảng 100 đô la trong 2 ngày để làm điều này.

Thật điên rồ.

Chúng tôi đã hết thời gian cho bài viết này và sẽ hoàn thành sau, vì vậy nếu bạn đang đọc bài này qua email, hãy kiểm tra lại vào cuối ngày.

Tuy nhiên, kết luận chung mà bạn nên rút ra là OpenAI rõ ràng đã huấn luyện được một mô hình có khả năng tự động hóa phần lớn công việc Kỹ thuật AI của chính họ, và cuối cùng đã đến lúc bạn học cách khai thác các mô hình đẳng cấp Astra và Fable để trở nên táo bạo hơn, táo bạo hơn nữa.

Chúng tôi đang thực hiện các công việc tương tự trên Grok, Fable và các mô hình tiên phong khác, nhưng OpenAI hào phóng nhất với các giới hạn dùng thử nên mô hình này được chọn để viết bài - tuy nhiên các mô hình lập trình tác nhân (agentic coding patterns) được thảo luận ở đây có khả năng sẽ áp dụng cho tất cả các mô hình tiên phong tương tự vào cuối năm 2026.

Nhiều người trong số các bạn đang chờ đợi kết quả… xin lỗi vì sự im lặng! Chúng tôi đã… quá bận rộn! Chúng tôi sẽ sớm công bố những người chiến thắng, các khoản hoàn trả và những nỗ lực xuất sắc nhất.

GPT-6AI tự độngKỹ sư phần mềmTối ưu chi phíCông nghệ mới
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Latent Space. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.