DịchNhà sáng lập Scale AI chia sẻ bài kiểm tra cho thấy Muse Spark 1.3 hoàn thành tác vụ chỉ trong 1 phút với chi phí gần như bằng 0, trong khi Fable 5.1 mất tới 70 phút và tốn 13 USD cho cùng một yêu cầu.
underrated result of muse spark 1.3 try it out with muse code: curl -fsSL https://dev.meta.ai/inst...
DịchAlexandr Wang khẳng định hiệu suất của AI lập trình Muse Spark 1.3 đang bị xem nhẹ và cung cấp hướng dẫn cài đặt trực tiếp để cộng đồng tự trải nghiệm.
DịchAlexandr Wang thông báo Muse Spark 1.3 đã có mặt trên nền tảng OpenCode Zen. Người dùng có thể trải nghiệm miễn phí hoàn toàn cho cả đầu vào, đầu ra và bộ nhớ đệm.
DịchNhà sáng lập Scale AI, Alexandr Wang, vừa đăng tải những đánh giá ban đầu về hiệu năng của mô hình Muse Spark 1.3 thông qua bộ kiểm chuẩn Stata, thu hút sự chú ý trong giới công nghệ.
1/ muse spark 1.2 is a very strong multimodal model-it can do visual coding, robotics planning, and …
DịchMuse Spark 1.2 là mô hình đa phương thức mạnh mẽ, tích hợp khả năng mã hóa thị giác, lập kế hoạch cho robot và hiểu sâu về âm thanh, video thông qua các công cụ tác nhân thông minh.
great initiative (RSI benchmark) from @ScaleAILabs and @mhrezaeics
DịchScale AI vừa giới thiệu bộ tiêu chuẩn RSI (Recursive Self-Improvement) nhằm đo lường khả năng tự tiến hóa của các hệ thống AI, đánh dấu cột mốc quan trọng trong việc theo dõi sự phát triển của trí tuệ nhân tạo hướng tới khả năng tự nâng cấp.
When an AI agent fails, blaming the model can send you to the wrong fix. This Scale AI paper argues…
DịchScale AI đề xuất phương pháp phân loại lỗi tập trung vào tương tác, giúp xác định chính xác nguyên nhân hỏng hóc từ mô hình, công cụ đến môi trường. Hệ thống này bao gồm 41 kiểu lỗi và đạt độ chính xác lên tới 96% khi kết hợp nhiều bộ đánh giá.