New Microsoft paper says agent training should happen inside the agent's normal operating setup. Oth…
DịchMicrosoft giới thiệu Agent Lightning v1.0, khung huấn luyện AI Agent nhẹ giúp tối ưu hóa mô hình ngay trong môi trường triển khai thực tế thay vì mô phỏng, đảm bảo tính nhất quán và hiệu quả cao hơn cho các ứng dụng AI.
Anthropic đã phân tách thành công transformer một lớp để chứng minh sự tồn tại của nhiễu trọng số và tác động trực tiếp của chúng đến hiệu suất huấn luyện mô hình.
Banger paper on harness continual learning. (bookmark it) If you already are allowing your agents …
DịchNghiên cứu chỉ ra hiện tượng 'quên lãng cấp khung' khi cập nhật các thành phần như bộ nhớ hay công cụ khiến AI mất khả năng vận hành. Cơ chế 'Tiến hóa khung được bảo vệ' giúp tối ưu hóa và kiểm chứng hiệu quả, cải thiện hơn 10% hiệu suất trong các tác vụ suy luận và tương tác.
Finally a good paper testing whether agents can really post-train other agents. (bookmark it) They…
DịchNghiên cứu chỉ ra rằng các AI hiện nay khi huấn luyện lẫn nhau thường bị mắc kẹt ở chiến lược ban đầu và thiếu khả năng thay đổi tư duy trong quá trình thực thi, dù có sự hỗ trợ từ con người hay kỹ thuật bổ trợ.
This is quite a big deal. Most tabular ML still starts with the same assumption: new dataset, new …
DịchSynthefy giới thiệu Nori, mô hình nền tảng cho dữ liệu số hóa có khả năng dự đoán hàng mới mà không cần tinh chỉnh. Với chỉ 30 triệu tham số, Nori đạt hiệu suất vượt trội so với các mô hình lớn gấp hàng chục lần.
Agent skills work for a very specific reason: they turn messy past experience into a clean procedure…
DịchNghiên cứu chỉ ra rằng việc chưng cất kinh nghiệm thành quy trình rõ ràng giúp AI đạt hiệu suất cao hơn 6,06% so với việc lưu trữ toàn bộ dữ liệu thô. Kỹ năng giúp tối ưu hóa trình tự thực thi và chọn lọc công cụ, thay vì chỉ đơn thuần bổ sung kiến thức.
Databricks Feature Store nâng cấp khả năng cập nhật dữ liệu đặc trưng xuống dưới 1 giây, giúp các mô hình AI phản hồi thời gian thực chính xác hơn cho các tác vụ như phát hiện gian lận.
LOPD giải quyết hạn chế của các phương pháp tự học truyền thống bằng cách cho phép AI tự tạo ra ngữ cảnh ưu tiên thay vì dựa vào dữ liệu thủ công, giúp hệ thống tự cải thiện hiệu quả và linh hoạt hơn.
Bài viết cung cấp quy trình toàn diện từ xử lý luồng, lọc dữ liệu đến tinh chỉnh mô hình dựa trên bộ dữ liệu suy luận SupraLabs, giúp tối ưu hóa hiệu suất cho các mô hình AI tư duy.
Thats the reaserach i love to see: Google put Gemini through a simulated medical residency, and it b…
DịchGoogle sử dụng phương pháp ResidencyRL để huấn luyện Gemini 3.5 Flash thông qua gần 50.000 ca bệnh giả lập với các tình huống phức tạp, giúp cải thiện độ chính xác chẩn đoán lên 88% và giảm tỷ lệ bỏ sót dấu hiệu nguy hiểm.
Expedia recently moved its ranking models to a state-of-the-art Keras 3 setup. Results: 30% faster t…
DịchExpedia đã chuyển đổi mô hình xếp hạng lưu trú sang kiến trúc Keras 3, giúp tối ưu hóa hiệu suất vượt trội với tốc độ huấn luyện nhanh hơn 30% và giảm đáng kể độ trễ suy luận.
TSDS-Toolbox là khung làm việc toàn diện giúp chuẩn hóa việc so sánh, đánh giá và mở rộng các phương pháp đo độ tương đồng trong dữ liệu chuỗi thời gian, hỗ trợ đắc lực cho việc lựa chọn tập dữ liệu nguồn khi tinh chỉnh các mô hình AI.