04/09

Thứ Sáu · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 47/100

Nghiên cứu mới: LLM đang mất đi tính đa dạng so với dữ liệu huấn luyện gốc

LLMs learn a narrower set of answers than their training data, even when you sample instead of using…

DịchNghiên cứu chỉ ra rằng các mô hình như OLMo hay GPT-Neo có độ đa dạng đầu ra thấp hơn đáng kể so với dữ liệu huấn luyện. Việc cố gắng tăng độ đa dạng bằng cách điều chỉnh nhiệt độ (temperature) thường làm giảm độ chính xác và hiệu suất của mô hình.

17/08

Thứ Hai · 1 tin
Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 23/100

Đóng góp khoa học của OLMo 1-3 vẫn chưa được đánh giá đúng mức

IMO OLMo 1-3 still underrated in their contributions to science. I wish we could've spent more time …

DịchChuyên gia Nathan Lambert cho rằng giá trị khoa học thực sự của mô hình OLMo 1-3 vẫn chưa được nhìn nhận xứng đáng và lẽ ra cần được làm nổi bật hơn ngay từ giai đoạn phát triển.

Tổng 2 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (17 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “OLMo” | AIHOT.vn