08/09

Thứ Ba · 1 tin
Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Nghiên cứuĐiểm AI 69/100

Tinh chọnEpoch AI phân tích độ trễ khi xử lý ngữ cảnh dài trên GPT-5.6 và Claude 5

Nghiên cứu từ Epoch AI cho thấy GPT-5.6 có độ trễ TTFT tăng theo đường cong bậc hai khi ngữ cảnh dài, trong khi dòng Claude 5 duy trì hiệu suất gần như tuyến tính.


Vì sao đáng đọc: Nghiên cứu kỹ thuật chuyên sâu về hiệu năng mô hình, cung cấp cái nhìn thực tế cho người dùng và nhà phát triển về khả năng xử lý ngữ cảnh dài của các model hàng đầu.

26/08

Thứ Tư · 1 tin
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 34/100

Groq 3 LPX: Giải pháp đột phá giúp AI Agent đạt tốc độ phản hồi mili giây

WSJ: "Agentic AI creates two distinct computing challenges: efficiently processing enormous amounts …

DịchGroq 3 LPX tối ưu hóa quy trình làm việc của AI Agent bằng cách giảm độ trễ tích lũy thông qua trình biên dịch xác định và bộ nhớ SRAM 128GB, giúp xử lý hàng trăm bước suy luận tuần tự nhanh chóng hơn bao giờ hết.

22/08

Thứ Bảy · 1 tin
LMSYS: Blog (nhóm Chatbot Arena)
Nghiên cứuĐiểm AI 63/100

Tinh chọnLing-3.0-flash: Tối ưu hóa độ trễ giải mã lên 54% trên 4 GPU Blackwell

Đội ngũ Ant Group và RadixArk đã tối ưu hóa mô hình Ling-3.0-flash, giúp tăng tốc độ giải mã đơn yêu cầu từ 288 lên 606 tok/s và giảm độ trễ TPOT xuống còn 1.53 ms nhờ kiến trúc MoE cải tiến.


Vì sao đáng đọc: Đây là một bước tiến kỹ thuật quan trọng trong việc tối ưu hóa suy luận mô hình MoE trên phần cứng Blackwell, mang lại giá trị thực tiễn cao cho cộng đồng kỹ thuật.

12/08

Thứ Tư · 1 tin
Tổng 4 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (17 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Độ trễ” | AIHOT.vn