Aravind Srinivas@Perplexity CEO
85

Sản phẩm

Perplexity ra mắt kiến trúc mô hình pplx-embed: Tối ưu độ trễ vượt trội so với vLLM

(giờ Việt Nam)

Tóm tắt AI

Perplexity vừa công bố kiến trúc phục vụ mô hình pplx-embed, giúp tăng tốc đáng kể các tác vụ embedding và reranking trên quy mô dữ liệu khổng lồ, vượt xa hiệu năng của vLLM.

Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Aravind Srinivas (Perplexity CEO) (@AravSrinivas). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.