24/09

Thứ Năm · 1 tin

23/09

Thứ Tư · 1 tin
vLLM Blog chính thức
Sản phẩmĐiểm AI 73/100

Tinh chọnvLLM ra mắt vllm-metal v0.28.0: Hỗ trợ phục vụ suy luận đồng thời trên Apple Silicon

vLLM chính thức phát hành vllm-metal v0.28.0, mang bộ lập lịch V1, paged KV cache và server tương thích OpenAI lên chip Apple Silicon thông qua MLX và Metal.


Vì sao đáng đọc: Lần đầu tiên chính thức phát hành vllm-metal, sử dụng packed varlen attention và paged KV để giải quyết vấn đề dịch vụ yêu cầu đồng thời trên Mac, đồng thời cung cấp dữ liệu chuẩn mực đồng thời có thể tái lập.

22/09

Thứ Ba · 1 tin

21/09

Thứ Hai · 1 tin

19/09

Thứ Bảy · 1 tin

13/09

Chủ Nhật · 1 tin
Thomas Wolf (Hugging Face đồng sáng lập/CSO)@Thom_Wolf
NgànhĐiểm AI 31/100

Đồng sáng lập Hugging Face hé lộ hệ thống AI Agent chạy trực tiếp trên thiết bị

Interesting new on-device local AI agentic system - seems to be running an open-weights 4B model qua…

DịchThomas Wolf chia sẻ về một hệ thống AI Agent chạy cục bộ đầy hứa hẹn, dường như đang vận hành mô hình mã nguồn mở 4B đã được lượng tử hóa 4-bit thông qua framework MLX.

31/08

Thứ Hai · 1 tin
karminski@karminski3
Hướng dẫnĐiểm AI 42/100

Bảng xếp hạng năng lực Agent cho các mô hình AI nhỏ: Qwen3.8-27B dẫn đầu

Karminski công bố bảng xếp hạng khả năng làm Agent của các mô hình nhỏ, trong đó Qwen3.8-27B-UD-Q4_K_XL được đánh giá cao nhất. Bài viết cũng chia sẻ cấu hình tối ưu cho lập luận và lập trình, cùng lời khuyên sử dụng MLX cho người dùng Mac để đạt tốc độ tốt hơn.

20/08

Thứ Năm · 1 tin
Sky Computing Lab@haoailab
Sản phẩmĐiểm AI 71/100

Tinh chọnFastMetal: Tạo video ngay trên Mac chỉ trong 30 giây mà không cần GPU rời

A 5-second 480P video, generated entirely on a Mac, in 30 seconds. No CUDA, no cloud, 3.9 GiB of mem…

DịchFastMetal mang mô hình FastWan-QAD lên chip Apple Silicon, cho phép tạo video 480P chỉ trong 30 giây với 3.9GB RAM mà không cần CUDA hay điện toán đám mây.


Vì sao đáng đọc: Công nghệ đột phá cho người dùng Mac, tối ưu hóa hiệu suất cực tốt trên phần cứng Apple Silicon mà không phụ thuộc vào cloud.
Tổng 8 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (25 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “MLX” | AIHOT.vn