This is exactly what MiniCPM5-2B was built for 🚀Love seeing @atomic_chat_hq run it locally on a 16G…
DịchMô hình MiniCPM5-2B của OpenBMB đã được chạy thành công trên MacBook 16GB, cho thấy khả năng xử lý thông minh và tích hợp tìm kiếm web vượt trội so với Qwen3.5-4B. Hiện mô hình đã có sẵn trên Hugging Face cho người dùng trải nghiệm.
Hy4 preview is now available on WorkBuddy, where users can switch between Work and Coding tasks. Th…
DịchTencent Hy4 Preview đã có mặt trên WorkBuddy, cho phép xử lý đa nhiệm từ viết code đến làm việc. Nhờ công nghệ nén MIX-STQ1_0, mô hình chỉ còn 200GiB GGUF, giúp chạy cục bộ mà vẫn giữ được độ chính xác gần như tương đương bản gốc BF16.
Đánh giá khả năng vận hành mô hình Qwen 2.5 27B trên Mac Studio M3 Ultra thông qua Ollama. Với định dạng lượng tử hóa Q4_K_M, mô hình đạt tốc độ phản hồi ấn tượng khoảng 14 tokens/giây.
Vì sao đáng đọc: Bài viết cung cấp dữ liệu thực tế hữu ích cho người dùng muốn chạy mô hình ngôn ngữ lớn trên phần cứng Apple Silicon, có tính ứng dụng cao.
IBM vừa trình làng Granite 4.2 với ba phiên bản 3B, 8B và 30B, hỗ trợ cửa sổ ngữ cảnh 128k token. Các phiên bản lớn được tối ưu hóa cho tác vụ đại lý (agentic), cho phép thực thi lệnh và sử dụng công cụ ngoại vi ngay trên thiết bị cá nhân.
Beautiful visual of somebody running, qwen 3.8 27B locally on a RTX 5090 32 GB VRAM system with 115 …
DịchMột bản demo cho thấy Qwen3.8 27B đạt tốc độ ấn tượng 115 tokens/giây khi chạy local trên RTX 5090 32GB VRAM. Cần lưu ý rằng phiên bản BF16 gốc của mô hình này có dung lượng lên tới 55.6 GB.