04/09

Thứ Sáu · 4 tin

03/09

Thứ Năm · 9 tin
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 40/100

Perplexity ra mắt phiên bản chạy cục bộ trên Linux cho GPU NVIDIA RTX

Portable Computer (fully local runtime of Perplexity Computer) is now compatible with RTX (Linux). W…

DịchCEO Aravind Srinivas thông báo Portable Computer của Perplexity đã hỗ trợ chạy cục bộ trên Linux với GPU NVIDIA RTX (yêu cầu VRAM từ 24GB trở lên), phiên bản Windows sẽ sớm ra mắt.

ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 18/100

OpenBMB giới thiệu MiniCPM Agent Gateway: Hệ thống định tuyến Agent ưu tiên quyền riêng tư

What if your AI agents could be lightning-fast, privacy-first, and smart enough to handle complex mu…

DịchMiniCPM Agent Gateway là hệ thống định tuyến Agent tập trung vào chất lượng và tính cục bộ, được xây dựng trên nền tảng NVIDIA-NeMo/Switchyard. Giải pháp này tối ưu hóa tốc độ và bảo mật cho các tác vụ đa phương thức phức tạp.

Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 60/100

Perplexity ra mắt Lily: Công cụ suy luận cục bộ tối ưu cho Mac

We're open-sourcing Lily, Perplexity's local inference engine for serving models locally on Apple Si…

DịchPerplexity vừa mã nguồn mở Lily, công cụ suy luận được tối ưu hóa cho chip Apple Silicon để chạy mô hình Qwen3.6-35B-A3B, giúp tăng tốc các tác vụ tính toán hỗn hợp trên Mac mà không phụ thuộc vào điện toán đám mây.

Thêm 1 nguồn khác đưa tinMarkTechPost
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 31/100

Perplexity trình diễn khả năng chạy hoàn toàn cục bộ trên hệ thống NVIDIA DGX Spark

Live demo of Perplexity Computer running fully local on DGX Spark

DịchCEO Aravind Srinivas vừa chia sẻ video trực tiếp cho thấy Perplexity Computer vận hành trơn tru trên phần cứng DGX Spark của NVIDIA mà không cần kết nối đám mây, khẳng định bước tiến mới trong việc triển khai AI cục bộ.

02/09

Thứ Tư · 2 tin
IT Home
Sản phẩmĐiểm AI 46/100

Cùng sự kiệnNubia NaviX Ultra lộ diện: Smartphone AI tích hợp Doubao dự kiến ra mắt tháng 9

Nubia NaviX Ultra vừa đạt chứng nhận mạng, dự kiến lên kệ vào tháng 9 với trợ lý AI Doubao tích hợp sâu. Thiết bị tập trung vào khả năng xử lý cục bộ, cho phép AI điều khiển ứng dụng thông qua giao thức MCP thay vì mô phỏng thao tác chạm truyền thống.

Cùng sự kiện, bài đại diện «Nubia NaviX Ultra chính thức lộ diện: Chip Snapdragon, màn hình BOE và tích hợp trợ lý AI Doubao»
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 27/100

CEO Perplexity sắp trình diễn khả năng chạy AI cục bộ trên NVIDIA DGX Spark

Live demo of Portable Computer (aka a fully local runtime of Perplexity Computer) on DGX Spark

DịchCEO Aravind Srinivas sẽ livestream demo 'Perplexity Computer' chạy hoàn toàn cục bộ trên hệ thống NVIDIA DGX Spark vào ngày 2/9. Buổi trình diễn hứa hẹn giới thiệu các tính năng phân tích tài liệu bảo mật và kết nối công cụ chuyên sâu.

01/09

Thứ Ba · 2 tin
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 54/100

Cùng sự kiệnPerplexity ra mắt tính năng tính toán lai (hybrid compute) trên ứng dụng Mac

We're introducing hybrid compute for all users of the Perplexity Mac app. This will allow Computer…

DịchPerplexity vừa cập nhật tính năng hybrid compute cho ứng dụng Mac, cho phép chạy các mô hình AI cục bộ để xử lý dữ liệu nhạy cảm như báo cáo y tế hay tài liệu thuế, giúp đảm bảo quyền riêng tư tối đa cho người dùng.

Cùng sự kiện, bài đại diện «Perplexity ra mắt tính năng tính toán lai: Chuyển đổi linh hoạt giữa Cloud và Mac cục bộ»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 61/100

Biến camera an ninh thành hệ thống nhận diện chim tự động với BirdNet-Go

Tận dụng micro từ camera an ninh sẵn có để chạy BirdNet-Go, giúp nhận diện hơn 14.000 loài chim, dơi và ếch cục bộ 24/7 mà không tốn phí thuê bao. Hệ thống hỗ trợ tích hợp Home Assistant và gửi thông báo qua Discord.

31/08

Thứ Hai · 1 tin

30/08

Chủ Nhật · 1 tin
JiQiZhiXin
Sản phẩmĐiểm AI 88/100

Tinh chọnPortable Computer: Giải pháp AI chạy cục bộ với Qwen 2.8-27B giúp tối ưu chi phí suy luận

Perplexity giới thiệu Portable Computer, khung làm việc cho phép chạy các mô hình như Qwen 2.8-27B ngay trên thiết bị cá nhân, giúp bảo mật dữ liệu và loại bỏ chi phí API cho các tác vụ AI thông thường.


Vì sao đáng đọc: Bài viết đề cập đến xu hướng 'Local-first' rất thực tế, giải quyết bài toán chi phí và bảo mật dữ liệu cho người dùng doanh nghiệp và cá nhân khi sử dụng AI agent.

28/08

Thứ Sáu · 3 tin
ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 49/100

MiniCPM-o 4.5 đã hỗ trợ chạy mượt mà trên chip Apple Silicon nhờ TyloQuant MFQ

MiniCPM-o 4.5 now runs efficiently on Apple Silicon with TyloQuant MFQ! 🥰 The team at @Tylogi_ai h…

DịchMô hình MiniCPM-o 4.5 hiện đã có thể chạy cục bộ trên chip Apple Silicon thông qua kỹ thuật lượng tử hóa TyloQuant MFQ, giúp tối ưu bộ nhớ mà vẫn giữ nguyên khả năng xử lý đa phương thức và tương tác thời gian thực.

27/08

Thứ Năm · 2 tin
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Hướng dẫnĐiểm AI 35/100

CEO Perplexity: Phần cứng tích hợp AI cục bộ sẽ là cửa ngõ tiếp cận các mô hình tiên tiến

Hardware like DGX Spark, with a local agentic computer, will become the gateway for consuming fronti…

DịchCEO Perplexity dự báo thiết bị tích hợp AI cục bộ sẽ xử lý 90% tác vụ, giúp giảm 10 lần chi phí bằng cách tối ưu hóa token trước khi gửi lên mô hình đám mây.

26/08

Thứ Tư · 4 tin
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 49/100

Mô hình Qwen3.8-Flash 125B: Chạy mượt mà trên máy tính cá nhân với 75GB RAM

A high-performance 125B model now running locally on just 75GB RAM! Thank you @UnslothAI for the day…

DịchNhờ sự hỗ trợ từ UnslothAI, mô hình mạnh mẽ 125B của Alibaba giờ đây đã có thể vận hành cục bộ chỉ với 75GB RAM, mở ra khả năng tiếp cận AI hiệu năng cao cho người dùng cá nhân.

AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 56/100

Chọn Mac chạy AI nội bộ: Đừng nhìn điểm CPU, hãy ưu tiên RAM thống nhất

Thay vì dựa vào điểm hiệu năng CPU, người dùng nên ưu tiên dung lượng RAM thống nhất khi chọn Mac để chạy AI cục bộ. Tùy vào nhu cầu từ nhẹ đến chuyên sâu, hãy cân nhắc các cấu hình từ 16GB đến 64GB RAM để tối ưu hóa khả năng xử lý mô hình.

Perplexity@perplexity_ai
Sản phẩmĐiểm AI 48/100

Perplexity ra mắt Portable Computer: Trợ lý AI cục bộ mạnh mẽ và bảo mật

New research: Portable Computer is a local-first agent for private and cost-effective work. With an…

DịchPerplexity giới thiệu Portable Computer, một tác nhân AI chạy cục bộ với mô hình 27B, giúp tối ưu hóa công việc tri thức với độ bảo mật cao và chi phí thấp, vượt qua các khung làm việc mã nguồn mở hiện nay.

Thêm 1 nguồn khác đưa tinIT Home

25/08

Thứ Ba · 8 tin
Perplexity@perplexity_ai
Sản phẩmĐiểm AI 53/100

Perplexity ra mắt 'Máy tính di động' chạy cục bộ trên NVIDIA DGX Spark

Today we're launching Portable Computer on @NVIDIA DGX Spark. Portable Computer is a fully local ve…

DịchPerplexity vừa giới thiệu phiên bản Portable Computer chạy hoàn toàn cục bộ trên phần cứng NVIDIA DGX Spark, cho phép vận hành toàn bộ quy trình LLM và tác nhân AI mà không cần dựa vào đám mây.

Thêm 3 nguồn khác đưa tinX: Aravind Srinivas (Perplexity CEO) (@AravSrinivas)MarkTechPostX: Testing Catalog (@testingcatalog)
Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 42/100

Perplexity ra mắt tính năng Portable Computer trên NVIDIA DGX Spark

PERPLEXITY 🔥: Perplexity Pro and Max subscribers can now use a new Portable Computer on DGX Spark f…

DịchNgười dùng Perplexity Pro và Max hiện có thể chạy các mô hình AI cục bộ mạnh mẽ như PPLX 27B và Qwen 3.8 27B trực tiếp trên thiết bị NVIDIA DGX Spark, mang lại trải nghiệm xử lý dữ liệu riêng tư và tốc độ cao.

Thêm 2 nguồn khác đưa tinX: Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPost
Ars Technica: AI
Sản phẩmĐiểm AI 57/100

Cùng sự kiệnApple ra mắt Mac mini và Mac Studio mới, tối ưu hóa cho AI cục bộ

Apple vừa trình làng Mac mini và Mac Studio mới với chip M6 (2nm) và M5 Ultra, tập trung mạnh mẽ vào khả năng xử lý AI cục bộ nhờ kiến trúc bộ nhớ thống nhất và hiệu suất GPU vượt trội.

Cùng sự kiện, bài đại diện «Apple ra mắt chip M6 và M5 Ultra: Bước nhảy vọt về hiệu năng và sức mạnh AI»
Kim@kimmonismus
Sản phẩmĐiểm AI 60/100

Cùng sự kiệnApple ra mắt chip M6 và M5 Ultra: Bước nhảy vọt về hiệu năng AI cục bộ

Huge upgrade for local AI: Apple introduces M6 and M5 Ultra for a "big leap in performance and AI co…

DịchApple chính thức trình làng dòng chip M6 và M5 Ultra với trọng tâm là khả năng xử lý AI cục bộ. Trong đó, M6 đạt tốc độ xử lý LLM nhanh gấp 4,8 lần so với M4, băng thông bộ nhớ 170GB/s và tích hợp hệ thống Neural Engine kép mạnh mẽ.

Cùng sự kiện, bài đại diện «Apple ra mắt chip M6 và M5 Ultra: Bước nhảy vọt về hiệu năng và sức mạnh AI»
Kim@kimmonismus
Sản phẩmĐiểm AI 20/100

Apple sắp ra mắt Mac mini mới: Cấu hình mạnh mẽ cho tác vụ AI

Nice: Apple may launch an M5 or M6 Mac mini before its iPhone keynote, "as soon as the coming days" …

DịchApple dự kiến trình làng Mac mini thế hệ mới trong vài ngày tới sau gần 2 năm chờ đợi. Thiết bị được kỳ vọng sẽ đáp ứng nhu cầu chạy các ứng dụng AI cục bộ đang tăng cao, vốn đang gây ra tình trạng khan hiếm nguồn cung cho các phiên bản hiện tại.

Cohere@cohere
NgànhĐiểm AI 39/100

Cohere trở thành mô hình mặc định trên Superwhisper

Supertranscribe = S-tier. Cohere is now the default local model for @superwhisper onboarding. Dicta…

DịchSuperwhisper đã tích hợp Cohere làm mô hình mặc định cho trải nghiệm chuyển đổi giọng nói thành văn bản cục bộ, cho phép người dùng ghi chú ý tưởng ngay trên thiết bị mà không cần kết nối internet.

Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 35/100

Mô hình Qwen2.5 27B hiện đã hỗ trợ kiểm thử hiệu năng trên nền tảng Optima

You can now benchmark Qwen3.8 27B with Optima. See how a model that can run on your laptop compares …

DịchBạn có thể sử dụng Optima để đánh giá hiệu suất, chi phí và tốc độ của mô hình Qwen2.5 27B trên các tác vụ thực tế ngay trên máy tính cá nhân. Artificial Analysis cũng cung cấp hỗ trợ tư vấn và tín dụng miễn phí cho các doanh nghiệp muốn xây dựng bộ kiểm thử riêng.

24/08

Thứ Hai · 2 tin
Yuchen Jin@Yuchenj_UW
Hướng dẫnĐiểm AI 36/100

Tốc độ chạy mô hình AI cục bộ trên PC gaming tăng gấp 12 lần sau 3 năm

2024: A gaming PC with a RTX 4090 ran Llama 3 70B at ~2 tok/s in 4-bit. 2026: A gaming PC with a RT…

DịchTừ mức 2 tok/s trên RTX 4090 năm 2024, tốc độ chạy mô hình AI cục bộ dự kiến đạt 24 tok/s trên RTX 5090 vào năm 2026, mở ra khả năng chạy các mô hình thông minh cấp độ cao ngay tại nhà.

23/08

Chủ Nhật · 1 tin

22/08

Thứ Bảy · 2 tin
Yuchen Jin@Yuchenj_UW
Sản phẩmĐiểm AI 43/100

UC Berkeley ra mắt FreeToken: Tăng tốc suy luận AI cục bộ lên gấp 4 lần

UC Berkeley open-sourced FreeToken. Wild results: A single RTX PRO 6000 runs the 753B GLM-5.2 at 14…

DịchFreeToken từ UC Berkeley cho phép chạy các mô hình lớn như GLM-5.2 hay Qwen3.6 trên GPU phổ thông với tốc độ nhanh gấp 2-4 lần so với Ollama mà không cần nén mô hình quá mức.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (63 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI cục bộ” — Trang 2 | AIHOT.vn