21/08

Thứ Sáu · 2 tin
Pandaily
Mô hìnhĐiểm AI 92/100

Tinh chọnQwen3.8-27B: 'Kẻ hủy diệt' mới cho người dùng cá nhân với sức mạnh ngang ngửa Opus 4.6

Qwen3.8-27B đang gây sốt khi đạt hiệu năng tiệm cận các mô hình hàng đầu dù chỉ chạy trên GPU tiêu dùng 24GB. Đây hiện là thước đo mới cho cộng đồng mã nguồn mở.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến đột phá của mô hình mã nguồn mở, có tác động lớn đến cộng đồng phát triển AI và người dùng phần cứng cá nhân.

20/08

Thứ Năm · 4 tin

19/08

Thứ Tư · 5 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

PTXBench: Đánh giá và tối ưu hóa nhân GPU cho LLM bằng mã PTX đặc thù kiến trúc

PTXBench là bộ benchmark mới đánh giá khả năng tối ưu hóa nhân GPU của LLM thông qua mã PTX trên H100 và B200. Kết quả cho thấy các mô hình hiện nay vẫn gặp khó khăn trong việc đạt hiệu suất tương đương với các thư viện chuyên dụng, đặc biệt là trong các tác vụ Attention phức tạp.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 51/100

Agentic ESOpt: Đột phá tinh chỉnh tác nhân LLM với chi phí GPU cực thấp

Agentic ESOpt là khung tinh chỉnh toàn tham số dựa trên chiến lược tiến hóa, cho phép tối ưu hóa các tác nhân LLM mà chỉ cần bộ nhớ GPU ở mức suy luận, vượt trội hơn hẳn các phương pháp học tăng cường truyền thống.

Simon Willison Blog
Sản phẩmĐiểm AI 52/100

Cùng sự kiệnNgôn ngữ lập trình Mojo chính thức mở mã nguồn, cấp phép Apache 2 cho trình biên dịch

Sau khi ra mắt phiên bản 1.0, Mojo đã chính thức mở mã nguồn trình biên dịch và bộ công cụ theo giấy phép Apache 2. Ngôn ngữ này hiện định vị là một thực thể độc lập, tập trung tối ưu hóa lập trình GPU với cú pháp gần gũi như Python.

Cùng sự kiện, tinh chọn hiển thị «Ngôn ngữ lập trình Mojo chính thức mã nguồn mở, công khai toàn bộ trình biên dịch»

18/08

Thứ Ba · 5 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 42/100

Qwen3.8-27B: Sức mạnh ngang tầm Opus trên GPU tiêu dùng

Somebody running an Opus 4.6-level intelligence on consumer GPU. Qwen3.8-27B-GGUF doing 80 tok/s on…

DịchMô hình Qwen3.8-27B đạt hiệu năng vượt trội so với Claude 3 Opus trong các bài kiểm tra lập trình và kiến thức, chạy mượt mà trên 2 card RTX 4090 với tốc độ 80 tok/s và cửa sổ ngữ cảnh lên tới 262k token.

Thêm 1 nguồn khác đưa tinPandaily
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnDumpsterCluster: Tận dụng GPU cũ giá rẻ để chạy mô hình LLaMA-70B

Nghiên cứu này chứng minh khả năng xây dựng cụm máy chủ 128 GPU từ linh kiện cũ để chạy suy luận LLM với chi phí thấp hơn đáng kể so với phần cứng hiện đại, đồng thời phân tích tính bền vững và hiệu quả kinh tế của giải pháp này.


Vì sao đáng đọc: Chủ đề cực kỳ thực tế và thú vị về việc tái chế phần cứng cũ để tối ưu chi phí hạ tầng AI, một vấn đề đang được cộng đồng công nghệ quan tâm sâu sắc.
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 35/100

Meta FAIR ra mắt mô hình RPM: Dự đoán hiệu quả thay vì tốn tài nguyên GPU để thử nghiệm ý tưởng AI

AI research agents can generate experiment ideas faster than they can afford to run them. This Meta…

DịchMeta FAIR giới thiệu mô hình ưu tiên nghiên cứu (RPM) giúp dự đoán giá trị của các ý tưởng AI trước khi chạy thực nghiệm, giải quyết bài toán thiếu hụt tài nguyên tính toán cho các tác nhân nghiên cứu tự động.

17/08

Thứ Hai · 2 tin

16/08

Chủ Nhật · 2 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 51/100

Cùng sự kiệnNVIDIA bắt tay các định chế tài chính, huy động 500 tỷ USD cho hạ tầng GPU

Interesting choice of title from The Wall Street Journal. Nvidia and 6 financial firms have signed…

DịchNVIDIA hợp tác với 6 tổ chức tài chính để thiết lập nền tảng huy động 500 tỷ USD vốn bên thứ ba, biến GPU thành tài sản thế chấp có thể thu hồi. Động thái này giúp NVIDIA củng cố vị thế độc tôn khi các ngân hàng lớn như Goldman Sachs bắt đầu cấp tín dụng dựa trên sức mạnh tính toán.

Cùng sự kiện, bài đại diện «NVIDIA bắt tay 6 ông lớn tài chính lập quỹ 500 tỷ USD thúc đẩy hạ tầng AI»

15/08

Thứ Bảy · 4 tin
Yuchen Jin@Yuchenj_UW
NgànhĐiểm AI 30/100

Scott Gray - 'Phù thủy' tối ưu hóa GPU rời bỏ OpenAI

Bob, the king of GPU kernels, left openai? GPT-6.7 will run 2x slower….

DịchScott Gray, nhân vật chủ chốt đứng sau các nhân lõi GPU của OpenAI, vừa thông báo rời công ty. Sự ra đi của ông dấy lên lo ngại về hiệu suất vận hành của các thế hệ mô hình tương lai như GPT-6.7.

Thêm 1 nguồn khác đưa tinX: AI Notes (@AYi_AInotes)
IT Home
NgànhĐiểm AI 66/100

NVIDIA bắt tay 6 ông lớn tài chính lập quỹ 500 tỷ USD thúc đẩy hạ tầng AI

NVIDIA hợp tác cùng các định chế tài chính hàng đầu như BlackRock, Goldman Sachs để huy động 500 tỷ USD xây dựng hạ tầng AI, đồng thời cam kết bảo trợ giá trị tài sản lên tới 25% cho các thiết bị GPU.

Thêm 2 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)VietnamPlus Công nghệ
QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnQwen2.5-27B: Chạy Agent 'đẳng cấp Opus' chỉ với card đồ họa phổ thông

Mô hình Qwen2.5-27B mới vừa thiết lập cột mốc ấn tượng khi vượt mặt Claude trên nhiều bảng xếp hạng, cho phép người dùng cá nhân chạy các tác nhân AI mạnh mẽ ngay trên GPU tiêu dùng.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến của mô hình mã nguồn mở, tối ưu hóa hiệu năng cho phần cứng phổ thông, có tính ứng dụng cao cho cộng đồng AI tại Việt Nam.
AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnQwen3.8-27B ra mắt: Mô hình mã nguồn mở vượt mặt Claude 3 Opus trên GPU tiêu dùng

Qwen3.8-27B chính thức phát hành, cho phép chạy cục bộ trên card đồ họa 24GB với hiệu suất lập trình và tác vụ Agent vượt trội so với Claude Opus 4.6.

Cùng sự kiện, tinh chọn hiển thị «Alibaba chính thức mã nguồn mở dòng mô hình Qwen3.8 mạnh mẽ»

14/08

Thứ Sáu · 5 tin
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 45/100

Alibaba ra mắt Qwen3.8-27B: Mô hình mạnh mẽ, chạy trên 1 GPU với ngữ cảnh lên tới 1 triệu token

One GPU, 1M context, Day-0 ready. Big props to the vLLM team for the seamless integration! 👍 Try Qwe…

DịchQwen3.8-27B sở hữu kiến trúc tối ưu cho phép chạy trên một GPU Blackwell duy nhất, hỗ trợ độ dài ngữ cảnh gốc 262K và mở rộng tới 1M token, đồng thời tích hợp sẵn công nghệ MTP giúp tăng tốc độ phản hồi vượt trội.

Thêm 1 nguồn khác đưa tinQbitAI

13/08

Thứ Năm · 6 tin
TechCrunch: AI
NgànhĐiểm AI 69/100

Nvidia huy động 500 tỷ USD xây trung tâm dữ liệu: Canh bạc tạo thị trường thứ cấp cho GPU cũ

Nvidia bắt tay với các định chế tài chính lớn để rót 500 tỷ USD vào hạ tầng AI, đồng thời cam kết bù lỗ tới 25% giá trị nếu GPU mất giá. Chiến lược này giúp thúc đẩy thị trường GPU cũ nhưng cũng tiềm ẩn rủi ro tài chính kép khi nhu cầu thị trường suy giảm.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 47/100

Ready Cohorts: Tối ưu hóa GPU cho LLM Agent bằng cách giảm thiểu độ trễ giao tiếp

Nghiên cứu giới thiệu phương pháp 'ready-cohort' nhằm xác định ranh giới thực thi trên GPU cho các tác nhân LLM, giúp giữ quyết định tại thiết bị và tăng tốc độ xử lý lên tới 2,39 lần so với cách tiếp cận truyền thống.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 46/100

Vòng đời GPU kéo dài: CoreWeave ký hợp đồng dài hạn với NVIDIA A100 đến năm 2029

Some really interesting numbers on GPU depreciation cycle. A 6-year-old NVIDIA GPU generation stil…

DịchCoreWeave kéo dài thời hạn khấu hao GPU A100 lên 6 năm và ký hợp đồng dịch vụ đến 2029, cho thấy sức sống bền bỉ của các dòng chip cũ nhờ hệ sinh thái CUDA và nhu cầu suy luận AI.

12/08

Thứ Tư · 6 tin
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnLibra: Hệ thống tối ưu hóa tài nguyên cho Agentic RL, tăng tốc độ huấn luyện gấp 3 lần

Nhóm nghiên cứu từ CUHK và HSU giới thiệu Libra, hệ thống quản lý tài nguyên đột phá giúp giải quyết tình trạng mất cân bằng tải trong huấn luyện Agentic RL, tăng hiệu suất lên gấp 3 lần so với các phương pháp truyền thống.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng về tối ưu hóa hệ thống cho AI Agents, giải quyết bài toán thực tế về hiệu suất GPU trong huấn luyện RL, có giá trị cao cho kỹ sư và nhà nghiên cứu.
Lan Xi@foxshuo
Hướng dẫnĐiểm AI 56/100

Cùng sự kiệnNvidia huy động 500 tỷ USD từ Phố Wall để cho các công ty AI vay mua GPU

Nvidia cùng các ngân hàng đầu tư lập quỹ 500 tỷ USD cho các công ty AI vay mua GPU, nhằm chia sẻ rủi ro và thúc đẩy nhu cầu hạ tầng tính toán trong cuộc đua AGI.

Cùng sự kiện, bài đại diện «NVIDIA bắt tay các ông lớn tài chính lập quỹ 500 tỷ USD, biến hạ tầng AI thành tài sản đầu tư»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (56 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “GPU” — Trang 4 | AIHOT.vn