Dữ liệu từ Kernel Insight cho thấy chi phí sản xuất 1b DRAM đang cao hơn đáng kể so với tiến trình 2nm của TSMC do nhu cầu khổng lồ từ máy chủ AI, gây ra tình trạng giá bộ nhớ tăng cao.
A model's context window does not have to be an agent's workspace limit. KVMEM makes million-token …
DịchKVMEM áp dụng kỹ thuật phân trang trạng thái KV cũ giúp AI Agent xử lý hàng triệu token hiệu quả hơn. Công nghệ này cải thiện đáng kể độ chính xác trên DeepSWE và tăng tốc độ truy xuất dữ liệu gấp nhiều lần so với các phương pháp nén truyền thống.
Viện Bán dẫn CAS vừa công bố nghiên cứu về cấu trúc đường hầm sắt điện trượt đạt tỷ lệ TER 1,9×10^7, với tốc độ chuyển đổi nan giây, tiêu thụ năng lượng cực thấp và độ bền lên tới 10^11 chu kỳ.
If 1 agent task launches many sandboxes, manage their memory together AgentZip shows that much of t…
DịchAgentZip tối ưu hóa hiệu suất bằng cách nén các dữ liệu trùng lặp trong bộ nhớ giữa các sandbox tác nhân AI. Công nghệ này giúp giảm tới 88,55% dung lượng bộ nhớ dư thừa khi chạy nhiều tác nhân từ cùng một khuôn mẫu, đặc biệt hiệu quả trong thời gian chờ phản hồi từ LLM.
Cố vấn cấp cao của Micron nhận định tình trạng thiếu hụt bộ nhớ đang lan rộng trên toàn thị trường và chưa có dấu hiệu cân bằng cung cầu rõ ràng trước năm 2028.
Tại hội nghị hạ tầng AI, Samsung công bố công nghệ bộ nhớ zHBM thế hệ mới, kỳ vọng nâng tốc độ xử lý từ 100 lên 1.000 token mỗi giây cho mỗi người dùng.
Very cool paper on memory compression for agents. If you run many agent sandboxes in parallel for R…
DịchCác nhà nghiên cứu từ HKUST giới thiệu AgentZip, kỹ thuật tối ưu hóa bộ nhớ cho các sandbox AI Agent bằng cách loại bỏ dữ liệu dư thừa, giúp giảm mức sử dụng RAM lên đến 8,7 lần mà vẫn duy trì hiệu suất ổn định.
Nice paper to improve inference efficiency. It's been a while we haven't seen good work on efficien…
DịchKVMem tối ưu hóa bộ nhớ cho AI Agent bằng cách phân trang và lưu trữ trạng thái KV trên GPU, RAM và NVMe. Hệ thống sử dụng cơ chế chỉ mục chú ý để truy xuất thông tin lịch sử liên quan, giúp xử lý ngữ cảnh siêu dài một cách hiệu quả.
Đối mặt với tình trạng khan hiếm và chi phí bộ nhớ cao, Google đang tận dụng RAM DDR4 từ các máy chủ cũ thông qua bộ chuyển đổi chuyên dụng để thay thế DDR5 trong một số hệ thống AI, đồng thời tối ưu hóa thuật toán để giảm tải áp lực bộ nhớ.
Kỷ nguyên AI tạo ra nhu cầu khổng lồ về bộ nhớ, khiến giá RAM và lưu trữ trên smartphone tăng phi mã, vượt qua cả chi phí sản xuất chip xử lý vốn là linh kiện đắt đỏ nhất trước đây.
Do chi phí bộ nhớ và chip tăng cao kỷ lục, các hãng điện thoại buộc phải cắt giảm mạnh kế hoạch sản xuất flagship. Dự báo giá linh kiện sẽ tiếp tục neo ở mức cao trong ít nhất 6 quý tới do ảnh hưởng từ cơn sốt AI và sự khan hiếm nguồn cung.
Everyone's asking whether the memory BOM shock is actually hitting the consumer. It is. And we have…
DịchDữ liệu mới nhất xác nhận rằng sự biến động trong chi phí linh kiện (BOM) của bộ nhớ không còn chỉ nằm ở quy mô sản xuất mà đã bắt đầu tác động trực tiếp đến giá thành sản phẩm cuối cùng trên thị trường.
Google sắp áp đặt giới hạn sử dụng bộ nhớ mới cho ứng dụng Android, trong bối cảnh cơn sốt AI gây thiếu hụt phần cứng, đe dọa trực tiếp đến hiệu năng của các dòng điện thoại giá rẻ.
Prefix Sliding giúp giảm bộ nhớ suy luận xuống mức hằng số bằng cách loại bỏ các token trung gian không cần thiết, giúp tăng tốc độ xử lý gấp 3 lần mà không cần huấn luyện lại.
Gartner dự báo thị trường bộ nhớ sẽ bùng nổ đạt 837,3 tỷ USD vào năm 2026, vượt qua tổng doanh thu toàn ngành bán dẫn năm 2025 nhờ sự thúc đẩy mạnh mẽ từ hệ sinh thái trung tâm dữ liệu AI.
Vì sao đáng đọc: Thông tin quan trọng từ Gartner về sự chuyển dịch cán cân quyền lực trong ngành bán dẫn, phản ánh tác động trực tiếp của AI đến nhu cầu phần cứng toàn cầu.
Nhu cầu AI làm tăng giá bộ nhớ, đẩy giá thiết bị điện tử lên cao và khiến nhu cầu thị trường màn hình phẳng sụt giảm. Tuy nhiên, phân khúc màn hình OLED và màn hình ô tô vẫn duy trì đà tăng trưởng tích cực.
Bài viết thực hiện kỹ thuật đảo ngược đường dẫn phần cứng trên RTX 4090, làm sáng tỏ cơ chế phân mảnh cache L1/L2 và hàm băm địa chỉ phức tạp. Tác giả cung cấp mã nguồn dự đoán phân mảnh cho các dòng GPU cao cấp như 4090 và L40S.
CEO Sanjay Mehrotra khẳng định AI đang tạo ra nhu cầu bền vững cho bộ nhớ hiệu năng cao, không chỉ từ trung tâm dữ liệu mà còn từ xe tự lái và robot. Micron đang mở rộng sản xuất để đáp ứng nhu cầu vượt quá 50% khả năng cung ứng hiện tại.
Micron công bố đầu tư 10 tỷ USD trong thập kỷ tới để thành lập phòng thí nghiệm nghiên cứu chuyên sâu về công nghệ bộ nhớ, kiến trúc tính toán và đóng gói chip thế hệ mới tại Mỹ.
Việc ưu tiên nguồn lực cho hạ tầng AI đã đẩy giá DRAM và NAND lên cao, buộc các ông lớn như Apple, Samsung, Lenovo phải tăng giá bán máy tính bảng, dẫn đến nhu cầu tiêu dùng sụt giảm mạnh.
Chủ tịch Xiaomi Lư Vĩ Băng dự báo đà tăng giá bộ nhớ sẽ chậm lại trong nửa cuối năm 2026 dù chi phí vẫn ở mức cao. Hãng đang tối ưu hóa cấu trúc sản phẩm và tăng giá bán trung bình để duy trì lợi nhuận trong bối cảnh thị trường smartphone và xe điện tăng trưởng mạnh.
SanDisk giới thiệu công nghệ bộ nhớ HBF (High Bandwidth Flash) với băng thông tương đương HBM nhưng dung lượng gấp 8-16 lần, giúp tối ưu hiệu suất chạy mô hình AI lớn với ít GPU hơn.