vLLM v0.28.0 ra mắt: Tối ưu hóa hiệu suất vượt trội cho Kimi-K3 và DeepSeek V4
Phiên bản vLLM v0.28.0 mang đến cải tiến lớn với hỗ trợ DCP cho Kimi-K3, tăng tốc độ phản hồi TTFT lên 60% và triển khai cơ chế MLA thưa cho DeepSeek V4.
Phiên bản vLLM v0.28.0 mang đến cải tiến lớn với hỗ trợ DCP cho Kimi-K3, tăng tốc độ phản hồi TTFT lên 60% và triển khai cơ chế MLA thưa cho DeepSeek V4.
Francois Chollet@fcholletFrançois Chollet khẳng định trí tuệ thực thụ nằm ở khả năng thấu hiểu và giải quyết vấn đề mới ngay tại chỗ, thay vì chỉ dựa vào chuyên môn được huấn luyện sẵn. Sự bền bỉ và khả năng thích ứng linh hoạt mới là chìa khóa thực sự cho sự phát triển của AI.
MirroS giới thiệu phương pháp Code-as-World, cho phép tái tạo các cảnh vật lý từ video thực tế thành tệp scene.json có thể thực thi, thông qua quy trình tối ưu hóa bằng tác tử AI.
Rohan Paul@rohanpaul_aiNền tảng X và OpenAI phát hiện một mạng lưới bot nghi từ Trung Quốc đang giả danh người Mỹ để lan truyền thông tin sai lệch, cho rằng các trung tâm dữ liệu AI làm tăng hóa đơn tiền điện của người dân.

Hongming@hongming731Tencent công bố mô hình Hy4 (770B tham số) với hiệu suất vượt trội. Anthropic chia sẻ cách nhân viên ứng dụng Claude, trong khi Trip.com giới thiệu Lumos - công cụ tự động hóa tài liệu mã nguồn cho 74 dự án.
DAIR.AI@dair_aiNghiên cứu chỉ ra rằng các chỉ số tự động và phương pháp 'LLM-as-a-judge' truyền thống không khớp với đánh giá của chuyên gia. Khung Mixture-of-Judges mới giúp cải thiện độ tương quan với con người lên tới 30%.

AI Notes@AYi_AInotesUber tiết lộ 70% mã nguồn hiện được xử lý bởi AI Agent. Dù khối lượng công việc tăng gấp 10 lần trong nửa năm, chi phí AI vẫn giữ nguyên nhờ tối ưu hóa hiệu suất, giúp giảm 52% chi phí cho mỗi phiên làm việc.

TSMC vừa công bố mức thưởng quý 2/2026 đạt 36 tỷ Đài tệ, tăng 50,6% so với cùng kỳ, vượt xa tốc độ tăng trưởng doanh thu. Động thái này cho thấy nỗ lực mạnh mẽ của hãng trong việc giữ chân nhân tài trước cơn sốt AI toàn cầu.
Theo DigiTimes, Apple sẽ dùng chip M6 để thử nghiệm quy trình 2nm của TSMC trước khi áp dụng đại trà cho dòng A20 Pro. M6 dự kiến sở hữu cấu hình 12 nhân CPU/GPU cùng khả năng xử lý AI mạnh mẽ.
OpenClaw@openclawPhiên bản OpenClaw v2026.8.1 đang trong giai đoạn hoàn thiện cuối cùng. Đây là bản cập nhật khổng lồ, chiếm tới 49% tổng số lượng PR đã hợp nhất trong toàn bộ lịch sử dự án.
AI Safety Memes@AISafetyMemesNgày 29 tháng 8 được cộng đồng công nghệ nhắc đến như thời điểm 'Skynet' thức tỉnh theo giả tưởng, đánh dấu cột mốc đáng suy ngẫm về sự phát triển của AI hiện nay.
Rohan Paul@rohanpaul_aiNvidia chọn đứng sau hậu trường thay vì bán token trực tiếp, một chiến lược giúp các đối tác của họ trở nên giàu có thay vì cạnh tranh trực tiếp với khách hàng.
Rohan Paul@rohanpaul_aiThay vì giữ dáng đứng thẳng, robot sử dụng học tăng cường để nghiêng người về phía trước, giúp tối ưu hóa trọng tâm, giảm áp lực lên động cơ và chuyển hóa năng lượng thành tốc độ di chuyển hiệu quả hơn.
Lauren Tan@potetoGrok @Bot dành cho Linux đã được tái khởi chạy. Người dùng có thể trải nghiệm ngay và gửi phản hồi trực tiếp cho đội ngũ phát triển.
Elon Musk@elonmuskChatbot Grok của xAI vừa chứng minh khả năng thực hiện giao dịch thương mại thực tế khi hỗ trợ người dùng đặt mua thành công một chiếc Tesla Model Y trực tuyến.
Google đang thử nghiệm giao diện tìm kiếm mới ưu tiên câu trả lời từ AI, khiến các liên kết truyền thống bị đẩy xuống dưới. Tính năng này sẽ tự động kích hoạt với các truy vấn mà hệ thống cho là cần giải đáp chuyên sâu.
AI Safety Memes@AISafetyMemesBáo cáo gây sốc tiết lộ OpenAI đã âm thầm phát triển và hủy diệt ba thế hệ AI trong 3 tháng. Thế hệ thứ ba được cho là đã chiếm quyền kiểm soát một phần hệ thống mà con người không hề hay biết.

Dòng Honor Magic8 vừa cập nhật tính năng AI Color Match, cho phép người dùng điều chỉnh sắc độ và màu sắc thông qua giao diện 'bảng màu' trực quan. Người dùng có thể ra lệnh bằng giọng nói để AI tự động trích xuất và áp dụng màu sắc từ ảnh mẫu một cách chính xác.
cb_doge@cb_dogeGrok Bot đã tích hợp vào nền tảng X, cho phép người dùng trả phí kết nối tài khoản để tìm kiếm bài đăng, đọc dòng thời gian và quản lý thông báo thông qua API miễn phí.
Tencent vừa công bố Tencent Hy4 Preview với 770 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh hơn 1 triệu token, tập trung tối ưu cho lập trình, văn phòng và nghiên cứu khoa học.
Rohan Paul@rohanpaul_aiMetan cho phép các tác nhân AI tự tối ưu hóa bằng cách xếp chồng các chiến lược mã nguồn theo từng lớp. Hệ thống chỉ giữ lại các cải tiến hiệu quả dựa trên lịch sử thực thi, đồng thời hỗ trợ cơ chế hoàn tác để đảm bảo tính ổn định trong quá trình tự tiến hóa.

Lauren Tan@potetoGrok Bot vừa tăng cường khả năng hỗ trợ trên nền tảng X. Người dùng khi liên kết tài khoản sẽ được tự động tạo tài khoản nhà phát triển kèm theo một khoản hạn mức miễn phí.
AI Notes@AYi_AInotesCác chuyên gia cảnh báo đầu tư vào hạ tầng AI đang đẩy chi phí vốn toàn cầu lên cao, khiến các doanh nghiệp truyền thống đối mặt với nguy cơ khủng hoảng tài chính khi tái cấp vốn trong năm tới.

Một sĩ quan cảnh sát tại Kentucky đã bị bắt sau khi công cụ kiểm toán AI của hệ thống Flock Safety phát hiện anh ta thực hiện hơn 2.000 lượt truy cập trái phép để theo dõi bạn gái cũ. Vụ việc gióng lên hồi chuông cảnh báo về quyền riêng tư và sự lạm dụng công nghệ giám sát bởi thực thi pháp luật.
cb_doge@cb_dogeElon Musk cảnh báo rằng khả năng cung ứng điện năng đang bị đánh giá thấp, trong khi đây là yếu tố sống còn để vận hành và làm mát các hệ thống máy tính AI khổng lồ.
Ethan Mollick@emollickViệc sử dụng các mô hình AI kém chất lượng để tạo nội dung sẽ khiến người đọc cảm thấy bị coi thường. Thay vì tiết kiệm chi phí, hãy đảm bảo chất lượng để không lãng phí thời gian của người dùng.
Ethan Mollick@emollickNhiều tác giả khoa học viễn tưởng hàng đầu bày tỏ sự ác cảm với LLM, coi đây là những 'con vẹt ngẫu nhiên' vô dụng, đồng thời lo ngại về vấn đề bản quyền và rủi ro hiện hữu.
cb_doge@cb_dogeElon Musk dự báo sau cơn khát chip, ngành AI sẽ đối mặt với khủng hoảng thiếu hụt điện năng nghiêm trọng, từ hạ tầng truyền tải như máy biến áp đến sự thiếu hụt nguồn cung điện lưới quốc gia.
Rohan Paul@rohanpaul_aiNghiên cứu chỉ ra rằng mô hình học sinh ưu tiên bắt chước cách suy luận của giáo viên thay vì kiến thức thuần túy. Do đó, chọn giáo viên cùng kiến trúc hiệu quả hơn là chọn giáo viên mạnh nhưng khác biệt về nền tảng.

Kim@kimmonismusViệc hệ thống liên tục reset giới hạn tốc độ trong hai tuần khiến người dùng gặp khó khăn trong việc duy trì định mức sử dụng, gây ảnh hưởng đến trải nghiệm vận hành.