Jason Liu@jxnlcoCodex Voice giảm một nửa độ trễ khung hình từ đầu đến cuối
Jason Liu thông báo đã tối ưu hóa thành công, giúp giảm 50% độ trễ khung hình trên Codex Voice, hứa hẹn mang lại trải nghiệm tương tác mượt mà hơn đáng kể.
Jason Liu@jxnlcoJason Liu thông báo đã tối ưu hóa thành công, giúp giảm 50% độ trễ khung hình trên Codex Voice, hứa hẹn mang lại trải nghiệm tương tác mượt mà hơn đáng kể.
Grok Bot từ x.ai đang thu hút sự chú ý lớn từ cộng đồng công nghệ khi nhanh chóng leo lên top đầu bảng xếp hạng Hacker News với lượng tương tác tăng mạnh.
opencode@opencodeDự án OpenCode Go vừa ghi nhận kỷ lục mới khi xử lý thành công 11 nghìn tỷ token chỉ trong một ngày, đánh dấu bước tiến quan trọng trong năng lực xử lý dữ liệu quy mô lớn.

SpaceXAI giới thiệu Grok Bot, hệ thống cho phép các AI tác nhân phối hợp làm việc, tự động đăng nhập ứng dụng và chia sẻ dữ liệu để xử lý tác vụ 24/7. Công cụ này hiện đang được ứng dụng nội bộ trong các khâu kỹ thuật và marketing của công ty.
Oracle đang chuẩn bị đợt sa thải mới nhằm cắt giảm chi phí vận hành, sau khi đổ hàng chục tỷ USD vào hạ tầng AI. Dù mảng điện toán đám mây tăng trưởng mạnh, áp lực nợ nần và giá cổ phiếu sụt giảm buộc công ty phải tinh giản bộ máy trước thềm quý tài chính mới.
Đại diện Doubao khẳng định không thu phí quảng cáo khách sạn, chỉ tính phí dịch vụ kênh khi có đơn hàng. Trong khi đó, tài sản của nhà sáng lập DeepSeek Lương Văn Phong tăng kỷ lục từ 1 tỷ lên 39,5 tỷ USD trong một năm.
Brad Lightcap, nhân sự chủ chốt gắn bó với OpenAI từ năm 2018, vừa thông báo rời công ty để theo đuổi dự án khởi nghiệp riêng. CEO Sam Altman đã gửi lời cảm ơn vì những đóng góp quan trọng của ông trong suốt thời gian qua.
Cựu lãnh đạo AI Lâm Tuấn Dương vừa thành lập Pragmatik Labs tại Thượng Hải, tập trung phát triển thế hệ AI Agent mới kết nối thế giới số và vật lý. Startup này đã huy động thành công hàng trăm triệu USD từ các quỹ lớn như Sequoia China và Hillhouse, đạt định giá 2 tỷ USD.
Bài viết hướng dẫn lộ trình 12 bước thực tế cho người mới, từ chuẩn bị thiết bị đến kỹ thuật đặt câu hỏi theo khung 'Bối cảnh - Nỗi đau - Nhu cầu' và cách biến kết quả thành kỹ năng tái sử dụng.
Hongming@hongming731NVIDIA trình làng mô hình Nemotron 3.5 Lightning tối ưu cho tác vụ thông minh, trong khi ứng dụng Gemini chính thức cán mốc 1 tỷ người dùng hoạt động hàng tháng.
Hongming@hongming731Alibaba chia sẻ kinh nghiệm phát triển open-code-review: đạt 20k sao sau 2 tháng, với tỷ lệ chấp nhận mã do AI đề xuất vượt mức 30% trong nội bộ.
Sophie Alpert nhấn mạnh kỹ sư phải chịu trách nhiệm hoàn toàn cho nội dung do AI viết, vì việc chuyển đổi ngôn ngữ tự nhiên luôn làm thay đổi ý nghĩa gốc và gây mất mát thông tin.
Jason Liu@jxnlcoJason Liu chia sẻ trải nghiệm về việc vượt qua các giới hạn sandbox trong môi trường AI, mở ra những khả năng mới trong việc tương tác và thực thi tác vụ.
Dex Horthy (HumanLayer)@dexhorthyMột người dùng trên X đã yêu cầu chính Claude viết bài blog để phàn nàn về trải nghiệm tương tác không như ý với chatbot này.
cb_doge@cb_dogeElon Musk khẳng định AI sẽ trở thành động lực cốt lõi, đóng góp tới 99% giá trị của SpaceX trong vòng 5 năm tới, mở ra một tương lai đầy đột phá cho công ty hàng không vũ trụ này.
cb_doge@cb_dogeElon Musk tuyên bố đã xây dựng cụm huấn luyện AI mạnh nhất thế giới và đặt mục tiêu đạt công suất 10GW vào cuối năm sau. Ông tin rằng tương lai của AI sẽ nằm ngoài không gian, nơi năng lượng mặt trời vô tận sẽ nuôi dưỡng một 'bộ não vũ trụ' cho nhân loại.
cb_doge@cb_dogeElon Musk tuyên bố Grok sẽ học hỏi từ kho dữ liệu khổng lồ của SpaceX để kế thừa tư duy và giá trị nhân loại, đồng thời hé lộ phiên bản Grok 4.7 sắp tới sẽ mang tính đột phá.
CoreWeave ghi nhận doanh thu tăng vọt nhờ nhu cầu hạ tầng AI, dù vẫn chịu lỗ do mở rộng quy mô. Công ty hiện sở hữu lượng đơn hàng tồn đọng khổng lồ 104 tỷ USD và tiên phong triển khai hệ thống NVIDIA Vera Rubin NVL72.
Các nhà nghiên cứu phát hiện lỗ hổng cho phép giải mã và đánh cắp các chuỗi suy luận ẩn của Anthropic, OpenAI và Google thông qua việc phát lại dữ liệu. Dù đã được các nhà cung cấp khắc phục, đây là cảnh báo quan trọng về bảo mật dữ liệu trong các mô hình AI suy luận.
Testing Catalog@testingcatalogOumi giới thiệu nền tảng cho phép LLM tự đánh giá, tổng hợp dữ liệu và tự huấn luyện từ chính lưu lượng truy cập thực tế. Giải pháp này giúp doanh nghiệp xây dựng trí tuệ nhân tạo độc quyền, tạo lợi thế cạnh tranh thay vì phụ thuộc vào các mô hình dùng chung.

Rohan Paul@rohanpaul_aiMeta giới thiệu Muse Glimmer 30B, mô hình tối ưu cho các tác vụ AI cục bộ trên GPU tiêu dùng, trong bối cảnh Mark Zuckerberg chia sẻ tầm nhìn về AI cho mọi người giữa làn sóng kêu gọi tạm dừng phát triển từ giới chính trị.

Artificial Analysis@ArtificialAnlysArtificial Analysis vừa công bố bộ tiêu chuẩn AA-AnalystAgent để đánh giá khả năng phân tích dữ liệu thực tế. Claude 3.5 Opus (bản max) hiện đang dẫn đầu với 54%, vượt qua GPT-5.5 và Kimi K3 trong các tác vụ xử lý bảng tính và tài liệu.

Mistral AI@MistralAIMistral AI đang xây dựng hệ sinh thái toàn diện kết hợp hạ tầng suy luận và các mô hình mở, khẳng định cam kết giúp châu Âu làm chủ tương lai công nghệ AI.

Testing Catalog@testingcatalogNhân dịp tựu trường, OpenAI triển khai chương trình tặng 1 năm sử dụng ChatGPT Plus miễn phí cho sinh viên tại hơn 220 trường đại học ở Mỹ thông qua xác thực SheerID.
SemiAnalysis@SemiAnalysis_Google đã khởi động quá trình tinh chỉnh phần mềm cho dòng chip TPUv8i thế hệ tiếp theo trên nền tảng nội bộ và công khai, đánh dấu bước tiến mới trong việc mở rộng hệ sinh thái TPU ra thị trường.

Rohan Paul@rohanpaul_aiNghiên cứu mới chỉ ra rằng các khối suy luận ẩn trong AI có thể lưu trữ và làm lộ thông tin nhạy cảm như mật khẩu hay API key ngay cả khi hội thoại đã bị xóa. Kẻ tấn công có thể khai thác các khối này để đánh cắp dữ liệu từ các mô hình mạnh thông qua mô hình yếu hơn.

Bài viết làm rõ bản chất của nén dữ liệu và LLM đều là bài toán dự đoán phần tử tiếp theo, từ đó giải thích vì sao khả năng dự đoán tốt hơn lại dẫn đến tỷ lệ nén cao hơn.
OpenAI hợp tác cùng AWS đưa mô hình an ninh mạng Daybreak lên Amazon Bedrock, giúp các doanh nghiệp tối ưu hóa quy trình bảo mật và ứng phó sự cố hiệu quả hơn.
cb_doge@cb_dogeVới sự hỗ trợ của tên lửa tái sử dụng và vệ tinh sản xuất hàng loạt, việc mở rộng hạ tầng tính toán trong không gian đang trở nên khả thi và hiệu quả hơn so với trên mặt đất.

cb_doge@cb_dogeSiêu máy tính của SpaceX tại Memphis hiện đạt công suất 1.4GW và đang hướng tới cột mốc 10GW vào cuối năm sau để phục vụ nhu cầu tính toán khổng lồ.
