Kim@kimmonismusOpenAI đại hạ giá dòng GPT-5.6, đẩy mạnh cuộc chiến về chi phí
OpenAI giảm tới 80% giá cho dòng GPT-5.6 và ra mắt chế độ API Fast giúp tăng tốc độ xử lý gấp 2,5 lần, nhằm chiếm lĩnh cả phân khúc giá rẻ lẫn hiệu năng cao.

Kim@kimmonismusOpenAI giảm tới 80% giá cho dòng GPT-5.6 và ra mắt chế độ API Fast giúp tăng tốc độ xử lý gấp 2,5 lần, nhằm chiếm lĩnh cả phân khúc giá rẻ lẫn hiệu năng cao.

Thinking Machines@thinkymachinesThinking Machines vừa giới thiệu Inkling-Small, mô hình sở hữu 276 tỷ tham số nhưng chỉ cần 12 tỷ tham số kích hoạt, mang lại hiệu suất ngang ngửa phiên bản gốc với kích thước nhỏ gọn hơn.
Demis Hassabis@demishassabisGemini Robotics 2 sở hữu khả năng suy luận từng bước để thực hiện các tác vụ tinh vi như thắt nút, đồng thời hỗ trợ robot phối hợp giải quyết các quy trình công việc phức tạp.
Thiết bị đeo Friend phiên bản 2.0 vừa ra mắt với tính năng đàm thoại trực tiếp qua loa ngoài. Sản phẩm có giá 249 USD kèm gói đăng ký 10 USD/tháng để lưu trữ lịch sử trò chuyện dài hạn.
Baoyu@doteyDù HTML là định dạng trung gian lý tưởng để AI tạo slide, thực tế cho thấy việc này tốn kém và dễ phát sinh lỗi CSS khó kiểm soát, khiến nội dung bị ẩn hoặc hiển thị sai lệch.
OpenRouter@OpenRouterOpenRouter vừa cập nhật mức giá mới cho GPT-5.6 Terra và Luna, kết hợp cùng ưu đãi độc quyền 50% giúp chi phí sử dụng giảm xuống chỉ còn từ $0.1/triệu token, tối ưu hóa đáng kể ngân sách cho người dùng.
Sam Altman@samaSam Altman vừa hé lộ về GPT-5.6 Sol, phiên bản tập trung vào khả năng tự tối ưu hóa nhằm nâng cao hiệu suất và cắt giảm chi phí vận hành cho người dùng.
Mira Murati@miramuratiThinking Machines vừa công bố Inkling-Small, mô hình mã nguồn mở với 276 tỷ tham số nhưng chỉ kích hoạt 12 tỷ, đạt hiệu suất tương đương các mô hình lớn gấp 4 lần. Người dùng có thể tinh chỉnh hoặc trải nghiệm đa phương thức ngay trên nền tảng Tinker.
SpecFirst giới thiệu khung làm việc hai giai đoạn, yêu cầu AI tạo quy tắc hành vi cấu trúc trước khi viết mã. Phương pháp này giúp tăng đáng kể tỷ lệ vượt qua bài kiểm tra và độ bao phủ mã so với các mô hình truyền thống.
MindForge là quy trình tự động hóa giúp mô hình ngôn ngữ học kỹ năng phát triển phần mềm toàn diện thông qua các chương trình đã biên dịch, giúp cải thiện đáng kể hiệu suất giải quyết bài toán lập trình thực tế.
DistillAlign giải quyết sự lệch pha trong chưng cất video bằng cách kết hợp mục tiêu tìm kiếm chế độ và ràng buộc bao phủ, giúp mô hình nhỏ đạt hiệu suất vượt trội so với các mô hình lớn hơn.
Voice Memory là phương pháp sửa lỗi ASR chỉ trong giai đoạn suy luận, sử dụng bộ nhớ văn bản có thể học để tinh chỉnh kết quả nhận diện. Công nghệ này giúp giảm đáng kể tỷ lệ lỗi từ vựng, đặc biệt hiệu quả trong các lĩnh vực chuyên biệt như hàng không.
GitHub Copilot giới thiệu tính năng phiên làm việc xếp chồng, cho phép chia nhỏ các tác vụ phức tạp thành chuỗi công việc liên tiếp và tự động tạo Pull Request cho từng phần, giúp quản lý dự án hiệu quả và tránh tình trạng lan man.
Nhóm nghiên cứu của Apple khai thác đồ thị kNN từ thuật toán UMAP để phân tích cấu trúc dữ liệu phức tạp. Bằng cách áp dụng các thuật toán đồ thị như PageRank, phương pháp này giúp nhận diện các điểm dữ liệu quan trọng và cấu trúc phân tầng hiệu quả như các kỹ thuật chuyên dụng.
Aravind Srinivas (Perplexity CEO)@AravSrinivasPerplexity vừa giới thiệu tính năng Projects, cho phép người dùng quản lý tệp tin, bộ nhớ bền vững và các phiên làm việc chuyên sâu, biến nền tảng này thành một hệ điều hành cộng tác đa tác nhân mạnh mẽ.
Alexandr Wang (Scale AI /Meta AI)@alexandr_wangFrancis de Souza sẽ chính thức tiếp quản vị trí CEO từ ngày 10/8, trong khi nhà sáng lập Alexandr Wang chuyển sang vai trò Chủ tịch để tập trung vào chiến lược dài hạn cho công ty chuyên cung cấp dữ liệu và hệ thống AI cho các tập đoàn lớn.
Yuchen Jin@Yuchenj_UWNgười dùng đã thành công trong việc triển khai và vận hành mô hình Kimi K3 ngay trên máy tính cá nhân tại nhà, mở ra khả năng sử dụng AI mạnh mẽ mà không cần phụ thuộc vào đám mây.

Gabriel@gabriel1Một người dùng X chia sẻ sự hào hứng khi tưởng tượng cảnh mình ngồi trên ghế thư giãn vào năm 2040, kể lại những ngày tháng điên cuồng của kỷ nguyên AI hiện tại.
Vista@vista8Một Product Manager đã hệ thống hóa lịch sử phát triển của Deep Learning qua 200 bài nghiên cứu, từ cột mốc AlexNet, Transformer đến các kỹ thuật tối ưu hóa chi phí và suy luận hiện đại.
Vista@vista8Dù các mô hình mới liên tục chạy đua điểm số, trải nghiệm thực tế cho thấy Claude 3.5 Sonnet vẫn vượt trội trong việc viết lách so với Opus 3.5. Điều này chứng minh rằng mô hình mới nhất chưa chắc đã là lựa chọn tốt nhất cho mọi nhu cầu.
Kim@kimmonismusChủ tịch Ủy ban châu Âu đề xuất rót 10 tỷ euro để xây dựng các 'AI Gigafactories' nhằm thúc đẩy sức mạnh tính toán, nhưng vấp phải làn sóng hoài nghi từ giới chuyên gia vì tính khả thi thấp.
OpenAI Developers@OpenAIDevsOpenAI vừa công bố giảm giá mạnh cho dòng API GPT-5.6, trong đó model Luna giảm 80% và Terra giảm 20%, đồng thời ra mắt tùy chọn Sol với tốc độ xử lý nhanh hơn nhờ tối ưu hóa lộ trình suy luận.
OpenAI ra mắt hai phiên bản Luna và Terra cho dòng GPT-5.6 với mức giá cạnh tranh hơn, giúp doanh nghiệp triển khai quy trình AI quy mô lớn một cách hiệu quả.
Microsoft Research@MSFTResearchEchoverse giúp AI cải thiện khả năng xử lý các tác vụ đa bước như email hay hỗ trợ khách hàng bằng cách huấn luyện trong môi trường mô phỏng thực tế, thay vì chỉ tăng số lượng bài tập.

Odyssey@odysseymlOdyssey vừa giới thiệu khả năng tạo dựng hình ảnh không gian 3D với hiệu ứng phối cảnh sâu sắc, mang lại trải nghiệm thị giác chân thực cho người dùng.
LangSmith giới thiệu tính năng LLM Gateway mới, cung cấp các công cụ kiểm soát runtime mạnh mẽ giúp doanh nghiệp quản lý, bảo mật và tối ưu hóa hiệu suất cho các tác nhân AI khi triển khai thực tế.
Skyscanner đã sử dụng Runway để tạo bản xem trước (pre-viz) cho các chiến dịch quảng cáo, giúp rút ngắn thời gian lên ý tưởng từ hai tuần xuống còn vài ngày và kiểm soát chất lượng hình ảnh ngay tại hiện trường.
Perplexity@perplexity_aiPerplexity vừa giới thiệu Projects, phiên bản nâng cấp của Spaces, đóng vai trò là trung tâm làm việc tập trung với hệ thống tệp chia sẻ và bộ nhớ bền vững giúp tối ưu hóa quy trình cộng tác.
AK@_akhaliqID-V2V là phương pháp mới giúp chuyển đổi phong cách nghệ thuật cho video mà vẫn bảo toàn chính xác đặc điểm nhận dạng của nhân vật gốc, giải quyết bài toán khó trong xử lý video AI.
AK@_akhaliqNghiên cứu giới thiệu CoRT, phương pháp mới giúp tối ưu hóa chiến lược của mô hình ngôn ngữ ở cấp độ token bằng cách sử dụng kỹ thuật phát lại phản thực tế (counterfactual replay) để hướng dẫn chấm điểm.
