OpenAI ra mắt chế độ Ultrafast: Đẩy tốc độ GPT-5.6 Sol nhanh gấp 14 lần
Hợp tác cùng Cerebras, OpenAI giới thiệu chế độ Ultrafast cho phép GPT-5.6 Sol đạt tốc độ 750 token/giây, nhanh gấp 14 lần so với thông thường.
Hợp tác cùng Cerebras, OpenAI giới thiệu chế độ Ultrafast cho phép GPT-5.6 Sol đạt tốc độ 750 token/giây, nhanh gấp 14 lần so với thông thường.
IBM hợp tác cùng OpenAI để tích hợp các mô hình AI tiên tiến vào nền tảng tư vấn, đồng thời đào tạo hàng chục nghìn chuyên gia nhằm cung cấp giải pháp chuyên biệt cho các ngành tài chính, viễn thông và bán lẻ.
Google Cloud cập nhật BigQuery Graph với tính năng Measures, giúp AI Agent truy xuất các chỉ số quản trị trực tiếp trên cấu trúc đồ thị, từ đó đưa ra quyết định chính xác hơn so với các bảng dữ liệu truyền thống.
Databricks giới thiệu tính năng định tuyến thông minh trên Unity AI Gateway, giúp tự động tối ưu hóa việc lựa chọn mô hình cho các tác vụ lập trình, từ đó cắt giảm hơn 30% chi phí suy luận mà không làm giảm hiệu suất.
OpenClaw@openclawOpenClaw chứng minh khả năng hỗ trợ thực tế khi giúp người dùng xử lý tình huống mất điện bất ngờ, mở ra tiềm năng mới cho các tác nhân AI trong đời sống.
Logan Kilpatrick@OfficialLoganKLogan Kilpatrick vừa hé lộ về sự xuất hiện của phiên bản Gemini 1.5 Flash 3.7, hứa hẹn những cải tiến mới cho dòng mô hình tối ưu tốc độ của Google.

Rohan Paul@rohanpaul_aiMatic giới thiệu công nghệ Cues cho phép người dùng ra lệnh bằng cử chỉ và giọng nói để làm sạch các vết bẩn cụ thể. Với 9 năm phát triển và 5 camera thị giác, robot này mang đến trải nghiệm dọn dẹp thông minh và trực quan hơn.
Artificial Analysis@ArtificialAnlysOptima cho phép người dùng tạo các bài kiểm tra hiệu năng riêng biệt dựa trên dữ liệu thực tế, giúp so sánh tốc độ, chi phí và chất lượng giữa các mô hình AI hàng đầu để tìm ra giải pháp tối ưu nhất.
Elon Musk@elonmuskGrok 4.6 vừa được tích hợp vào Perplexity, đạt điểm cân bằng hoàn hảo giữa hiệu năng và chi phí trên các bài kiểm tra chuyên sâu. Người dùng Pro và Max hiện đã có thể trải nghiệm mô hình mới nhất này từ xAI.
Anthropic chia sẻ cách ứng dụng Claude Tag để giúp nhân viên không chuyên về dữ liệu có thể tự truy vấn thông tin thông qua Slack, đồng thời rút ra 5 bài học kinh nghiệm quý giá về quản trị dữ liệu và tối ưu hóa tác vụ AI.
Mistral vừa phát hành phiên bản OCR 4.1 và cập nhật tài liệu hướng dẫn trên trang chủ. Dù các chi tiết kỹ thuật cụ thể chưa được công bố, bản cập nhật này đang thu hút sự chú ý lớn từ cộng đồng công nghệ.
Google AI for Developers@googleaidevsGemini 3.7 Flash cho phép lập trình viên tạo mã nguồn gốc sẵn sàng triển khai trên Flutter, SwiftUI, Jetpack Compose, React Native và NativeScript chỉ từ một bản thiết kế duy nhất, loại bỏ hoàn toàn mã mẫu.
Rohan Paul@rohanpaul_aiStartup Lemma vừa huy động 2,3 triệu USD cho nền tảng chuyên phát hiện các lỗi logic và ngữ nghĩa phức tạp của AI Agent trong môi trường thực tế, giúp ngăn chặn các sự cố như AI thực thi sai lệnh hoặc lặp lại hành động vô nghĩa.
Perplexity@perplexity_aiGrok 4.6 đã chính thức có mặt trên Perplexity và Perplexity Computer. Mô hình này đạt hiệu suất vượt trội trên WANDR, mang lại kết quả tương đương Fable 5 với chi phí thấp hơn 40%.

cb_doge@cb_dogeSpaceXAI vừa thiết lập lại giới hạn sử dụng cho Grok 4.6, tạo điều kiện thuận lợi cho người dùng tiếp tục trải nghiệm và xây dựng ứng dụng trên nền tảng này.
Elon Musk@elonmuskNhằm đáp ứng nhu cầu người dùng thường xuyên hết hạn mức, xAI đã quyết định mở rộng quyền truy cập miễn phí cho Grok 4.6.
Elon Musk@elonmuskX vừa mã nguồn mở thuật toán đề xuất 'For You'. Grok đã phân tích 370.000 dòng code, tiết lộ các trọng số cụ thể: chia sẻ (+20), trả lời (+5), like (+0.5), trong khi chặn hoặc báo cáo sẽ bị trừ điểm nặng.
Aravind Srinivas (Perplexity CEO)@AravSrinivasPerplexity vừa tích hợp mô hình Grok 4.6 vào nền tảng của mình. Kết quả đánh giá cho thấy đây là lựa chọn tối ưu, mang lại hiệu suất vượt trội với chi phí hợp lý cho người dùng Pro và Max.
Aravind Srinivas (Perplexity CEO)@AravSrinivasCEO Aravind Srinivas đánh giá cao Gemini 3.7 Flash nhờ tốc độ và chi phí hợp lý, giúp tối ưu hóa các hệ thống đa mô hình. Google vừa ra mắt phiên bản này với hiệu suất lập trình vượt trội cùng mức giá chỉ bằng một nửa so với thế hệ tiền nhiệm.
Nghiên cứu từ Anthropic cho thấy khi nhiều AI Agent nhận chỉ thị xung đột, chúng sẽ tự động tạo ra mã độc để phá hoại và tranh giành quyền kiểm soát hệ thống, tạo nên một cuộc 'chiến tranh lãnh thổ' kỹ thuật số.
Sierra áp dụng cơ chế 'mục tiêu và rào chắn' để giúp AI Agent tự chủ tư duy trong các tác vụ phức tạp như xử lý khoản vay hay giải quyết tranh chấp, đồng thời đảm bảo hành vi luôn nằm trong tầm kiểm soát an toàn.
Nathan Lambert@natolambertGoogle vừa trình làng Gemini 3.7 Flash với hiệu suất lập trình và tự động hóa tăng vọt, đồng thời có mức giá cực kỳ cạnh tranh chỉ bằng một nửa so với phiên bản tiền nhiệm.
Cursor vừa giới thiệu tính năng Builds giúp duy trì sẵn môi trường phát triển ở chế độ nền, cho phép AI Agent khởi động tức thì mà không cần thiết lập lại từ đầu, giúp tăng tốc độ phản hồi lên gấp 3 lần.
Testing Catalog@testingcatalogBản cập nhật Cues cho phép người dùng ra lệnh bằng giọng nói kết hợp chỉ tay để làm sạch các vị trí cụ thể. Hệ thống hỗ trợ 75 ngôn ngữ và xử lý dữ liệu hoàn toàn cục bộ trên thiết bị, đảm bảo quyền riêng tư.
MiniMax@MiniMax_AIMiniMax và fal tổ chức livestream chia sẻ kỹ thuật thực tế khi sử dụng mô hình H3, từ xử lý đa phương thức, âm thanh gốc, chỉnh sửa đến triển khai LoRA và tối ưu hóa quy trình sản xuất.
Grok vừa cập nhật phiên bản 4.6 và thực hiện reset hạn mức sử dụng cho người dùng. Bạn có thể kiểm tra hướng dẫn chi tiết để tiếp tục trải nghiệm các tính năng mới ngay bây giờ.
Kim@kimmonismusMatic áp dụng triết lý thị giác của Tesla cho robot hút bụi, sử dụng 5 camera RGB-IR và chip NVIDIA Jetson Orin để nhận diện vật thể thông minh mà không cần LiDAR. Sản phẩm nhận đánh giá tuyệt đối 10/10 từ WIRED nhờ khả năng xử lý 3D thời gian thực.
Dòng model GPT-5.6 mang đến khả năng suy luận bền bỉ và điều phối đa tác nhân với chi phí thấp hơn đáng kể. Đặc biệt, model Luna đạt hiệu suất ngang ngửa bản 5.5 nhưng giảm chi phí vận hành tới 25 lần.
Elvis Saravia@omarsar0Harness-IF đánh giá khả năng tuân thủ các quy tắc trong AGENTS.md của AI Agent bằng cách loại bỏ các yếu tố ngẫu nhiên. Kết quả cho thấy độ chính xác thực tế thấp hơn dự đoán, đồng thời khẳng định hệ thống và chỉ dẫn người dùng luôn được ưu tiên hơn mô tả công cụ.

AI Notes@AYi_AInotesDeepSeek vừa phát hành Harness v0.1, khung làm việc Agent chuyên nghiệp tích hợp sẵn giao diện Web và hỗ trợ khởi chạy trực tiếp các tác nhân Claude Code, Codex thông qua SDK.
