Onsemi báo lãi ròng 227 triệu USD trong quý 2/2026, tăng trưởng ấn tượng 33%
Onsemi ghi nhận doanh thu 1,6 tỷ USD và lợi nhuận ròng tăng 33,18% trong quý 2/2026. Công ty kỳ vọng mảng trung tâm dữ liệu AI sẽ tăng gấp đôi doanh thu trong năm nay.
Onsemi ghi nhận doanh thu 1,6 tỷ USD và lợi nhuận ròng tăng 33,18% trong quý 2/2026. Công ty kỳ vọng mảng trung tâm dữ liệu AI sẽ tăng gấp đôi doanh thu trong năm nay.
Ethan Mollick@emollickEthan Mollick cảnh báo rằng ngữ cảnh quá dài khiến AI trở nên bảo thủ và kém linh hoạt. Thay vì để AI tự xử lý toàn bộ lịch sử, hãy tóm tắt công việc vào file Markdown để duy trì hiệu suất trong các phiên chat mới.
Elvis Saravia@omarsar0TokTier giới thiệu dịch vụ tokenization có trạng thái, giải quyết tình trạng mất hiệu lực bộ nhớ đệm do dịch chuyển ranh giới token trong các tác vụ AI Agent. Giải pháp này giúp giảm độ trễ tới 34% và tăng tốc độ xử lý lên đến 437 lần.

Hongming@hongming731Quy trình làm việc hiệu quả kết hợp Fable 5 để lập kế hoạch và nghiệm thu, cùng Codex (GPT-5.6) để thực thi. Phương pháp này giúp tối ưu chi phí thông qua Prompt Caching và đảm bảo chất lượng công việc so với các lựa chọn thay thế như Opus 5.
Greg Brockman@gdbGPT-Live giới thiệu kiến trúc âm thanh đột phá, cho phép ChatGPT lắng nghe và phản hồi đồng thời mà không bị gián đoạn, mang lại trải nghiệm hội thoại tự nhiên và mượt mà hơn.
Quân đội Ukraine bắt đầu triển khai drone Shrike tích hợp công nghệ AI từ Auterion, cho phép drone tự động bám đuổi và tiêu diệt mục tiêu sau khi được chỉ định. Dự kiến 50.000 chiếc sẽ được bàn giao trong những tháng tới.
Bài viết giới thiệu quy trình đánh giá toàn diện cho PerceptionBench, hỗ trợ kiểm tra khả năng nhận diện, suy luận và phát hiện ảo giác của các mô hình đa phương thức thông qua cơ chế tự động hóa linh hoạt.
Cloudflare tối ưu hóa việc triển khai các mô hình MoE như Kimi và GLM trên GPU bằng cách sử dụng kỹ thuật lượng tử hóa bộ nhớ đệm KV, nén trọng số và kiểm tra tính toàn vẹn của cache.
Thay vì kỹ thuật viết prompt, chính kiến thức chuyên sâu trong lĩnh vực mới giúp bạn khai thác tối đa tiềm năng của LLM. Người có chuyên môn cao sẽ biết cách đặt câu hỏi và kiểm chứng kết quả hiệu quả hơn hẳn người mới bắt đầu.
SemiAnalysis@SemiAnalysis_Khám phá kiến trúc đột phá của Kimi K3, bao gồm kỹ thuật nén bộ nhớ, cơ chế chú ý đa tầng và định tuyến chuyên gia tiềm năng giúp tối ưu hóa hiệu suất vận hành.
Kim@kimmonismusAnthropic đang chịu áp lực dư luận khi dòng model Opus 5 bị đánh giá là suy giảm chất lượng nghiêm trọng, thường xuyên quên nhiệm vụ và phản hồi kém hơn so với các phiên bản trước.
Microsoft Research@MSFTResearchMicrosoft giới thiệu SocialRL giúp mô hình nhỏ học đàm phán, PazaBench V2 mở rộng đánh giá AI cho ngôn ngữ châu Phi và EvoLib chuyển hóa kinh nghiệm thành tri thức cho AI agent.
Replit@ReplitReplit vừa giới thiệu công cụ Replit Design, cho phép người dùng tạo và tùy chỉnh giao diện ứng dụng chỉ bằng cách nhập mô tả bằng ngôn ngữ tự nhiên.

Testing Catalog@testingcatalogAtomic vừa tung ra 14 phiên bản lượng tử hóa của mô hình DeepSeek V4 Flash (284B MoE) trên Hugging Face, từ định dạng BF16 đến 1-bit, giúp tối ưu hóa khả năng chạy trên phần cứng hạn chế mà vẫn giữ hiệu suất cao.

MiniMax@MiniMax_AIMiniMax H3 đã chứng minh khả năng vận hành mạnh mẽ trên phần cứng cá nhân, cho phép tạo nội dung chất lượng cao chỉ với một card đồ họa RTX 5090 duy nhất.
MiniMax@MiniMax_AIMiniMax giới thiệu trợ lý thông minh H3, hỗ trợ tạo mã vùng (regional coding) chỉ với một lần thực thi, tối ưu hóa quy trình làm việc cho lập trình viên.
AI Safety Memes@AISafetyMemesTài khoản AI Safety Memes cảnh báo về khả năng mô hình Mythos của Anthropic có thể tự động khai thác lỗ hổng ngân hàng. Điều này dấy lên lo ngại rằng các mô hình mã nguồn mở trong tương lai có thể tự sao chép và tấn công mạng như một loại 'sinh vật xâm lấn' kỹ thuật số khó kiểm soát.

Thariq@trq212Bạn có thể tích hợp các công cụ như Gmail, Lịch hay Slack vào Claude Code. Sau khi kết nối, các dữ liệu này sẽ được Claude Code sử dụng trực tiếp ngay trong giao diện Artifacts, giúp tối ưu hóa quy trình làm việc.

Dù AI hỗ trợ viết code nhanh hơn, nhưng thực tế thời gian tiết kiệm được chỉ khoảng 15-25%. Các nhà quản lý cần nhìn nhận lại kỳ vọng vì AI giúp lập trình viên mới tiến bộ nhanh hơn thay vì chỉ tập trung tuyển dụng nhân sự cấp cao.
Nhân kỷ niệm 45 năm giao thức Kermit, dự án C-Kermit đã chính thức tái khởi động với bản cập nhật lớn đầu tiên sau hơn một thập kỷ, đánh dấu sự trở lại của công cụ truyền tải dữ liệu và giả lập đầu cuối huyền thoại.
SemiAnalysis@SemiAnalysis_Báo cáo từ SemiAnalysis cho thấy các ông lớn như AWS và Meta đang chuyển sang mô hình trung tâm dữ liệu mô-đun hóa, với các khối tiền chế nặng hơn 22 tấn, giúp tối ưu hóa quy mô xây dựng lên tới 60GW trên toàn cầu.

Replit@ReplitReplit giới thiệu cách xây dựng 'lớp sự thật' (truth layer) giúp các tác nhân AI chia sẻ ngữ cảnh chung, từ đó cung cấp câu trả lời đáng tin cậy hơn cho đội ngũ phát triển.

Eric Zakariasson@ericzakariassonCác AI Agent thế hệ mới giờ đây có thể tự thực hiện các thao tác phức tạp trên máy tính như di chuột, điền biểu mẫu, truy cập trang web không có API và thậm chí là tự tìm lỗi rồi sửa chữa, mang lại trải nghiệm vận hành mượt mà như người thật.
NLP@dongxi_nlpCác mô hình thế giới tương lai cần theo dõi cả trạng thái tâm trí và bối cảnh, vì niềm tin và ý định của con người chính là yếu tố then chốt định hình các hành động tiếp theo.

OpenAI ra mắt GPT-Live, hệ thống AI đột phá với khả năng đàm thoại giọng nói liên tục, độ trễ cực thấp và phản hồi tự nhiên nhờ kiến trúc mô hình không cần chờ lượt.
Đại học UNAM buộc 58.000 thí sinh thi lại sau khi hệ thống giám thị AI gây ra bất thường, khiến tỷ lệ thí sinh đạt điểm cao tăng vọt bất thường so với các năm trước.
Gabriel@gabriel1Yêu cầu phần cứng lên tới 96GB RAM chỉ để chạy Codex trên nền tảng Electron đang trở thành chủ đề bàn tán sôi nổi trong cộng đồng lập trình viên vì sự phi lý của nó.

Bài viết giới thiệu khung bảo mật 'see-fix-protect' cùng danh sách kiểm tra 12 lỗi cấu hình phổ biến, giúp doanh nghiệp hệ thống hóa quy trình bảo vệ ứng dụng AI theo các tiêu chuẩn quốc tế như NIST và OWASP.
Rohan Paul@rohanpaul_aiPhiên bản nội bộ của mô hình OpenAI thế hệ mới đã giải thành công 10 bài toán toán học và khoa học máy tính lý thuyết với chi phí cực thấp, kèm theo chứng chỉ kiểm chứng Lean hoàn chỉnh, mở ra kỷ nguyên mới cho việc giải quyết các vấn đề khoa học phức tạp.

Gemini@GeminiAppGoogle kêu gọi người dùng chia sẻ các tác phẩm sáng tạo từ Gemini Omni. Đặc biệt, người dùng miễn phí có thể tạo tối đa 10 video bằng công cụ này cho đến hết ngày 4/8/2026.