Google cập nhật tính năng cho phép loại bỏ hình mờ 'sparkle' trên nội dung do Gemini tạo ra, tuy nhiên các tệp vẫn sẽ chứa mã định danh ẩn SynthID và siêu dữ liệu C2PA để đảm bảo tính minh bạch.
Thank you! Pi is many DeepSeek researchers and developers favorite daily drive. DSH reused Pi's LLM…
DịchDeepSeek Harness được các chuyên gia đánh giá cao nhờ khả năng kết nối linh hoạt với các mô hình phi DeepSeek, nhận được sự công nhận từ những nhân vật có tầm ảnh hưởng trong giới công nghệ về tinh thần cởi mở.
Từ công cụ thử nghiệm, AI đã trở thành trợ thủ đắc lực trong mọi khâu từ sản xuất, phân phối đến phát triển nội dung, mở ra kỷ nguyên mới cho báo chí hiện đại.
Arcads' Actors+ is a good example of why AI video quality is becoming a perceptual problem now. You…
DịchArcads giới thiệu Actor+ sử dụng công nghệ Seedance 2.5, tạo ra các diễn viên AI có độ chân thực cao đến mức khó phân biệt với người thật, xóa bỏ rào cản về cảm giác "giả tạo" trong video AI hiện nay.
Chủ tịch Honor khẳng định Robot Phone không chỉ là điện thoại gắn gimbal, mà là bước đột phá đưa smartphone trở thành nền tảng cho các tác nhân AI thông minh thay vì chỉ là nơi chứa ứng dụng.
Chỉ trong 70 ngày, các công ty Trung Quốc đã tung ra 10 mô hình AI mới, dần bắt kịp các đối thủ Mỹ. Bất chấp lệnh hạn chế, các doanh nghiệp toàn cầu vẫn ưu tiên chọn AI Trung Quốc nhờ tính bảo mật và hiệu suất vượt trội.
Startup VUI Labs vừa đưa mô hình Luna-TTS lên vị trí dẫn đầu bảng xếp hạng TTS Arena của Hugging Face, vượt qua các tên tuổi lớn như ElevenLabs nhờ kiến trúc khuếch tán từ Qwen3 và độ trễ cực thấp chỉ 41,6ms.
Vì sao đáng đọc: Tin tức quan trọng về sự trỗi dậy của AI Trung Quốc trong lĩnh vực giọng nói, với các số liệu kiểm chứng từ bảng xếp hạng uy tín, rất đáng chú ý cho cộng đồng công nghệ.
Bảng xếp hạng Agent Memory Leaderboard (AML) chính thức công bố kết quả đầu tiên, đánh dấu bước tiến quan trọng trong việc giải quyết bài toán bộ nhớ dài hạn cho AI Agent, giúp chúng thoát khỏi tình trạng 'quên sạch' sau mỗi phiên làm việc.
Vì sao đáng đọc: Đây là tin tức quan trọng về hạ tầng AI, giải quyết trực tiếp điểm nghẽn về bộ nhớ của Agent. Nội dung có tính thời sự cao, tác động lớn đến cộng đồng phát triển AI.
DịchOpenAI vừa giới thiệu chế độ siêu tốc cho GPT-5.6 Sol, giúp tăng tốc độ xử lý lên gấp 14 lần. Tính năng này hiện đang được triển khai thử nghiệm cho một nhóm khách hàng API trước khi mở rộng quy mô.
Pony.ai mở rộng hợp tác chiến lược với Uber để đưa hơn 2.000 xe Robotaxi vào vận hành tại 5 thành phố châu Âu, đồng thời tích hợp dịch vụ gọi xe tự lái trực tiếp lên ứng dụng Uber.
Low latency matters more inside an agent because one task can stack many sequential model calls. Gem…
DịchGemini 3.7 Flash thiết lập chuẩn mực mới về tốc độ và hiệu quả chi phí cho các tác vụ AI phức tạp, đồng thời Devin hiện đang áp dụng ưu đãi giảm giá 50% cho người dùng.
OpenAI giới thiệu chế độ Ultrafast cho GPT-5.6 Sol, hợp tác cùng Cerebras để đạt tốc độ phản hồi siêu nhanh, phục vụ các tác vụ thời gian thực như tài chính và hỗ trợ khách hàng.
DịchOpenAI vừa giới thiệu chế độ 'Ultrafast' cho mô hình GPT-5.6 Sol, giúp tăng tốc độ phản hồi lên tới 14 lần. Tính năng này hiện đang được triển khai thử nghiệm cho nhóm khách hàng doanh nghiệp chọn lọc trước khi mở rộng quy mô.
Thêm 6 nguồn khác đưa tinX: Greg Brockman (@gdb)X: Sam Altman (@sama)The Decoder: AI NewsHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeJiqizhixin
Gemini 3.7 went from a natural-language description to a complete procedural three.js scene in one s…
DịchGemini 3.7 có khả năng tạo mã Three.js hoàn chỉnh để dựng cảnh 3D một chiếc đồng hồ sang trọng chỉ qua mô tả văn bản, không cần tài nguyên bên ngoài. Với chi phí chỉ 0,038 USD, đây là minh chứng cho khả năng lập trình hình ảnh 3D chính xác của mô hình.
Suno Studio 2.0 biến nền tảng AI thành DAW điều khiển bằng chat, cho phép người dùng tạo nhạc, chỉnh sửa và xuất file chất lượng cao thông qua câu lệnh văn bản. Bản cập nhật này đánh dấu bước tiến lớn trong việc đơn giản hóa quy trình sản xuất âm nhạc chuyên nghiệp.
DeepSeek vừa ra mắt DeepSeek Harness, khung làm việc AI dạng plugin cho phép xây dựng ứng dụng phức tạp như game 3D hay hoạt họa chỉ từ mô tả văn bản. Dự án gây ấn tượng mạnh nhờ khả năng tối ưu hóa hiệu suất vượt trội so với các mô hình lớn hơn.
Vì sao đáng đọc: Đây là tin tức công nghệ quan trọng về một framework AI mới từ DeepSeek, có tính ứng dụng cao và khả năng thay đổi cách phát triển ứng dụng AI, rất thu hút cộng đồng.
Finally: OpenAI is previewing Ultrafast mode for GPT-5.6 Sol, delivering up to 750 tokens per second…
DịchOpenAI vừa giới thiệu chế độ siêu tốc cho mô hình GPT-5.6 Sol, cho phép đạt tốc độ tạo văn bản lên tới 750 token mỗi giây, tối ưu hóa cho các ứng dụng doanh nghiệp đòi hỏi phản hồi tức thời.
Thêm 9 nguồn khác đưa tinX: Greg Brockman (@gdb)X: Sam Altman (@sama)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeJiqizhixinX: Tibo (@thsottiaux)TechCrunch: AIX: Sherwin Wu (@sherwinwu)X: Testing Catalog (@testingcatalog)
Suno Studio 2.0 bổ sung hỗ trợ MIDI, các hiệu ứng tích hợp và chatbot thông minh giúp tự động hóa quy trình sản xuất nhạc, biến nền tảng này thành một trạm làm việc âm thanh kỹ thuật số (DAW) mạnh mẽ hơn.
Higgsfield công bố bộ phim AI 'Cully Hill Boys' cùng loạt câu lệnh chi tiết lấy cảm hứng từ các đạo diễn lừng danh, qua đó khẳng định rằng những khoảnh khắc đắt giá nhất vẫn cần đến tư duy sáng tạo của con người.
DeepSeek announced DeepSeek-V4-Pro! The model is now available on DeepSeek Chat under "Expert Mode…
DịchDeepSeek vừa trình làng DeepSeek-V4-Pro với khả năng tùy chỉnh cường độ suy luận linh hoạt và hỗ trợ chuẩn OpenAI Responses API, tối ưu hóa đặc biệt cho các tác vụ lập trình.
We ran @techhalla's Seedance 2.5 prompt with a little tweak on PixVerse and got a 30 second one take…
DịchPixVerse vừa tích hợp mô hình Seedance 2.5, cho phép tạo các đoạn video dài 30 giây liên tục mà vẫn duy trì tính nhất quán về vật lý và hình ảnh, khắc phục tình trạng biến dạng thường thấy trong AI video.
Giải vô địch Robot hình người thế giới lần thứ 2 sẽ khai mạc tại Bắc Kinh vào ngày 22/8 với sự tham gia của hơn 2.000 robot. Ban tổ chức đã thiết lập 'Làng vận động viên robot' với hệ thống quản lý số hóa hiện đại, đảm bảo vận hành cho hàng trăm đội thi đấu.
Dyna Robotics giới thiệu mô hình nền tảng DYNA-2, được huấn luyện từ hơn 1 triệu giờ video góc nhìn thứ nhất, giúp robot cải thiện khả năng suy luận không gian và tương tác vật lý với độ chính xác lên tới 90%.
Upstage (Hàn Quốc) vừa giới thiệu Solar Pro 4, mô hình ngôn ngữ thương mại với cửa sổ ngữ cảnh 512K, tối ưu cho các tác vụ AI Agent phức tạp và là đại diện Hàn Quốc đầu tiên góp mặt trong bảng xếp hạng Agent Arena.
Tạp chí Kiến thức là Sức mạnh hợp tác cùng tập đoàn 360 ra mắt nền tảng 'Zhili-Nano', cho phép người dùng sáng tạo các thước phim khoa học viễn tưởng bằng công nghệ AI.
Pixel Watch 5 sở hữu chip Snapdragon W5 Gen 2 với hiệu năng vượt trội, cùng tính năng phát hiện khẩn cấp hô hấp lần đầu xuất hiện, cho phép tự động gọi cứu hộ và định vị chính xác.
Tomorrow at 5: 30pm PT: MiniMax H3 × @magnific at the Magnific SF office. We'll be showcasing what p…
DịchMiniMax tổ chức sự kiện trải nghiệm thực tế tại San Francisco để trình diễn khả năng tạo video điện ảnh, âm thanh gốc và quy trình làm việc chuyên sâu của mô hình H3 kết hợp cùng Magnific.
Soniox TTS v2 is one of those models you need to actually hear. They just launched TTS v2, a text-t…
DịchSoniox vừa trình làng mô hình TTS v2 với khả năng hỗ trợ đa ngôn ngữ, tích hợp tính năng cảm xúc và sao chép giọng nói, tối ưu cho các tác nhân AI thời gian thực với mức giá chỉ 0,7 USD/giờ.
Tailoring for machines is going to be a real job 😃 Una, UBTECH's ultra-bionic humanoid, underwent …
DịchRobot mô phỏng sinh học Una của UBTECH vừa có màn ra mắt ấn tượng với vai trò người mẫu thời trang, đánh dấu bước tiến mới khi nghề thiết kế trang phục cho robot dần trở thành một lĩnh vực chuyên nghiệp.
We craft golden-hour cinema that holds, unbroken, from intimate close-up to soaring aerial. The cam…
DịchPixVerse giới thiệu Seedance 2.5 với khả năng tạo video dài liền mạch, từ cận cảnh chi tiết đến góc quay toàn cảnh trên không mà không bị ngắt quãng, mang lại hiệu ứng hình ảnh điện ảnh chuyên nghiệp.
Nvidia đang phát triển Nemotron 4 với quy mô lên tới 1.000 tỷ tham số, dự kiến ra mắt vào mùa thu này. Để hiện thực hóa tham vọng này, hãng đã nâng mức chi tiêu cho hạ tầng đám mây lên 28 tỷ USD đến năm 2031.
Geely Galaxy chuẩn bị trình làng mẫu SUV địa hình 700 với công nghệ AI toàn địa hình, khả năng xoay tại chỗ và hệ thống truyền động hybrid mạnh mẽ lên tới 830kW. Xe dự kiến có mặt tại đại lý vào giữa tháng này và chính thức bán ra trong quý 4.
Unitree vừa công bố đạt mốc 18.000 robot hình người được sản xuất, trong đó mẫu G1 chiếm ưu thế với tốc độ tăng trưởng sản lượng ấn tượng. Công ty hiện nắm giữ 31% thị phần robot hình người toàn cầu trong nửa đầu năm 2026.
LTX-2.5 mang đến khả năng tạo video 720p kèm âm thanh với tốc độ ấn tượng và chi phí tối ưu, đồng thời hỗ trợ tích hợp sâu vào ComfyUI. Các tổ chức có doanh thu dưới 10 triệu USD/năm có thể sử dụng miễn phí.
Vì sao đáng đọc: Bước tiến lớn về tốc độ tạo video AI và tính ứng dụng cao nhờ tích hợp ComfyUI, rất phù hợp với cộng đồng sáng tạo nội dung tại Việt Nam.
Jason Liu thông báo đã tối ưu hóa thành công, giúp giảm 50% độ trễ khung hình trên Codex Voice, hứa hẹn mang lại trải nghiệm tương tác mượt mà hơn đáng kể.
LTX-2.5 là mô hình thế giới mã nguồn mở chuyên dụng cho tạo video và AI vật lý, được tối ưu hóa để chạy mượt mà trên GPU NVIDIA RTX với yêu cầu VRAM thấp, giúp đơn giản hóa quy trình sản xuất video chuyên nghiệp.
I wasn't expecting Soniox TTS v2 (a text-to-speech model) to sound this natural. They just released…
DịchSoniox giới thiệu mô hình TTS v2 hỗ trợ hơn 60 ngôn ngữ với chi phí chỉ 0,7 USD/giờ. Công nghệ này tối ưu cho AI agent nhờ khả năng phản hồi thời gian thực, độ trễ thấp và tính năng sao chép giọng nói trung thực.
Cảnh sát Giao thông Anh (BTP) đã bắt đầu áp dụng công nghệ nhận diện khuôn mặt trực tiếp tại các nhà ga tàu điện ngầm ở London nhằm tăng cường an ninh và ngăn chặn tội phạm.