Qwen 3.8-Flash-Next sắp ra mắt: Mô hình 125B đầy hứa hẹn
Alibaba chuẩn bị trình làng Qwen 3.8-Flash-Next với quy mô 125B tham số. Trang thông tin của mô hình đã xuất hiện trên ModelScope và đang thu hút sự chú ý lớn từ cộng đồng công nghệ quốc tế.
Alibaba chuẩn bị trình làng Qwen 3.8-Flash-Next với quy mô 125B tham số. Trang thông tin của mô hình đã xuất hiện trên ModelScope và đang thu hút sự chú ý lớn từ cộng đồng công nghệ quốc tế.
Testing Catalog@testingcatalogGatik cho phép khách hàng theo dõi trực tiếp lộ trình xe tải tự lái và công khai video vận hành thực tế. Công ty vừa huy động thành công 200 triệu USD, nâng định giá lên 1 tỷ USD với các đối tác lớn như Pepsi.
Elvis Saravia@omarsar0Prime Agent cung cấp môi trường IPython REPL liên tục và hệ thống Continual Harness giúp AI tự lưu trữ lịch sử, kỹ năng và ngữ cảnh, từ đó tối ưu hóa khả năng tự cải tiến qua các tác vụ phức tạp.
a16z vừa chia sẻ bộ tài liệu phân tích sâu sắc về xu hướng ứng dụng AI trong tiêu dùng, nhấn mạnh vai trò của AI như một nền tảng cốt lõi để thúc đẩy sự phát triển của các lớp ứng dụng thực tế.
SenseTime@SenseTime_AISenseTime chính thức mở mã nguồn SenseNova U1.5 Lite, hỗ trợ tạo và chỉnh sửa ảnh chuyên sâu với khả năng xuất 4K. Người dùng có thể trải nghiệm miễn phí với hạn mức 1.500 yêu cầu mỗi 5 giờ.

Tencent WorkBuddy@WorkBuddy_AIWorkBuddy đã hỗ trợ kết nối với Notion, cho phép bạn truy xuất và xử lý dữ liệu từ các tài liệu, ghi chú ngay trong không gian làm việc của mình một cách thông minh.

Tencent khẳng định thông tin về việc tái cơ cấu bộ phận AI Gaming là sai sự thật. Hãng cho biết bộ phận AI Engine đã tồn tại từ lâu nhằm tối ưu hóa quy trình phát triển và sáng tạo lối chơi, không phải là một đơn vị mới thành lập như đồn đoán.
Apple chính thức trình làng chip M5 Ultra với kiến trúc 4 chip, băng thông bộ nhớ 1.2 TB/s và hiệu năng AI tăng gấp 4.5 lần so với thế hệ trước, cho phép chạy các mô hình ngôn ngữ lớn ngay trên thiết bị.
Apple vừa trình làng chip M6 trên Mac mini mới với tiến trình 2nm đột phá, mang lại hiệu năng đơn nhân mạnh nhất thế giới và cải thiện 30% khả năng xử lý AI so với thế hệ trước.
Apple vừa trình làng Mac mini thế hệ mới với chip M6 và M5 Pro, mang lại bước nhảy vọt về hiệu năng AI và tốc độ xử lý. Sản phẩm hỗ trợ Wi-Fi 7, Bluetooth 6 và sẽ chính thức lên kệ vào ngày 22/9.
SemiAnalysis@SemiAnalysis_OpenAI đang tự phát triển chip ASIC mang tên Jalapeño, được kỳ vọng vượt trội Nvidia Blackwell về hiệu suất trên mỗi MW và tổng chi phí sở hữu (TCO).
cb_doge@cb_dogeJPMorgan duy trì xếp hạng khả quan với SpaceX, kỳ vọng Grok 4.6 sẽ tối ưu chi phí vượt trội. Đồng thời, ngân hàng dự báo Grok 5 ra mắt vào tháng 12 sẽ tạo bước ngoặt lớn về hiệu năng nhờ dữ liệu từ Cursor.

SemiAnalysis@SemiAnalysis_Các tập đoàn công nghệ lớn đang đổ nguồn vốn khổng lồ vào hạ tầng AI, từ mua đất, thiết bị đến thuê nhà thầu xây dựng trên toàn cầu, dự kiến đạt mức chi tiêu hơn 1.000 tỷ USD trong năm tới.
Rohan Paul@rohanpaul_aiAnthropic đã yêu cầu nhân viên tại San Francisco làm việc tại nhà trong hai ngày đầu tuần sau khi nhận được cảnh báo về khả năng đình công từ lực lượng bảo vệ. Tuy nhiên, công đoàn SEIU đại diện cho các nhân viên bảo vệ đã lên tiếng bác bỏ thông tin này.

OpenBMB@OpenBMBNhà phát triển JacobLinCool đã tinh chỉnh MiniCPM5-1B bằng hai bộ LoRA để tạo ra trợ lý tư vấn sáng tạo và công cụ phân loại dự án thi đấu, chứng minh tiềm năng mạnh mẽ của các mô hình nhỏ khi được tối ưu hóa cho tác vụ cụ thể.

Nghiên cứu mới chỉ ra rằng việc mở rộng cửa sổ ngữ cảnh không hiệu quả do suy giảm tương quan. Thay vào đó, phương pháp phân bổ lặp lại theo trình tự giúp tăng tỷ lệ thu hồi lên tới 20.5%, tối ưu hóa hiệu suất cho các hệ thống RAG.
Meta chuẩn bị trình làng Hatch, trợ lý AI tích hợp đa nền tảng với các tính năng tùy chỉnh chuyên sâu, cùng mô hình AI mới mang tên Watermelon. Dịch vụ này dự kiến áp dụng mô hình đăng ký trả phí với mức giá cao cấp lên tới 199,99 USD/tháng.
Apple trình làng Mac Studio mới trang bị chip M5 Max và M5 Ultra, mang lại hiệu năng AI tăng 4,3 lần và khả năng chạy các mô hình ngôn ngữ lớn (LLM) trực tiếp trên thiết bị với bộ nhớ thống nhất lên đến 512GB.
STARFlow2 tích hợp dòng chuẩn hóa tự hồi quy vào LLM, tận dụng cấu trúc chung để tạo ảnh đa phương thức mà không làm giảm độ trung thực của hình ảnh như phương pháp token hóa rời rạc.
Apple chính thức trình làng chip M6 tiến trình 2nm và M5 Ultra mạnh mẽ nhất từ trước đến nay, trang bị cho dòng Mac mini và Mac Studio mới nhằm tối ưu hóa khả năng xử lý AI.
Elvis Saravia@omarsar0AutoSaddler của Microsoft tự động tối ưu hóa các khung làm việc AI Agent bằng cách phân tích lỗi và chỉnh sửa mã nguồn, giúp cải thiện đáng kể hiệu suất trên các bộ benchmark khó như SWE-Bench Pro.

Dex Horthy (HumanLayer)@dexhorthyDex Horthy chia sẻ quy trình dùng AI để chia nhỏ các dự án hàng chục nghìn dòng code thành các PR tinh gọn, giúp việc kiểm duyệt và triển khai tính năng lớn trở nên nhanh chóng và hiệu quả hơn.
Được sáng lập bởi cựu lãnh đạo Yandex, Keenable vừa huy động 26 triệu USD để phát triển chỉ mục web khổng lồ với hơn 100 tỷ tài liệu, cung cấp dữ liệu thời gian thực cho các mô hình AI Agent.
Giám đốc sản phẩm Thibault Sottiaux chia sẻ về ChatGPT Work, công cụ giúp phổ cập hóa AI Agent cho người dùng phổ thông với 20 triệu người dùng hiện tại, đồng thời nhấn mạnh sự cải tiến vượt bậc trong xử lý tài liệu chuyên sâu.
Qualcomm giới thiệu CPU Oryon tùy chỉnh với xung nhịp đạt ngưỡng 5GHz và kiến trúc FlexCache mới, giúp tối ưu hóa hiệu năng cho AI trên thiết bị, chơi game và đa nhiệm.
GAC Aion và Neolix vừa xuất xưởng mẫu xe tự lái X6 chuyên dụng cho vận chuyển hàng hóa đô thị, với dung tích khoang chứa 6m3 phục vụ đa dạng nhu cầu từ thương mại điện tử đến thực phẩm và y tế.
Tại Đại hội thể thao robot hình người thế giới lần thứ 2, robot Yuanqi Zai của Honor giành ngôi quán quân vòng loại 100m, trong khi robot Lightning gây ấn tượng khi phá kỷ lục chạy của con người với thành tích 8,94 giây.
Kim@kimmonismusApple chính thức trình làng dòng chip M6 và M5 Ultra với trọng tâm là khả năng xử lý AI cục bộ. Trong đó, M6 đạt tốc độ xử lý LLM nhanh gấp 4,8 lần so với M4, băng thông bộ nhớ 170GB/s và tích hợp hệ thống Neural Engine kép mạnh mẽ.

OpenBMB@OpenBMBPlugin ComfyUI_VoxCPM_SM mới cho phép người dùng chạy mô hình VoxCPM2 trên máy tính cá nhân với yêu cầu VRAM thấp, hỗ trợ định dạng GGUF và tinh chỉnh LoRA bằng dữ liệu giọng nói tùy chỉnh.

cb_doge@cb_dogeJPMorgan duy trì xếp hạng khả quan cho SpaceX, nhấn mạnh việc tích hợp Cursor giúp Grok 4.6 đạt hiệu suất vượt trội với chi phí tối ưu, hứa hẹn trở thành động lực doanh thu AI chủ chốt.
