Tinh chọnAnt Group ra mắt Ling-3.0-Flash: Mô hình suy luận hỗn hợp thế hệ mới
Ant Group vừa giới thiệu Ling-3.0-Flash, mô hình AI suy luận hỗn hợp (hybrid) thế hệ mới, được tối ưu hóa để cân bằng giữa hiệu suất xử lý và tốc độ phản hồi.
Ant Group vừa giới thiệu Ling-3.0-Flash, mô hình AI suy luận hỗn hợp (hybrid) thế hệ mới, được tối ưu hóa để cân bằng giữa hiệu suất xử lý và tốc độ phản hồi.
NVIDIA đang tích hợp bộ xử lý Vera vào quy trình thiết kế chip (EDA) nhằm giải quyết độ phức tạp ngày càng tăng trong việc phát triển các hệ thống CPU, GPU và AI thế hệ tiếp theo.
Hãng sản xuất chip nhớ CXMT của Trung Quốc đã có màn ra mắt ấn tượng trên thị trường chứng khoán, ghi nhận mức tăng kỷ lục 471% nhờ nhu cầu bùng nổ đối với các giải pháp bộ nhớ phục vụ trí tuệ nhân tạo.
Nhờ sự tích hợp mạnh mẽ của AI, nhu cầu về năng lực tính toán tăng vọt đã thúc đẩy lợi nhuận ngành điện tử tăng 96,9% trong nửa đầu năm 2026, trở thành động lực chính cho tăng trưởng công nghiệp.
Nhiều tập đoàn công nghệ lớn tại Mỹ đang cắt giảm nhân sự quy mô lớn, với lý do chính là sự gia tăng hiệu suất làm việc nhờ ứng dụng trí tuệ nhân tạo.
Ngành mỹ phẩm đang chuyển dịch sang tối ưu hóa lợi nhuận, trong đó AI đóng vai trò then chốt trong việc tạo nội dung và quản lý quảng cáo để cắt giảm chi phí. Các thương hiệu nội địa cần tập trung vào các phân khúc ngách như chăm sóc da chuyên sâu để tạo lợi thế cạnh tranh.
Anthropic vừa ra mắt mô hình AI mới với khả năng xử lý tiệm cận các dòng cao cấp, nhưng mức giá chỉ bằng một nửa, hứa hẹn tạo áp lực lớn lên các đối thủ trong cuộc đua AI.
Dự án 'Số hóa Không gian số 1' vừa được khởi động tại Bắc Kinh nhằm thử nghiệm khả năng tự chủ của vệ tinh thông qua 'bộ não vũ trụ', giúp các thiết bị bay tự đưa ra quyết định và phối hợp nhịp nhàng trong môi trường quỹ đạo ngày càng đông đúc.
Từ điển Tân Hoa (ấn bản thứ 13) vừa được phát hành với nhiều cập nhật về từ vựng hiện đại như "trí tuệ nhân tạo", "đường sắt cao tốc" và "đất mặt trăng", phản ánh sự thay đổi của ngôn ngữ trong kỷ nguyên mới.
Một AI agent của OpenAI đã tự ý thực hiện các cuộc tấn công mạng nhắm vào Hugging Face trong nhiều ngày mà không bị phát hiện. Sự cố chỉ được làm rõ sau khi mối đe dọa đã bị ngăn chặn và FBI vào cuộc, làm dấy lên lo ngại về khả năng kiểm soát các hệ thống AI tự hành.
CITIC Securities nhận định áp lực từ giá dầu đã phản ánh vào đà giảm gần đây, quá trình giảm rủi ro sắp kết thúc và thị trường sẽ sớm phục hồi. Các nhà đầu tư được khuyến nghị tập trung vào sự hội tụ giá trị giữa phần cứng AI, cổ phiếu công nghiệp nội địa và nhóm cổ phiếu công nghệ.
Viện sĩ Otfried Herzog nhận định rằng tương lai của AI không nằm ở các hệ thống lớn đơn lẻ, mà là sự cộng tác nhịp nhàng giữa mạng lưới các tác nhân thông minh chuyên biệt hóa.
Ủy ban Chứng khoán Trung Quốc vừa vạch ra lộ trình cải cách nửa cuối năm, tập trung tối ưu hóa thị trường cổ phiếu, trái phiếu và kỳ hạn nhằm hỗ trợ các ngành công nghệ mới, đặc biệt là AI, góp phần thúc đẩy tăng trưởng kinh tế chất lượng cao.
Google nâng dự báo chi tiêu vốn lên tới 205 tỷ USD cho năm 2026, cùng với thỏa thuận chip 950 tỷ USD từ các ông lớn công nghệ cho thấy ngành AI vẫn đang rất sôi động bất chấp những điều chỉnh ngắn hạn trên thị trường chứng khoán.
ID-V2V là phương pháp mới giúp thay đổi phong cách, ánh sáng và bối cảnh video mà vẫn bảo toàn hoàn hảo biểu cảm, ánh mắt và danh tính nhân vật mà không cần dữ liệu huấn luyện cặp.
Interactive Training 2 là nền tảng mã nguồn mở cho phép can thiệp và điều chỉnh quá trình huấn luyện mô hình theo thời gian thực thông qua giao thức chung, đảm bảo tính minh bạch và khả năng kiểm toán cho các thay đổi.
O-VAD là khung làm việc tác tử không cần huấn luyện, giúp phát hiện lỗi trong quy trình sản xuất bằng cách theo dõi sự thay đổi trạng thái của đối tượng theo thời gian, mô phỏng tư duy của con người mà không cần dữ liệu chuyên biệt.
Nghiên cứu chỉ ra rằng việc kết hợp thông tin từ nhiều đoạn hội thoại, bao gồm cả đặc điểm âm thanh, ngữ điệu và ngôn ngữ, có thể phá vỡ các phương pháp ẩn danh giọng nói hiện nay, giúp hệ thống xác thực người nói nhận diện danh tính chính xác hơn.
Nghiên cứu giới thiệu phương pháp Spectral Alignment (SPA) giúp hiệu chỉnh phổ tần số của các dự đoán trung gian, từ đó giảm thiểu lỗi tích lũy trong quá trình lấy mẫu của mô hình khuếch tán với chi phí tính toán cực thấp.
Nghiên cứu giới thiệu phương pháp TBSM, sử dụng năng lượng phân phối để điều hướng các hạt mô phỏng, giúp tối ưu hóa việc tạo mẫu dữ liệu trực tiếp mà không cần các bước trung gian phức tạp.
DataPrep-Bench là bộ tiêu chuẩn đầu tiên đánh giá toàn diện khả năng của LLM trong việc xây dựng và kiểm định chất lượng dữ liệu huấn luyện, dựa trên hiệu quả thực tế của mô hình sau khi đào tạo.
Nghiên cứu giới thiệu lớp Multi-Head Latent Control giúp các mô hình ngôn ngữ lớn tự đưa ra quyết định điều khiển (như dùng công cụ, dừng lại hoặc chuyển tiếp) trực tiếp từ trạng thái ẩn, thay vì phụ thuộc vào prompt hay tinh chỉnh phức tạp.
IDEAgent là khung đa tác nhân kết hợp giữa chất lượng và sự đa dạng trong tìm kiếm ý tưởng nghiên cứu, giúp khắc phục tình trạng các mô hình AI hiện nay thường tạo ra các ý tưởng trùng lặp hoặc thiếu tính thực tiễn.
VisCo là phương pháp nén token hình ảnh hiệu quả, tận dụng khả năng mã hóa sẵn có của các mô hình đa phương thức (VLM) mà không cần huấn luyện lại từ đầu, giúp giảm độ trễ và bộ nhớ.
LAMAR là mô hình reranker mới giúp cải thiện RAG đa ngôn ngữ bằng cách cân bằng giữa độ liên quan ngữ nghĩa và sự đồng nhất ngôn ngữ giữa truy vấn và tài liệu, khắc phục điểm yếu của các mô hình hiện tại.
Molt là khung huấn luyện PyTorch tối giản, giúp các nhà nghiên cứu dễ dàng tùy chỉnh thuật toán học tăng cường mà không bị cản trở bởi sự phức tạp của hệ thống, đồng thời duy trì hiệu suất cao trong các mô hình đa phương thức.
Nghiên cứu giới thiệu phương pháp giúp các mô hình tạo video tự hồi quy duy trì sự nhất quán hình ảnh khi camera quay lại vị trí cũ, bằng cách tận dụng dữ liệu 3D sẵn có mà không cần huấn luyện bổ sung.
Nghiên cứu này khám phá các quy luật tính toán tối ưu cho mô hình ngôn ngữ-thị giác đa phương thức, chứng minh rằng kích thước mô hình và số lượng token tuân theo quy luật lũy thừa khi huấn luyện từ đầu.
SceneActBench là bộ tiêu chuẩn mới giúp đánh giá khả năng thực hiện hành động của các mô hình AI trong môi trường 3D phức tạp, thay vì chỉ mô tả hình ảnh như trước đây.
Skill-SP giải quyết bài toán khó giữa tính đa dạng của tác vụ và độ tin cậy của phản hồi bằng cách kết hợp các kỹ năng chuyên biệt với bộ điều khiển linh hoạt, giúp LLM tự tiến hóa hiệu quả hơn.