26/09

Thứ Bảy · 2 tin
Clément Delangue (Hugging Face CEO)@ClementDelangue
Mô hìnhĐiểm AI 49/100

Xiaomi tung bộ dữ liệu môi trường RL mã nguồn mở lên Hugging Face

Open-source RL envs for the win. On Hugging Face of course!

DịchXiaomi vừa phát hành kho lưu trữ môi trường RL (Học tăng cường) trên Hugging Face, một tài nguyên giá trị ước tính hàng triệu USD nếu mua thương mại, giúp cộng đồng tiếp cận miễn phí các tác vụ huấn luyện phức tạp.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 31/100

RGBD20K: Bộ dữ liệu chuẩn quy mô lớn cho phân đoạn ngữ nghĩa RGB-D

RGBD20K cung cấp 20.000 cặp ảnh RGB-D với 160 lớp chi tiết, vượt xa các bộ dữ liệu cũ như NYUv2 hay SUN RGB-D. Nghiên cứu cũng giới thiệu phương pháp SPF giúp đạt hiệu suất SOTA trong phân đoạn ngữ nghĩa.

25/09

Thứ Sáu · 1 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 45/100

TinyFish liên minh cùng 15 đối tác chiến lược xây dựng kho dữ liệu độc quyền cho AI

This is such a great initiative, because "DATA" is the moat now. @Tiny_Fish launched a 15-company a…

DịchTinyFish thành lập liên minh dữ liệu với 15 đơn vị như Crunchbase, Similarweb nhằm cung cấp nguồn dữ liệu bản quyền chất lượng cao cho các AI agent, giải quyết bài toán thiếu hụt thông tin chuyên sâu mà dữ liệu công khai trên internet không thể đáp ứng.

24/09

Thứ Năm · 1 tin

23/09

Thứ Tư · 3 tin
StepFun@StepFun_ai
Sản phẩmĐiểm AI 59/100

StepFun ra mắt onPanda: Công cụ mã nguồn mở tối ưu hóa dữ liệu và kiểm tra mô hình LLM

We've open-sourced onPanda 🐼 - the tool we use internally for LLM data annotation and model inspect…

DịchStepFun vừa công bố onPanda, công cụ mã nguồn mở giúp tăng tốc gắn nhãn dữ liệu LLM lên 52% và hỗ trợ kiểm soát token chi tiết. Nền tảng này cho phép tạo dữ liệu SFT và dữ liệu ưu tiên trong cùng một quy trình, đồng thời hỗ trợ gắn nhãn đa phương thức cho các tác nhân AI.

22/09

Thứ Ba · 1 tin

21/09

Thứ Hai · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

TeleAntiFraud 2.0: Bộ tiêu chuẩn mới giúp phát hiện lừa đảo viễn thông qua giọng nói

TeleAntiFraud 2.0 cung cấp quy trình tạo dữ liệu linh hoạt, giúp phân biệt chính xác giữa cuộc gọi lừa đảo và cuộc gọi dịch vụ thông thường dựa trên ngữ cảnh thực tế, hỗ trợ cập nhật các kịch bản lừa đảo mới nhất.

19/09

Thứ Bảy · 3 tin
IT Home
NgànhĐiểm AI 21/100

Vệ tinh tiên phong 'Ngũ Dương' - Chòm sao viễn thám góc nghiêng thấp đầu tiên trên thế giới chính thức xuất quân

Vệ tinh tiên phong A (Xiguang-4 01) thuộc chòm sao Ngũ Dương đã lên đường tới bãi phóng. Với khả năng chụp ảnh độ phân giải cao và hồng ngoại, hệ thống này sẽ cung cấp dịch vụ viễn thám chuyên biệt cho khu vực Vịnh Lớn và các vùng vĩ độ thấp.

Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Sản phẩmĐiểm AI 35/100

Epoch AI ra mắt công cụ theo dõi việc ứng dụng AI trong các nghiên cứu toán học trên arXiv

Epoch AI vừa giới thiệu công cụ mới giúp thống kê tỷ lệ và hình thức sử dụng AI trong các bản thảo toán học trên arXiv từ đầu năm 2023 đến tháng 8/2026, hỗ trợ các nhà nghiên cứu nắm bắt xu hướng ứng dụng công nghệ.

Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Sản phẩmĐiểm AI 28/100

Cùng sự kiệnEpoch AI công bố bộ dữ liệu về xu hướng ứng dụng AI trong nghiên cứu toán học

Epoch AI vừa phát hành bộ dữ liệu chi tiết về xu hướng sử dụng AI trong các bài báo toán học trên arXiv theo từng tháng và lĩnh vực, cho phép cộng đồng nghiên cứu tải về miễn phí.

Cùng sự kiện, bài đại diện «Epoch AI ra mắt công cụ theo dõi việc ứng dụng AI trong các nghiên cứu toán học trên arXiv»

18/09

Thứ Sáu · 2 tin
SemiAnalysis@SemiAnalysis_
Quan điểmĐiểm AI 32/100

Phân tích tần suất sử dụng công cụ của các mô hình OpenAI

How often do OpenAI models use tools? Following our Claude breakdown, we looked through 616, 300 Ope…

DịchDựa trên dữ liệu từ 616.300 phản hồi, SemiAnalysis tiết lộ tần suất gọi công cụ của các mô hình OpenAI, trong đó GPT-5.6 Terra dẫn đầu với trung bình 1,94 lần mỗi phản hồi.

Jason Liu@jxnlco
Sản phẩmĐiểm AI 60/100

Exa ra mắt Snapshot: Kho lưu trữ 400 tỷ trang web, cho phép tìm kiếm dữ liệu theo thời gian

Edited with Astra!?! That's crazy @donaldjewkes

DịchExa vừa giới thiệu Snapshot, công cụ lập chỉ mục 400 tỷ bản lưu trang web lịch sử, hỗ trợ truy vấn thông tin theo trạng thái quá khứ. Dữ liệu này hiện được ứng dụng trong huấn luyện mô hình AI, kiểm thử chiến lược và nghiên cứu sự phát triển của internet.

17/09

Thứ Năm · 3 tin
AI Notes@AYi_AInotes
NgànhĐiểm AI 48/100

Bảng xếp hạng AI nội địa Trung Quốc: Tongyi Qianwen trở lại Top 3, Zhihu Zhida gây bất ngờ

Tongyi Qianwen tái chiếm vị trí thứ 3 trong bảng xếp hạng AI Trung Quốc, trong khi Zhihu Zhida bứt phá mạnh mẽ nhờ tận dụng kho dữ liệu chuyên sâu từ cộng đồng. Cuộc đua AI hiện đã chuyển dịch từ năng lực mô hình sang khai thác hệ sinh thái nội dung thực tế.

Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Sản phẩmĐiểm AI 53/100

Epoch AI mở rộng công cụ theo dõi trung tâm dữ liệu, bao phủ 44% năng lực tính toán AI toàn cầu

Epoch AI vừa nâng cấp công cụ theo dõi trung tâm dữ liệu, mở rộng phạm vi từ 13 lên 86 cơ sở, chiếm khoảng 44% tổng năng lực tính toán AI thế giới. Nền tảng cung cấp dữ liệu chi tiết về chip, vốn đầu tư và tiến độ xây dựng, đồng thời công khai phương pháp tính toán cho cộng đồng.

16/09

Thứ Tư · 1 tin
Emad Mostaque@EMostaque
NgànhĐiểm AI 23/100

Emad Mostaque: Chất lượng dữ liệu quyết định sự phát triển của mô hình AI

You are what you eat and AI models especially so https://x.com/EMostaque/status/2099580512675262512...

DịchCũng giống như con người 'ăn gì thì người nấy', các mô hình AI cũng phụ thuộc hoàn toàn vào chất lượng dữ liệu đầu vào để hình thành trí tuệ.

15/09

Thứ Ba · 2 tin
Google Blog: AI
Nghiên cứuĐiểm AI 51/100

Google công bố báo cáo AI & Economy ATLAS: Sự khác biệt trong ứng dụng AI toàn cầu

Báo cáo mới từ Google cho thấy các quốc gia OECD ưu tiên AI trong lĩnh vực tài chính và kỹ thuật, trong khi các nước ngoài OECD tập trung vào hành chính, giáo dục và sáng tạo. Đáng chú ý, Brazil và UAE có tỷ lệ ứng dụng AI vượt xa kỳ vọng dựa trên GDP bình quân đầu người.

14/09

Thứ Hai · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

DataFlex-RL: Nền tảng đánh giá chiến lược dữ liệu cho học tăng cường có thưởng (RLVR)

DataFlex-RL là nền tảng mới giúp so sánh các chiến lược chọn lọc và trọng số dữ liệu trong huấn luyện mô hình RLVR. Kết quả thực nghiệm cho thấy các phương pháp chọn lọc phức tạp hiện nay chưa mang lại ưu thế vượt trội so với cách lấy mẫu đồng nhất truyền thống.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnFeyospace-v1: Đột phá trong huấn luyện mô hình AI chuyên biệt về an ninh mạng

Feyospace-v1 giới thiệu khung dữ liệu tập trung giúp tối ưu hóa việc huấn luyện các tác nhân AI an ninh mạng thông qua năm hệ thống chuyên biệt, giải quyết các rào cản về chi phí và môi trường thực thi để tạo ra hơn 164.000 quỹ đạo dữ liệu chất lượng cao.


Vì sao đáng đọc: Nghiên cứu giải quyết vấn đề thực tế trong huấn luyện AI an ninh mạng, cung cấp giải pháp kỹ thuật cụ thể cho các rào cản về dữ liệu và môi trường thực thi.

12/09

Thứ Bảy · 2 tin
Zhao Chunxiang@chunxiangai
NgànhĐiểm AI 40/100

Góc nhìn về 'tuyên ngôn chưng cất' của OpenAI: Khi dữ liệu trở thành vũ khí chiến lược

Chuyên gia Zhao Chunxiang phân tích hai khía cạnh của việc OpenAI tố cáo các bên lạm dụng mô hình cho mục đích quân sự, đồng thời cảnh báo về sự khan hiếm dữ liệu toàn cầu và hệ quả từ chiến lược 'đốt sách' của các ông lớn AI.

11/09

Thứ Sáu · 1 tin

10/09

Thứ Năm · 2 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 44/100

Sam Altman: Mức tiêu thụ token AI đang tăng trưởng theo cấp số nhân

Sam Altman on how AI token usage is growing at an exponential rate. "6 and a half years ago, the w…

DịchTại YC Startup School 2026, Sam Altman cho biết mức tiêu thụ token AI toàn cầu đã tăng từ gần bằng 0 lên trung bình 100.000 token/người/tháng chỉ sau 6 năm, cho thấy sự bùng nổ mạnh mẽ trong nhu cầu sử dụng AI.

JiQiZhiXin
NgànhĐiểm AI 88/100

Tinh chọnPhỏng vấn CEO Lightwheel AI Tạ Thần: Hai 'kim tự tháp' trong Scaling Law của trí tuệ hiện thân

CEO Tạ Thần chia sẻ về chiến lược xây dựng dữ liệu quy mô lớn cho robot, khẳng định Scaling Law của trí tuệ hiện thân cần hai trụ cột song hành: dữ liệu con người để huấn luyện và mô phỏng để đánh giá.


Vì sao đáng đọc: Bài viết cung cấp góc nhìn chuyên sâu từ chuyên gia đầu ngành về xu hướng dữ liệu cho robot, rất có giá trị cho những người quan tâm đến tương lai của AI hiện thân.

09/09

Thứ Tư · 3 tin
Mark Chen (OpenAI Giám đốc nghiên cứu)@markchen90
NgànhĐiểm AI 43/100

OpenAI bác bỏ cáo buộc sử dụng dữ liệu người dùng cho nghiên cứu Navier Stokes

Two things to distinguish: Did any human or agent look at user data as part of the Navier Stokes ef…

DịchGiám đốc nghiên cứu OpenAI khẳng định dữ liệu người dùng không liên quan đến nghiên cứu Navier Stokes, đồng thời xác nhận công ty sử dụng dữ liệu ẩn danh để cải thiện mô hình như tiêu chuẩn chung của ngành.

Dwarkesh Patel: Podcast & Blog
Nghiên cứuĐiểm AI 60/100

Tinh chọnNghiên cứu của Dwarkesh Patel: Chất lượng dữ liệu là chìa khóa thúc đẩy hiệu suất mô hình AI

Phân tích thực nghiệm cho thấy cải tiến dữ liệu giúp tăng hiệu suất tính toán gấp 12 lần, vượt xa mức 3,7 lần từ cải tiến kiến trúc mô hình, khẳng định dữ liệu đóng vai trò quan trọng gấp 3,24 lần so với thiết kế mô hình.


Vì sao đáng đọc: Nghiên cứu thực nghiệm có giá trị cao, giải mã được yếu tố cốt lõi đằng sau sự tiến bộ vượt bậc của các mô hình ngôn ngữ lớn hiện nay.

08/09

Thứ Ba · 1 tin

05/09

Thứ Bảy · 1 tin

02/09

Thứ Tư · 2 tin
QbitAI
Nghiên cứuĐiểm AI 92/100

Tinh chọnAnt Group giành giải bài báo xuất sắc nhất tại VLDB: Hệ thống OmniTable tăng tốc xử lý 35PB dữ liệu AI gấp 5,6 lần

Ant Group giới thiệu OmniTable, hệ thống bảng rộng thống nhất giúp tối ưu hóa quy trình làm sạch dữ liệu quy mô lớn, đạt giải bài báo công nghiệp xuất sắc nhất tại VLDB 2026.


Vì sao đáng đọc: Tin tức quan trọng về đột phá kỹ thuật trong xử lý dữ liệu cho AI, có tính ứng dụng thực tiễn cao và được công nhận bởi hội nghị uy tín hàng đầu thế giới.

31/08

Thứ Hai · 1 tin
Clément Delangue (Hugging Face CEO)@ClementDelangue
Hướng dẫnĐiểm AI 25/100

Hugging Face đón nhận hơn 4PB dữ liệu mô hình chỉ trong một tuần

Over 4 petabytes of models and datasets have been uploaded to HF just last week by AI builders and t…

DịchChỉ trong tuần qua, cộng đồng AI đã tải lên hơn 4PB dữ liệu lên Hugging Face, tương đương với khoảng 800.000 bộ phim HD, khẳng định vị thế nền tảng lưu trữ và cộng tác AI hàng đầu thế giới.

30/08

Chủ Nhật · 1 tin
TechCrunch: AI
Hướng dẫnĐiểm AI 47/100

Cựu sếp quỹ a16z Vijay Pande ra mắt VZVC: Quỹ đầu tư tinh gọn, vận hành bằng AI

Sau khi rời a16z, Vijay Pande thành lập VZVC với chiến lược tập trung vào ít thương vụ, vận hành tối giản nhờ AI. Ông nhấn mạnh rào cản lớn nhất của AI trong y tế hiện nay là sự thiếu hụt dữ liệu mở, buộc các công ty phải tự xây dựng kho dữ liệu riêng.

29/08

Thứ Bảy · 1 tin

28/08

Thứ Sáu · 2 tin
JiQiZhiXin
NgànhĐiểm AI 92/100

Tinh chọnĐường đua bị đánh giá thấp nhất năm 2026: Đưa robot đến được hiện trường

Ngành công nghiệp robot đang khát dữ liệu tương tác vật lý trầm trọng. Thay vì chỉ tập trung vào dữ liệu bàn tay, cuộc đua hiện nay chuyển dịch sang các giải pháp thu thập dữ liệu vận động toàn thân để giúp robot thực sự làm chủ môi trường thực tế.


Vì sao đáng đọc: Bài viết phân tích sâu sắc về nút thắt dữ liệu trong ngành robot, chỉ ra sự chuyển dịch từ thu thập dữ liệu đơn lẻ sang dữ liệu vận động toàn thân, rất có giá trị cho người làm công nghệ.
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (84 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Dữ liệu AI” | AIHOT.vn