TechCrunch: AI
85

Sản phẩm

Liên Hợp Quốc hợp tác cùng Google ra mắt kho dữ liệu AI 'UN System Data Commons'

(giờ Việt Nam)

Tóm tắt AI

Liên Hợp Quốc bắt tay với Google xây dựng nền tảng dữ liệu mới dựa trên Data Commons, hỗ trợ truy vấn ngôn ngữ tự nhiên và giao thức MCP để tối ưu hóa cho các AI agent.

Bản dịch AI

UN turns to Google to make its global data ready for AI agents

Liên Hợp Quốc hôm thứ Năm thông báo rằng họ đang hợp tác với Google để giúp các hệ thống AI dễ dàng truy cập và sử dụng kho dữ liệu thống kê khổng lồ trên toàn cầu của tổ chức này.

Được gọi là UN System Data Commons, hệ thống mới này được xây dựng trên nền tảng mã nguồn mở Data Commons của Google, cho phép người dùng tìm kiếm số liệu thống kê từ các cơ quan của Liên Hợp Quốc bằng các truy vấn ngôn ngữ tự nhiên. Hệ thống này thay thế cổng thông tin UNData hiện tại, nơi người dùng chủ yếu phải duyệt và tìm kiếm số liệu thông qua giao diện cơ sở dữ liệu truyền thống. Nền tảng mới cũng hỗ trợ Model Context Protocol (MCP), một tiêu chuẩn cho phép các hệ thống AI kết nối trực tiếp với các nguồn dữ liệu bên ngoài.

Người dùng ngày càng tìm đến các công cụ AI để tìm câu trả lời, nhưng nhiều hệ thống vẫn gặp khó khăn trong việc cung cấp dữ liệu chính thống một cách đáng tin cậy. João Pedro Azevedo, chuyên gia thống kê trưởng của UNICEF, chia sẻ với các phóng viên trong một buổi họp báo trực tuyến rằng, một bài kiểm tra đánh giá của UNICEF trên sáu mô hình ngôn ngữ lớn với hơn 133.000 câu trả lời về các chỉ số phát triển toàn cầu chỉ đạt điểm chính xác trung bình là 21,2%.

Azevedo cho biết với TechCrunch rằng bài kiểm tra bao gồm các mô hình GPT-4o và GPT-4o-mini của OpenAI, Claude Sonnet 4.5 và Haiku 4.5 của Anthropic, cùng với Gemini 2.5 Flash và Gemini 2.0 Flash của Google.

Azevedo cho biết khoảng ba trong số năm câu trả lời không cung cấp được con số hữu ích nào, thường là do các mô hình đưa ra câu trả lời thiếu chắc chắn. Tuy nhiên, khi cùng những câu hỏi đó được chạy lại trên cùng các phiên bản mô hình khoảng hai ngày sau, các mô hình cung cấp con số trong cả hai lần chỉ đưa ra kết quả giống hệt nhau trong khoảng một nửa số trường hợp.

Nghiên cứu này là một tài liệu làm việc của UNICEF đang được chuẩn bị để gửi đăng trên các tạp chí và chưa được bình duyệt. Tổ chức này cho biết họ có kế hoạch công bố phương pháp luận, mã nguồn và dữ liệu cùng với tài liệu này.

UNICEF cũng ghi nhận lưu lượng truy cập từ các trợ lý AI tạo sinh vào trang web dữ liệu của họ tăng mạnh trong năm nay. Trang web này nhận được hơn 6 triệu lượt truy cập mỗi tháng và là một trong những trang web phổ biến nhất của cơ quan này. Azevedo nói với TechCrunch rằng lượt truy cập từ người dùng nhấp vào các liên kết trong câu trả lời của ChatGPT dẫn đến trang web đã tăng 67% so với cùng kỳ năm ngoái trong khoảng thời gian từ ngày 1 tháng 1 đến ngày 14 tháng 9. Những lượt giới thiệu này chiếm 6,4% tổng số phiên truy cập trong năm nay, trong khi UNICEF ước tính rằng các trợ lý AI hiện chiếm khoảng một trong 10 lượt truy cập.

Liên Hợp Quốc cho biết 26 đơn vị trực thuộc đã cam kết tham gia Data Commons, với dữ liệu từ gần 20 đơn vị đã sẵn sàng khi ra mắt. Hơn nữa, tổ chức này đặt mục tiêu đưa 80% tập dữ liệu thống kê của hệ thống Liên Hợp Quốc lên nền tảng này vào năm 2027.

"Chúng ta đang tiến bộ vượt bậc về quy mô, phạm vi và tính linh hoạt, lần đầu tiên kết nối được nhiều cơ quan trong hệ thống Liên Hợp Quốc với nhau," Shantanu Mukherjee, quyền giám đốc Ban Thống kê Liên Hợp Quốc cho biết. "Và chúng ta cũng đang tận dụng thời điểm này để chuẩn bị dữ liệu sẵn sàng cho AI."

Google.org đã cung cấp 2 triệu USD tài trợ nâng cao năng lực và hỗ trợ kỹ thuật để thiết lập cơ sở hạ tầng cốt lõi cho nền tảng. Prem Ramaswami, người đứng đầu nhóm Data Commons của Google, chia sẻ với TechCrunch rằng hệ thống được lưu trữ trên một phiên bản do Liên Hợp Quốc quản lý và dự kiến cuối cùng sẽ được Liên Hợp Quốc tự duy trì, vận hành và mở rộng quy mô.

"Chúng tôi đã áp dụng phương pháp 'đào tạo giảng viên' trong suốt quá trình triển khai và chúng tôi đã thấy đội ngũ của hệ thống Liên Hợp Quốc bắt nhịp rất nhanh," Ramaswami nói.

Google ra mắt Data Commons vào năm 2018 như một nỗ lực nhằm tổ chức các tập dữ liệu công cộng từ nhiều nguồn khác nhau vào một khuôn khổ chung. Năm ngoái, họ đã bổ sung hỗ trợ cho MCP, cho phép các tác nhân AI truy vấn trực tiếp Data Commons để lấy số liệu thống kê và nguồn gốc của chúng.

Nền tảng của Liên Hợp Quốc cũng theo dõi nguồn gốc của từng số liệu thống kê, để mọi người có thể truy xuất dữ liệu do hệ thống AI cung cấp về nguồn gốc ban đầu của Liên Hợp Quốc. Azevedo nói với các phóng viên rằng điều này rất quan trọng khi ngày càng có nhiều người dựa vào các công cụ AI để tìm kiếm và diễn giải thông tin.

Bên cạnh việc cho phép các tác nhân AI truy xuất từng số liệu thống kê riêng lẻ, Google đã trình diễn cách một hệ thống AI kết nối với dữ liệu của Liên Hợp Quốc thông qua MCP có thể tổng hợp nhiều chỉ số và sử dụng chúng để tạo ra các bảng điều khiển, biểu đồ và phân tích bằng văn bản mà người dùng không cần phải tự tay tìm kiếm và kết hợp các tập dữ liệu cơ sở.

Trong một buổi trình diễn, Google đã yêu cầu một hệ thống AI tìm hiểu tác động của Kế hoạch Cứu trợ Khẩn cấp của Tổng thống Hoa Kỳ về AIDS tại Châu Phi. Hệ thống đã xác định các số liệu thống kê liên quan của Liên Hợp Quốc về các thước đo như tỷ lệ nhiễm HIV, tỷ lệ tử vong do AIDS và tuổi thọ, sau đó sử dụng chúng để tạo ra một đồ họa thông tin.

Tuy nhiên, việc cung cấp dữ liệu chính thống cho hệ thống AI không nhất thiết khiến các kết luận của nó trở nên chính xác. "Vì các mô hình có thể hiểu sai các sắc thái, con người nên luôn xem xét các kết quả đầu ra trước khi trích dẫn hoặc xuất bản chúng," Ramaswami nói.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.

Liên Hợp QuốcGoogleAI AgentDữ liệu mởChuyển đổi số
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.