联合国正携手谷歌改革全球统计数据访问机制,通过共建“联合国系统数据共享平台”(UN System Data Commons),提升人工智能代理查找、解读及使用数据的效率。

该平台基于谷歌开源的Data Commons构建,旨在取代现有的UNData门户。它将分散在多个联合国机构的数据整合为机器可读的统一系统,支持用户使用自然语言进行跨数据集搜索,无需再逐个浏览不同数据库。

这一举措源于AI直接获取权威数据的迫切需求。联合国儿童基金会的一份工作论文显示,在针对13.3万多个全球发展指标问题的测试中,六款主流AI模型的正确回答率仅为21.2%。新平台旨在让AI代理成为用户与信息间的关键接口,借助模型上下文协议(MCP),AI系统可直接连接外部数据源,在获取统计数据的同时检索原始来源,不再单纯依赖模型内部知识。

数据溯源与人工审查并重

数据溯源是该平台的核心功能之一,确保AI生成的答案可追溯至原始的联合国来源。此外,平台能通过MCP合并多个数据集,使AI代理能在无需用户手动干预的情况下,直接检索并分析信息。

尽管引入了权威数据源,谷歌数据共享平台负责人普雷姆·拉马斯瓦米(Prem Ramaswami)仍强调,由于模型可能误解细微差别,人类在引用或发布前必须审查输出结果。这也突显了当前AI技术的局限性及人工审核的必要性。

2027年前迁移80%数据集

目前,已有26个联合国实体承诺加入该平台,近20个实体已提供数据。谷歌公益部门(Google.org)为此提供了200万美元资金及技术支持。联合国计划进一步扩展该平台,目标是在2027年前将80%的统计数据集迁移至此。这一举措也反映了公共数据结构结构、机器可读且对AI系统可溯源的全球趋势。