原文标题:UN turns to Google to make its global data ready for AI agents

联合国周四宣布,它正在与谷歌合作,让人工智能系统更容易访问和使用其大量的全球统计数据。

这个新系统被称为联合国系统数据共享,建立在谷歌的开源数据共享平台之上,让人们使用自然语言查询来搜索联合国各机构的统计数据。它取代了现有的 UNData 门户,用户在很大程度上必须通过更传统的数据库界面浏览和搜索统计数据。新平台还支持模型上下文协议(MCP),该标准允许人工智能系统直接连接到外部数据源。

用户越来越多地转向人工智能工具来寻求答案,但许多系统仍然难以可靠地提供权威数据。联合国儿童基金会首席统计师若昂·佩德罗·阿泽维多 (João Pedro Azevedo) 在一次虚拟简报中告诉记者,该机构对六种大型语言模型进行的基准测试,涵盖了超过 133,000 条有关全球发展指标问题的回答,得出的平均准确度分数仅为 21.2%。

测试涵盖了OpenAI的GPT-4o和GPT-4o-mini、Anthropic的Claude Sonnet 4.5和Haiku 4.5以及Google的Gemini 2.5 Flash和Gemini 2.0 Flash,

阿泽维多告诉 TechCrunch。

阿泽维多说,大约五分之三的回复根本没有提供可用的数字,这通常是因为模型对冲了他们的答案。然而,当大约两天后在相同的模型版本上再次运行相同的问题时,两次提供数字的模型仅返回相同数字的大约一半。

该研究是联合国儿童基金会正在准备提交期刊的工作论文,尚未经过同行评审。该组织表示,计划与该论文一起发布其方法、代码和数据。

联合国儿童基金会今年还发现生成式人工智能助手对其数据网站的访问量急剧上升,该网站每月的访问量超过 600 万次,是该机构最受欢迎的网站之一。阿泽维多告诉 TechCrunch,从 1 月 1 日到 9 月 14 日,用户点击 ChatGPT 答案中的链接访问该网站的次数同比增长了 67%。此类推荐占今年所有会议的 6.4%,而联合国儿童基金会估计,目前人工智能助理的访问量约占十分之一。

联合国表示,其 26 个实体已承诺加入数据共享,近 20 个实体的数据在启动时可用。此外,它的目的是

到 2027 年,将联合国系统 80% 的统计数据集引入该平台。

联合国系统数据共享。图片来源:谷歌

联合国统计司代理司长尚塔努·穆克吉 (Shantanu Mukherjee) 表示:“我们在规模、范围和灵活性方面都先进了几个数量级,首次在联合国系统内如此多的机构之间建立联系。” “而且[我们]也在利用这个时刻让我们的数据为人工智能做好准备。”

Google.org 提供了 200 万美元的能力建设资金和技术支持,以建立该平台的核心基础设施。谷歌数据共享团队的负责人普雷姆·拉马斯瓦米 (Prem Ramaswami) 告诉 TechCrunch,该系统托管在联合国管辖的实例上,并计划最终由联合国独立维护、运营和扩展。

“我们在整个部署过程中采取了‘培训培训师’的方法,我们已经看到联合国系统团队的迅速壮大,”拉马斯瓦米说。

Google 于 2018 年推出了 Data Commons,旨在将不同来源的公共数据集组织到一个通用框架中。去年,它增加了对 MCP 的支持,允许人工智能代理直接查询 Data Commons 的统计数据及其来源。

联合国平台还跟踪

每个统计数据的来源,因此人们可以将人工智能系统检索到的数据追溯到联合国的原始来源。阿泽维多告诉记者,随着越来越多的人依靠人工智能工具来查找和解释信息,这一点很重要。

除了使人工智能代理能够检索个人统计数据之外,谷歌还演示了如何通过 MCP 连接到联合国数据的人工智能系统可以汇集多个指标,并使用它们生成仪表板、图表和书面分析,而无需用户手动查找和组合底层数据集。

在一次演示中,谷歌要求人工智能系统找出美国总统非洲艾滋病救援紧急计划的影响。该系统确定了联合国有关艾滋病毒感染、艾滋病死亡率和预期寿命等指标的相关统计数据,并用它们来制作信息图。

然而,给人工智能系统提供权威数据并不一定意味着它的结论具有权威性。拉马斯瓦米说:“由于模型可能会误解细微差别,因此人们在引用或发布输出之前应始终对其进行审查。”