🤖
🤖
核心导读
联合国与谷歌合作推出“联合国系统数据共享平台”,基于谷歌开源Data Commons构建,支持自然语言查询和MCP协议,让AI智能体可直接访问权威统计数据。联合国儿童基金会测试显示,六大主流大模型回答全球发展指标问题的平均准确率仅21.2%,凸显AI获取可靠数据的迫切性。联合国计划2027年前将80%统计数据集接入该平台。
联合国周四宣布,正与谷歌合作,使其庞大的全球统计数据集合更便于AI系统访问和使用。
这一新系统名为“联合国系统数据共享平台”,基于谷歌的开源Data Commons平台构建,允许人们通过自然语言查询检索来自联合国各机构的统计数据。它取代了现有的UNData门户——用户此前基本上必须通过较为传统的数据库界面浏览和搜索统计数据。新平台还支持模型上下文协议(MCP),这一标准使AI系统能够直接连接外部数据源。
用户越来越多地转向AI工具寻求答案,但许多系统仍难以可靠地呈现权威数据。联合国儿童基金会首席统计师若昂·佩德罗·阿泽维多在虚拟简报会上告诉记者,该机构对六种大语言模型进行了基准测试,覆盖超过13.3万条关于全球发展指标问题的回答,平均准确率仅为21.2%。
阿泽维多告诉TechCrunch,测试涵盖了OpenAI的GPT-4o和GPT-4o-mini、Anthropic的Claude Sonnet 4.5和Haiku 4.5,以及谷歌的Gemini 2.5 Flash和Gemini 2.0 Flash。
阿泽维多说,约五分之三的回答根本没有提供可用的数字,通常是因为模型给出了模棱两可的答案。然而,当大约两天后对相同模型版本再次提出同样的问题时,两次都给出数字的模型,仅约一半的情况下返回了完全相同的数字。
该研究是联合国儿童基金会正在准备投稿至期刊的工作论文,尚未经过同行评审。该组织表示,计划随论文一同发布其方法论、代码和数据。
联合国儿童基金会还发现,今年来自生成式AI助手的流量在其数据网站上大幅上升。该网站每月访问量超过600万次,是该机构最受欢迎的网站之一。阿泽维多告诉TechCrunch,1月1日至9月14日期间,用户点击ChatGPT回答中的链接访问该网站的访问量同比增长67%。此类引荐占今年全部会话的6.4%,而联合国儿童基金会估计,AI助手总体上现在约占访问量的十分之一。
联合国表示,其26个实体已承诺加入Data Commons,发布时已有近20个实体的数据可供使用。此外,联合国的目标是在2027年前将联合国系统80%的统计数据集接入该平台。
联合国统计司代理司长尚塔努·穆克吉表示:“我们在规模、范围和灵活性上都先进了多个数量级,首次连接了联合国系统内如此多的机构。而且我们正借此机会让我们的数据也为AI做好准备。”
Google.org提供了200万美元的能力建设资金和技术支持,用于建立该平台的核心基础设施。领导谷歌Data Commons团队的普雷姆·拉马斯瓦米告诉TechCrunch,该系统托管在由联合国治理的实例上,并计划最终由联合国独立维护、运营和扩展。
拉马斯瓦米说:“我们在整个推广过程中采取了‘培训培训者’的方式,我们已经看到联合国系统团队迅速上手。”
谷歌于2018年推出Data Commons,旨在将来自不同来源的公共数据集组织到一个共同框架中。去年,它增加了对MCP的支持,使AI智能体能够直接查询Data Commons以获取统计数据及其来源。
联合国平台还会追踪每项统计数据的来源,因此人们可以将AI系统检索到的数据追溯至联合国原始来源。阿泽维多告诉记者,随着越来越多的人依赖AI工具查找和解读信息,这一点很重要。
除了让AI智能体能够检索单项统计数据外,谷歌还演示了通过MCP连接到联合国数据的AI系统如何汇总多个指标,并利用它们生成仪表盘、图表和书面分析,而用户无需手动查找和合并底层数据集。
在一次演示中,谷歌要求AI系统查找美国总统防治艾滋病紧急救援计划在非洲的影响。该系统识别出联合国关于HIV感染、艾滋病死亡率和预期寿命等指标的相关统计数据,并利用它们制作了一张信息图。
然而,为AI系统提供权威数据并不一定使其结论也具有权威性。拉马斯瓦米说:“由于模型可能误解细微差别,在引用或发布输出内容之前,始终应由人工审核。”
分享这篇文章: