联合国系统数据共享平台:26个联合国机构承诺使全球数据具备人工智能就绪能力

  |  

联合国面临的数据难题并非在于收集数字本身,而在于如何将这些数据连接起来。几十年来,联合国系统各机构收集了全球最权威的统计数据——涵盖健康、贫困、教育和用水等领域——却将这些数据分别存储在彼此独立的数据库中,这些数据库之间鲜有互通。2026年9月17日,联合国和谷歌宣布了一项解决方案:联合国系统数据共享平台(UN System Data Commons) ,这是一个开放的、支持人工智能的平台,旨在将这些分散的信息整合到一个可搜索的单一资源中,任何人都可以用通俗易懂的语言进行查询。

要点总结

  • 联合国系统数据共享平台将分散的联合国统计数据整合到一个可用于人工智能的知识图谱中,取代了旧的联合国数据门户网站。
  • 它运行在谷歌的开源平台Data Commons上,并支持自然语言搜索和 AI 助手功能。
  • Google.org 提供了 200 万美元的资金和技术支持,而联合国基金会则支持了该项目的推广。
  • 已有 26 个联合国机构承诺使用该平台,其中近 20 个机构的数据在启动时已经上线,目标是到 2027 年使 80% 的联合国系统统计数据集加入该平台。
  • 联合国儿童基金会的另一项基准测试发现,领先的人工智能聊天机器人回答全球发展问题的平均准确率仅为 21.2%,这凸显了权威、可追溯的数据的重要性。

联合国系统数据共享平台:一个面向全球统计的AI就绪平台

联合国系统数据共享平台的核心目标是终结分析人员此前在开展任何真正研究之前需要花费数月时间手动处理电子表格的繁琐工作。该平台基于谷歌于2018年首次推出的开源框架Data Commons构建,旨在将公共数据集组织成统一的结构。新平台取代了原有的UNData门户网站,后者依赖于更为传统的浏览和搜索式数据库界面。

Google.org 为该项目提供了 200 万美元的能力建设资金和技术支持,以帮助建立该平台的核心基础设施,并与联合国基金会合作。谷歌数据共享团队负责人普雷姆·拉马斯瓦米表示,该系统托管在联合国管理的实例上,最终目标是由联合国独立运行。“我们在整个推广过程中采取了‘培训师培训’的方式,并且已经看到联合国系统团队迅速提升了工作效率,”拉马斯瓦米说道。

联合国统计司代理司长沙塔努·穆克吉将此次启动描述为规模上的飞跃,而非小幅升级。穆克吉表示:“我们在规模、范围和灵活性方面都取得了数量级的进步,首次实现了联合国系统内如此众多机构之间的互联互通。”他还补充说,此次启动的另一个重要意义在于“借此机会使我们的数据能够应用于人工智能”。

将联合国系统各部门各自为政的信息孤岛整合为一个互联的知识图谱

该平台的主要成就是使原本互不兼容的数据集能够使用同一种语言。联合国系统数据共享平台无需分析人员手动协调各机构间格式、时间线和地域范围不匹配的数据,而是自动将这些指标整合到一个互联的环境中——联合国称之为“人工智能就绪的知识图谱”。这使得研究人员能够专注于发现趋势和构建基于证据的解决方案,而不是忙于格式化电子表格。

基于模型上下文协议等开放标准构建

互操作性贯穿整个平台的设计。它支持模型上下文协议(MCP),这是谷歌去年添加到数据共享平台(Data Commons)的一项标准,它允许人工智能系统直接连接到外部数据源,并提取统计数据及其来源信息。正是这一技术基础使得人工智能代理能够自主查询联合国的数据,而无需人工逐个浏览数据集。

自然语言搜索和人工智能助手改变了数据访问方式

现在任何人都可以用通俗易懂的语言向联合国系统数据共享平台提问,并获得相关的数据和交互式图表,而无需知道哪个机构持有基础数据集。这意义重大,因为它让那些以前因技术数据库界面而无法参与严肃统计工作的人们——包括非营利组织项目经理、记者和政策分析师——也能参与其中。

平台如何回答通俗易懂的问题

用户可以输入诸如“农村地区清洁用水的获取如何影响入学率”、“过去十年有多少人用上了电”或“不同地区的预期寿命发生了怎样的变化”等问题,并立即获得答案。喜欢浏览的用户可以使用“探索”选项卡按地点或主题(例如健康或教育)进行筛选,而“博客”版块则将复杂的趋势(例如联合国儿童基金会关于减少儿童贫困的数据)转化为易于理解的报告。

此次发布也进一步推动了人工智能融入实际研究工作流程。由于该系统在设计之初就考虑到了人工智能的应用,因此人工智能代理可以自主获取权威数据,连接不同领域的数据,并将所有信息整合到图表、信息图或撰写报告中——这些工作过去需要分析师花费数小时进行手动搜索。在一次演示中,谷歌利用人工智能系统追踪了美国总统艾滋病紧急救援计划在非洲的影响;该系统提取了联合国关于艾滋病毒感染、艾滋病死亡率和预期寿命的统计数据,并将其转化为信息图。

为什么准确的数据至关重要:联合国儿童基金会人工智能准确性测试

推动人工智能赋能统计数据的举措,其背景也凸显了其中的利害关系。联合国儿童基金会(UNICEF)对六款大型语言模型——OpenAI 的 GPT-4o 和 GPT-4o-mini、Anthropic 的 Claude Sonnet 4.5 和 Haiku 4.5,以及 Google 的Gemini 2.5 Flash 和 Gemini 2.0 Flash——进行了基准测试,测试了超过 13.3 万条关于全球发展指标问题的回答。据联合国儿童基金会首席统计学家若昂·佩德罗·阿泽维多(João Pedro Azevedo)在 TechCrunch 报道的一次线上简报会上介绍,平均准确率仅为 21.2%。

阿泽维多表示,大约五分之三的回复未能提供任何可用的数字,这通常是因为模型给出了模棱两可的答案。更令人惊讶的是:大约两天后,当使用相同的模型版本再次运行相同的问题时,两次都返回数字的模型只有大约一半的概率给出相同的数字。联合国儿童基金会关于这项研究的工作报告尚未经过同行评审,但该组织表示计划同时发布其方法论、代码和数据。

这种不一致性有助于解释为何对可靠、来源明确的数据的需求正在快速增长。据阿泽维多称,联合国儿童基金会自身的数据网站每月访问量超过600万次,从1月1日至9月14日,用户点击ChatGPT答案链接带来的流量同比增长了67%。这些由人工智能驱动的流量目前占所有访问量的6.4%,联合国儿童基金会估计,人工智能助手总体上贡献了该网站约十分之一的访问量。阿泽维多表示,随着越来越多的人依赖人工智能工具来查找和解读信息,追溯数据的原始来源(即联合国系统数据共享平台)变得越来越重要——而这正是联合国系统数据共享平台旨在维护的可追溯性。

谷歌团队自身也谨慎地避免过分夸大人工智能数据所能提供的保障。“因为模型可能会误解细微差别,所以在引用或发布结果之前,始终应该由人工进行审核,”拉马斯瓦米说道。

数据验证及通往2027年的道路

所有进入平台的数据集在正式上线前都会经过联合国系统统计学家和技术专家的验证,这一步骤旨在确保人工智能生成的答案基于官方、可信的事实,而非近似值。目前已有26个联合国机构承诺加入数据共享平台,其中近20个机构的数据在平台上线之初即可使用。

更广泛的推广工作仍在进行中。未来一年,联合国系统计划继续添加来自更多机构的数据集,其既定目标是到2027年覆盖联合国系统80%的统计数据集。读者可直接访问data.un.org浏览该平台。

常问问题

什么是联合国系统数据共享平台?

这是一个开放的、支持人工智能的平台,它将全球联合国统计数据集整合到一个可搜索的资源中,以便更轻松地访问数据。该平台基于谷歌的数据共享框架构建,取代了旧的联合国数据门户网站。

该平台如何帮助用户探索数据?

它支持自然语言搜索,使记者和政策分析师等用户能够用简单的语言提出问题,并立即收到数据和可视化结果,同时还提供人工智能助手工具,自动进行数据检索和报告。

平台上的数据可信度如何?

所有数据集均由联合国系统统计学家和技术专家进行验证,以确保准确性和可信度,该平台会跟踪每个统计数据的原始来源,以便可以追溯和验证数字。

该平台未来有哪些扩展计划?

联合国系统的目标是增加来自更多机构的数据集,目前已有 26 个实体承诺加入,近 20 个实体在启动时上线,目标是到 2027 年覆盖 80% 的统计数据集。

本文由人工智能辅助生成,并经编辑团队审核。

推荐阅读

相关文章

阿里巴巴股价因102亿美元AI投资押注下跌10%

阿里巴巴股价周一收于118.47美元,下跌约10%,此前该公司确认将以102亿美元股权融资,用于其人工智能业务的拓展。目前股价已跌破日线图上的三条关键移动平均线。整体趋势结构已明显趋于沉重。阿里巴巴——日线图,包含蜡烛图、EMA20/EMA50 和成交量。

红杉资本AI投资达100亿美元,创其史上最大押注

风险投资公司很少会一次性宣布100亿美元的投资,但红杉资本(Sequoia Capital)刚刚就这么做了。这项于2026年8月6日左右公布的红杉资本人工智能投资计划,是该公司迄今为止最大的一笔投资,它将传统的人工智能投资与红杉所谓的“再工业化”相结合——后者涵盖制造业、国防技术、能源和关键矿产等领域。

癌症基因组学AI在乳腺癌与结直肠癌测试中达到p < 0.0001的显著性水平

识别癌症驱动基因一直是生物学中最棘手的问题之一。如今,一种名为RegNetAgents的全新框架正将多智能体人工智能应用于这一挑战,实现了过去需要耗费大量人力在不兼容的数据集上进行人工筛选的自动化流程。对于从事癌症基因组学、人工智能和计算生物学交叉研究的研究人员而言,该方法代表着调控候选基因识别和排序方式的重大变革。

“代币末日”冲击企业AI支出,成本增速远超投资回报率

企业在人工智能方面的支出正遭遇意想不到的瓶颈。多年来,企业奉行“人人试验”的政策,但如今越来越多的公司发现,鼓励成千上万的员工自由使用人工智能工具,最终体现在账单上和战略规划中的效果截然不同。账单来得比投资回报来得快。要点总结由于按代币计费的 API 定价模式导致成本意外高昂,各公司正在减少对人工智能的无限制支出。

美国对 ChatGPT 的监管使华盛顿成为人工智能守门人

美国联邦政府正着手控制谁能使用最先进的ChatGPT技术——这一举措可能会重塑美国企业与尖端人工智能的互动方式。根据新规,希望使用OpenAI最新模型的公司必须首先通过政府的审查程序,这标志着华盛顿对硅谷人工智能竞赛采取的最直接干预措施之一。

杰夫·贝佐斯驳斥人工智能将导致失业的担忧,Prometheus 获得 120 亿美元融资

杰夫·贝佐斯现在说了一些大多数人都不想听到的话:他通过普罗米修斯项目筹集的人工智能就业资金不会导致美国出现大规模失业潮,至少不会像许多人担心的那样。这位亚马逊创始人认为,人工智能将提高生活水平,使劳动力更加稀缺,而不是更容易被取代。这与主流观点截然不同。