联合国与谷歌合作构建AI数据平台,UNData升级助力全球统计
联合国与谷歌合作推出UN System Data Commons(UNData),旨在提升全球统计数据的AI可用性。该平台基于谷歌开源Data Commons构建,支持自然语言查询和Model Con...
在人工智能技术快速发展的背景下,联合国与谷歌公司于2026年9月17日宣布达成一项重要合作,共同开发名为UN System Data Commons(简称UNData)的新一代全球统计数据平台。这一平台的推出标志着联合国在推动AI与大数据融合应用方面迈出了关键一步,将显著提升全球统计数据的可访问性和AI系统的利用效率。
新平台的核心优势在于其采用谷歌开源的Data Commons技术架构,并引入了Model Context Protocol (MCP)标准。与传统的UNData portal相比,用户可以通过自然语言直接查询统计数据,而无需熟悉复杂的数据库操作界面。例如,用户可以输入"How has maternal mortality changed in Southern Asia?"这样的问题,系统会自动从多个联合国机构的数据源中提取相关信息并给出答案。
这项合作的背景是当前AI系统在处理权威数据时存在的普遍问题。根据联合国儿童基金会(UNICEF)的一项测试,六款主流大语言模型在回答全球发展指标相关问题时,平均准确率仅为21.2%。测试覆盖了OpenAI的GPT-4o、Anthropic的Claude Sonnet 4.5、Google的Gemini 2.5 Flash等模型,结果显示大多数情况下模型无法提供具体的数值答案,而是倾向于使用模糊表述。
值得注意的是,这项测试结果并非偶然。当相同的模型在同一组问题上进行重复测试时,只有约一半的情况能给出一致的答案。这种不稳定性凸显了当前AI系统在处理权威数据时面临的挑战。为此,联合国正在准备一份详细的UNICEF工作论文,计划在期刊发表前公开其测试方法、代码和数据集,以促进学术界的进一步研究。
除了技术层面的改进,此次合作还反映了联合国在AI治理方面的战略考量。联合国秘书长安东尼奥·古特雷斯在9月16日的讲话中强调,需要全球范围内的协调努力来为人工智能设定安全框架。他指出,在地缘政治分歧日益加剧的背景下,不能让AI安全问题陷入无序竞争。古特雷斯特别提到,当前世界正面临三大生存威胁:失控的人工智能、气候危机以及日益加剧的不平等,这些都需要国际社会加强合作。
从实际应用场景来看,联合国的数据网站每月吸引超过600万次访问,其中很大一部分流量来自生成式AI助手,如ChatGPT。这表明,随着AI技术的普及,对高质量、结构化数据的需求正在快速增长。通过与谷歌的合作,联合国不仅提升了数据的AI友好性,也为全球政策制定者、研究人员和开发者提供了更便捷的数据获取渠道。
展望未来,UN System Data Commons预计将成为连接联合国各机构数据资源的重要枢纽。除了支持自然语言查询外,该平台还将整合更多实时数据流,为AI系统提供更全面、及时的信息支持。同时,联合国计划与更多科技公司合作,探索如何将区块链等新兴技术应用于数据治理,以确保数据的完整性和可信度。
图1展示了UN System Data Commons的用户界面,清晰地呈现了其自然语言查询功能和直观的数据展示方式。这种设计不仅降低了用户的学习成本,也为AI系统提供了更友好的数据交互接口。