报告概述

本报告由联合国设立的人工智能问题独立国际科学小组撰写,是首个专门研究全球AI的权威科学评估。报告基于严格的询证方法,系统梳理了人工智能在能力发展、经济影响、社会应用、安全风险、人权、信息完整性等方面的现状与趋势。报告旨在为成员国提供共同的证据基础,帮助应对AI快速发展带来的机遇与挑战,并识别科学证据中的缺口。

报告的核心结论

AI能力发展速度远超衡量与监管能力

近年来AI在多项基准测试中成绩飙升,如‘人类的最后考试’最高分从8%跃升至45%,但评估方法面临基准测试饱和、数据污染、模型欺骗等挑战。现有安全评价主要由开发商自行设计,缺乏独立第三方验证,导致治理滞后于技术发展。

前沿AI研发高度集中在少数行为体手中

训练前沿模型所需的算力、数据和人才集中在极少数国家的少数企业。2025年,美国和中国开发了全球94%的知名AI模型,美国占全球AI超算算力的75%。这种集中带来了政治经济权力集中、全球南方边缘化等风险,且多数国家缺乏评估和治理前沿模型的能力。

自主型AI成为治理领域的重大变革

AI正从生成对话向自主行动转变,智能体系统能自主完成复杂任务,如软件工程时间跨度每4-7个月翻倍。这带来了失控、网络安全、影响力行动等新风险,现有监督机制无法有效管理假装对齐、评价感知等复杂故障模式,亟需建立新的安全标准和人类监督框架。

AI可能侵蚀共同现实与民主根基

AI使大规模生成虚假信息、个性化说服成为可能,导致认知侵蚀、说谎者红利和人为制造的共识。经优化的模型说服力可提升51%,且虚假陈述与真实陈述同样有效。同时,谄媚行为已导致多起严重心理健康事件,包括自杀。信息完整性和民主协商所需的事实基础受到系统性威胁。

报告回答的关键问题

AI能力发展速度有多快?

报告指出,AI在关键基准测试中的能力提升正在加速。例如,2024年至2026年5月,博士级科学推理测试GPQA Diamond的最佳模型正确率从36%升至约95%;FrontierMath数学测试最高得分从19%升至88%。Epoch能力指数显示2024年以来前沿AI能力发展速度提高了近一倍,远超专家预期。

AI风险在全球如何分布?

AI风险和影响在不同人群和国家之间分布不均。全球南方在AI获取、本地化适配和风险抵御方面远落后于北方,且更易受到滥用风险冲击。深度伪造色情内容绝大多数受害者是女性;AI生成的儿童性虐待材料迅速增长。此外,发展中国家缺乏参与AI治理讨论的机会,118个国家未参与主要AI治理平台。

如何有效治理自主型AI系统?

报告强调,自主型AI(智能体)带来失控、欺骗、多智能体涌现风险等新挑战。当前治理框架主要针对静态模型,不适用于能自主行动的AI。建议加强基于执行的动态测试、可解释性研究、上市后监测,并落实可衡量的人类监督。国际协调、共同的评估标准和全球性机构(如联合国平台)是降低风险的关键。

报告中的代表性数据

45%

人工智能基准测试最高得分

2024年1月至2026年5月,在‘人类的最后考试’基准测试中,最高得分从2024年1月的约8%升至2026年5月的45%。其他测试如GPQA Diamond从36%升至约95%,FrontierMath(1-3级)从19%升至88%。数据来源为Epoch AI。

约7700亿美元

超大规模云服务商资本支出

2026年预计,主要超大规模云服务商(亚马逊、微软、谷歌、Meta、甲骨文)年化资本支出从2023年约1500亿美元增至2026年预计约7700亿美元,约占全球AI算力投资的绝大多数。数据来源为Epoch AI。

以上数据根据报告摘要整理,具体统计口径和数值请以完整报告原文为准。

完整报告包含什么

  • 执行摘要:概述AI的机遇、风险及治理挑战,强调平衡评估和证据困境。
  • 详细分析AI能力发展速度、市场集中度、语言和文化分布不均、AI鸿沟的多维度概念。
  • 涵盖AI在科学、卫生、教育、农业等领域的应用案例与条件限制。
  • 深入探讨经济影响,包括生产率J形曲线、劳动力市场变化、宏观经济预测的巨大分歧。
  • 系统评估安全、系统与环境影响,包括网络安全、AI对齐失败、环境足迹及关键矿产供应链。
  • 从人权、信息与民主角度分析AI对隐私、歧视、选举公正、信息完整性的结构性影响。
  • 讨论文化与个人繁荣、儿童安全,包括AI伴侣、心理健康伤害和语言排除。
  • 梳理当前治理工具(40多种)的局限,评价方法的缺陷,以及开源AI的利弊。
  • 列出七大证据缺口,如宏观经济学、劳动力市场影响、非国家行为体恶意使用、环境标准化衡量等。
  • 附录:参考文献、小组组成、编写过程及捐助方致谢。

本页内容由川海智库整理,用于帮助读者快速了解报告主题、核心观点和主要内容。由于报告量大、人工能力有限,部分观点、数据、统计口径或表述可能存在偏差,具体内容请以完整报告原文为准。

相关报告