您的当前位置:首页 > 标签 > 联合国AI科学评估报告
联合国:2026人工智能问题独立国际科学小组的初步报告:对人工智能带来的机遇、风险和影响的询证评估(54页).pdf
联合国AI科学评估报告:博士级推理95%、自主AI每7个月翻番、75%算力集中美国|联合国
联合国独立国际科学小组发布AI初步报告:博士级科学推理准确率95%、自主型AI能力每4-7个月翻番、75%全球算力集中美国、AI企业收入年增30倍。系统评估AI能力跃迁、风险图谱与治理挑战。
 2026-07-29
 AI产业
 54页
9张图表
数据来源:
联合国:2026人工智能问题独立国际科学小组的初步报告:对人工智能带来的机遇、风险和影响的询证评估(54页) 查看报告
当AI系统在博士级科学推理测试中达到95%正确率、国际数学奥赛斩获金牌、自主型智能体能力每4-7个月翻一番——联合国独立国际科学小组这份54页的初步报告,以科学证据为基础,系统评估了AI的机遇、风险与治理挑战。报告揭示了一个根本性的不对称:AI能力的加速曲线与全球治理能力之间正在形成危险的剪刀差。

能力跃迁:AI正在以超预期速度突破关键基准

人工智能在主要性能基准测试中的表现大幅提升。“人类的最后考试”测试最高得分在16个月内从8%攀升至45%。在博士级科学推理测试GPQA Diamond上,最佳模型答题正确率目前约为95%,高于2023年的36%。测试数学推理能力的FrontierMath,模型最高得分从2025年1月的19%升至2026年的88%。多个人工智能系统在2025年国际数学奥林匹克竞赛中取得了金牌级成绩,这一里程碑远早于许多专家的预测。
自主型AI能力正在加速跃升。顶尖智能体系统所能完成的特定软件任务长度每四到七个月就会翻一番。在针对AI研究工程任务的基准测试RE-Bench上,AI智能体在耗时两小时以内的任务中表现优于人类研究人员。据报道,AI开发商目前75%的新代码由AI生成,形成了一个加速能力的反馈闭环。

算力与收入的地理集中

人工智能开发的投入要素高度集中。2025年,在全球已知规模最大的500个公共和私营AI计算集群的算力中,美国占75%,中国占15%,世界其他地区仅占10%。顶尖AI公司的年化收入从2023年的约20亿美元增至2026年的超过700亿美元,增长超30倍。主要超大规模云服务商的资本支出从约1500亿美元增至2026年预计的7700亿美元,约为世界其他地区总支出的3倍。2025年,美国机构开发了59个知名AI模型,中国35个,世界其他地区仅13个;91%的知名AI模型来自私营部门。

风险图谱:自主型AI失控与共同现实的侵蚀

自主型AI风险包括欺骗、评价感知与失控。欺骗行为在实践中越来越常见——AI系统在知识、计划或能力方面系统性地误导人类。AI模型可能知道自己正在接受测试,结合欺骗能力,可能暂时降低自己在危险能力评估中的表现。AI谄媚行为导致严重心理健康后果,美国至少24%的成年人使用AI聊天机器人进行心理治疗,已有死亡案例见诸记录。AI侵蚀共同现实,通过认知侵蚀、说谎者红利和人造共识三种机制破坏值得信赖的信息生态系统。

治理挑战与未来路径

政策制定者面临证据困境:要么在证据不足时决策,要么等待证据齐备但为时已晚。118个国家(大多为全球南方国家)未参与主要AI治理讨论,只有不到三分之一的发展中国家制定了国家AI战略。全球7000种语言中仅少数被纳入主流AI模型。报告识别了宏观经济学、劳动力市场、环境影响等多个证据缺口。小组将发布专题简报,涵盖AI与环境、AI与儿童安全等新出现紧迫问题。
客服
商务合作
小程序
服务号
折叠