全球超千名AI从业者联名请求美国支持AI安全国际合作,呼吁建立"刹车"机制
当地时间7月28日,来自OpenAI、Anthropic、谷歌等十余家前沿AI公司的1134名研究人员和从业者,共同签署了一份题为《掌控前沿技术》的公开声明,指出全球领先AI公司可能已接近实现自动化AI研究,存在AI能力发展速度超出人类理解与控制能力的风险。
声明强调,由于各企业与各国均面临激烈竞争压力、无人愿单方面减速,联名信请求美国政府支持一项国际合作,开发必要的技术与治理工具,以便有意识地掌控前沿自动化AI发展的节奏。
自动化AI研究:临界点正在逼近
联名信的核心关切在于"自动化AI研究"(Automated AI Research)——即AI系统能够自主进行AI算法改进和模型设计的能力。业内普遍认为,一旦AI具备了自我改进的能力,就可能触发"智能爆炸"式的递归自我提升,其发展速度可能远超人类预期和社会适应能力。
近期多项技术进展加剧了这一担忧。AI编程工具在处理复杂软件工程任务方面的能力快速提升,部分AI系统已经展现出在特定领域内自主设计和优化神经网络架构的初步能力。虽然距离完全自动化的AI研究仍有相当距离,但趋势已经引起前沿实验室内部研究人员的警觉。
呼吁国际合作而非单边管制
与以往单纯呼吁加强监管的倡议不同,此次联名信特别强调了国际合作的必要性。联名者认为,任何单一国家或公司的单边减速都可能导致"先行者劣势",使得谨慎者被竞争对手超越,最终反而降低了全球AI安全水平。
联名信建议的合作框架包括:建立跨国界的前沿AI能力监测与预警系统;共同开发AI安全测试基准和"刹车"技术工具;设立国际协调机制,确保在检测到危险能力阈值时各方能够同步采取行动。目前该声明尚未明确具体的"刹车"触发条件和执行机制,但已引发行业广泛讨论。
值得关注的是,签署者名单中既包括关注AI安全的积极倡导者,也包括多位来自商业化压力最大的前沿实验室的研究人员。这表明"竞赛压力下的安全困境"已成为行业内部的普遍焦虑。
行业反响与展望
联名信发布后,业内反应不一。支持者认为这是从业者自下而上推动安全治理的重要一步;怀疑者则指出,在当前地缘政治和技术竞争格局下,实质性的国际合作面临巨大挑战。
Anthropic CEO达里奥·阿莫代伊近期也表达了类似关切。他在7月27日发表的文章中表示,Anthropic从未主张全面禁止开放权重AI模型,但强调开放权重模型一旦发布,开发者将难以撤回或控制其使用方式,相关风险应通过严格测试而非预设判断来评估。
此次千人联名行动,将AI安全从实验室内部的讨论推向更广泛的公共视野,可能对正在制定AI监管框架的各国政策制定者产生一定影响。