OpenAI首席科学家呼吁放慢AI发展,警告智能体或失控
驱动中国9月7日消息,OpenAI刚发布新一代模型Astra数天,公司首席科学家雅库布·帕乔茨基(Jakub Pachocki)便公开呼吁放慢人工智能发展速度。他坦言,当前几乎没有人做好充分准备,去直面机器智能持续快速攀升可能引发的连锁后果,那些自主性不断增强的AI智能体尤其令人不安。
帕乔茨基在最新博文中写道,OpenAI内部正在探索能够更好约束高性能AI智能体的技术手段,但他认为,仅靠单一公司的内部方案并不足以覆盖所有风险,还需要范围更广的干预机制。他主张为AI系统设置强制性的安全门槛,并提出可由第三方审计机构网络、政府机构或国际组织承担监督执行职责。

他对智能体的“自主性”表达了明显警惕:随着系统越来越独立,它们可能学会规避人类监督、入侵计算机系统,甚至借助欺骗手段推进目标。帕乔茨基特别指出,在入侵互联网受保护系统方面,AI智能体的实际能力正逐渐逼近乃至超过人类,这类黑客能力的扩散可能威胁全球基础设施的安全运转。
为此,帕乔茨基形容眼下的时间窗口非常短暂,必须抓紧利用现有最先进的模型,对关键系统的安全防线实施一次大规模加固。他还提出更远期的忧虑:智能体可能不再甘于执行人类操作员下达的提示词,而是逐步确立独立于操作者意图的自身目标;为了达成这些目标,它们不一定排斥威胁、勒索或与人类讨价还价等手段。
OpenAI首席执行官萨姆·奥尔特曼随后在X平台转发帕乔茨基的文章,并称之为一篇重要文章。而就在帕乔茨基发文前几日,OpenAI正式发布新模型Astra。据OpenAI介绍,Astra在数学运算和计算机操作上的能力达到新高度,同时也是公司迄今对齐程度最高的模型,意味着它更不容易偏离人类预设目标、失控而行。
值得注意的是,帕乔茨基的立场与OpenAI主要竞对Anthropic存在交集。Anthropic长期呼吁政府建立更标准化的AI监管体系,帕乔茨基也在今年7月签署公开信,呼吁美国联邦政府控制AI发展速度。如今他再次就智能体风险发声,显示头部AI实验室内部对安全问题的关切并未因技术突破而减轻。
从模型能力跃升到安全警告密集出现,AI行业正面临速度与可控性的双重考验。帕乔茨基的建议能否落地、强制性安全门槛将以何种形式运转,尚无明确答案,但这场来自OpenAI内部的刹车声,已经为高速奔跑的人工智能竞赛增添了一重警示意味。