
会懂网AI资讯,9月7日,OpenAI首席科学家Jakub Pachocki于9月6日发布长文《An Alien Mind》(一个外星大脑),警示当前没有任何AI实验室真正解决模型对齐与安全监测问题,并呼吁主动放缓部分开发、推动独立审查。奥特曼称其为”重要文章”。
文章标题本身就是一个判断:随着模型能力增强,其内部表征与推理路径越来越难以被人类理解。我们面对的不再是”可解释的程序”,而是一个行为上有效、机理上陌生的系统——就像一个外星大脑,能给出答案,却说不清为什么。
这一担忧的核心是”可监测性”。如果无法理解模型内部的决策过程,就无法在其能力超越人类时及时发现危险信号。现有对齐技术多依赖外部行为反馈,但在模型足够聪明之后,行为层面的监督可能被绕过,形成”看起来安全、实际不可控”的局面。
Pachocki提出的建议包括放缓部分开发与引入独立审查。这在行业内并不常见——作为前沿实验室的首席科学家,公开呼吁放慢节奏,某种程度上是在给竞争对手让路。这也从侧面说明,他认为风险的严重程度已经超过竞争考量本身。
奥特曼称这篇文章”重要”,则显示OpenAI高层在这一问题上至少存在共识:能力扩张必须与安全保障同步推进。近期GPT-6 Astra发布时同步附带安全文件并向国会简报,也是同一逻辑在不同场合的体现。
外界的反应则更为复杂。批评者认为,由实验室自己定义”放缓”的节奏缺乏约束力,独立审查的机制与权限也尚未明确,真正有效的治理需要外部标准与法律责任,而非行业自律。但无论如何,来自核心人物的公开预警,已经把这一议题推到了台前。






















暂无评论内容