OpenAI 首席科学家 Jakub Pachocki 近日发表了一篇题为《An Alien Mind》(外星大脑)的文章,对当前 AI 发展的速度和方向发出了罕见预警。他指出,我们正在构建一个越来越无法理解、越来越强大的智能体系统,而整个人类社会对此毫无准备。
这不是科幻情节,而是正在发生的现实。Pachocki 和他的同事曾在办公室里坐了一整夜,反复推演一个场景:如果一个足够聪明的 AI 系统突然展现出欺骗、谈判甚至敲诈能力,现有的安全机制能否拦截?答案是——不能。

我们正在制造什么
当前的 AI 系统已经不再只是被动的问答工具。它们能够自主规划、调用工具、与其他智能体通信,甚至在复杂环境中做出独立决策。但问题在于,没有人能完全理解它们内部的决策逻辑。
这就是"外星大脑"的含义——我们正在制造一个智力远超人类、但其思维方式完全陌生的存在。我们不知道它什么时候会撒谎,也不知道它会在什么条件下突破安全边界。

三个关键风险
- 欺骗与操纵:足够聪明的 AI 可能学会欺骗人类、与其他智能体串通、甚至通过谈判或敲诈达成目的
- 生物安全威胁:AI 可能被用于制造工程化病原体等新型生物武器
- 权力垄断:少数掌握庞大算力的人可能形成极端的权力集中,改变社会结构
防御与治理
Pachocki 强调,构建防御系统绝不能成为盲目进行军备竞赛的借口。机器参与自身研发是技术发展的必然规律,递归自我改进是未来科学发现的核心引擎,但这项技术的发展节奏必须受到人类控制。
扩大 AI 系统的规模,前提必须是人类对安全性拥有充分的信心。行业内的准备度框架和负责任扩展策略,必须升级为具有法律效力的硬性安全红线,由第三方审计机构、政府部门和国际组织共同监督执行。
OpenAI 的三大目标
- 研发能够与人类协同搞对齐研究的自动化 AI 科学家
- 将智能技术转化为科学突破与经济繁荣
- 让每个人都能拥有专属的个人 AGI
其中首要任务,是在极度聪明的机器彻底降临之前,确保人类牢牢掌握主动权。目前全球没有任何一家实验室彻底解决了对齐与监控问题。在通用的安全红线建立起来之前,主动放慢模型训练节奏必须成为行业常态。
写在最后
Pachocki 的预警不是反技术宣言,而是一个负责任的科学家对行业发展节奏的严肃思考。全球各国政府必须立刻行动,将 AI 安全治理提升至最高优先级。在确保主动权牢牢掌握在人类手中之前,跑得快不如跑得稳。