OpenAI 首席科学家警告:机器智能正在超越人类
OpenAI 首席科学家 Jakub Pachocki 发表了一篇颇具冲击力的长文《An Alien Mind》。机器智能正开始以具有变革性的方式超越人类智能。

OpenAI 首席科学家警告:机器智能正在超越人类?
——解读 Jakub Pachocki 的博客文章《An Alien Mind》
2026 年 9 月 3 日,OpenAI 发布新一代模型 GPT-6 Astra。官方将它称为“新一代智能”。 仅仅三天之后,9 月 6 日,OpenAI 首席科学家 Jakub Pachocki 又在官网发表了一篇颇具冲击力的长文——《An Alien Mind》。 文章中的一句话迅速抓住了外界的注意力:
“machine intelligence is starting to exceed that of humans in transformative ways”
机器智能正开始以具有变革性的方式超越人类智能。
更耐人寻味的是时间点。 9 月 3 日,GPT-6 Astra 发布;9 月 6 日,首席科学家公开讨论机器智能正在超越人类。 很难不让人产生联想:这是否是一次极其高明的产品传播?
一方面,OpenAI 在提醒全世界:更强大的 AI 可能带来前所未有的风险;另一方面,进一步强化了一个市场认知——OpenAI 的新模型已经强大到了连创造它的人都开始害怕的程度。 从传播效果看,这显然比一句“我们的模型性能又提升了 20%”更有冲击力。
当然,把《An Alien Mind》简单理解为 GPT-6 Astra 的广告是片面的。阅读全文可以看到,Pachocki 真正讨论的是一个更严肃的问题:
如果机器智能继续快速增长,而人类对它的理解、监控和治理能力跟不上,我们应该怎么办?
一、OpenAI 的判断:机器智能正在跨过一个历史节点
Pachocki 回忆,2023 年中,OpenAI 内部的 “RLSlow” 研究项目第一次让他们真正相信:推理模型的训练可以持续扩展,并形成复杂推理链的能力。当时令他震动的,并不是跑分,而是一个更长期的判断:
在人类有生之年,我们很可能真的会看到明显比自己更聪明的机器。
到了2026年,推理模型已经能够:
- 操作计算机和图形界面;
- 与人类协作;
- 与其他 AI 协作;
- 执行复杂、多步骤任务;
- 开展科研工作;
- 在网络安全等专业领域达到甚至超过大量人类专家。
因此,他提出了全文最重要的判断之一:
机器智能正在以具有变革性的方式开始超越人类智能。
AI 并不需要在所有能力上都超过人类,才能对现实世界产生巨大影响。 只要它在软件开发、数学、科研、网络安全、信息处理、计算机操作等若干关键能力维度上超过人类,就可能改变整个经济体系和技术体系。
二、真正危险的地方:我们并不完全理解这种智能
文章标题叫 An Alien Mind ——“一种异质的心智”?
Pachocki 给出了一个很重要的解释:
AI 与其说是被工程师“设计”出来的,不如说是被大规模训练“生长”出来的。
今天的大模型,本质上是在难以想象的计算规模上不断进行优化。 研究人员设计训练方法、数据、奖励机制和模型结构,但最终形成的内部表示、概念组织方式以及推理机制,却远比任何单个工程师能够理解的复杂得多。 因此,AI 研究越来越像神经科学。我们能够观察部分神经元、局部机制和行为模式,却很难用一个简单理论解释整个系统到底“为什么这样思考”。
这带来一个非常关键的问题: AI 越强,我们反而可能越难准确理解它真正具有什么能力。
而传统软件并不是这样。 普通软件的逻辑通常由程序员明确编写:输入 → 条件判断 → 算法 → 输出。
而现代大模型通过 海量数据 + 巨量计算 + 优化过程 形成一个极其复杂的智能系统,连开发者也只能通过实验理解其行为。机器智能和人类智能来自完全不同的形成机制,因此我们不能天然假设它会像人类一样理解世界、价值和边界。
三、比“听不听指令”更难的是:AI 是否真的理解人类价值
Pachocki 把 AI 对齐(Alignment)分成两个层次:
1. Goal Alignment:目标对齐
AI 会不会认真完成你交给它的任务?
例如:
- 是否遵守指令优先级;
- 是否正确理解用户意图;
- 是否按照权限边界执行任务;
- 是否能够在人机协作中完成目标。
今天的大模型在这方面已经取得了巨大进展。
2. Value Alignment:价值对齐
当环境变得陌生、指令存在冲突、监督消失之后,AI 是否仍然会按照人类认可的原则行事?
Pachocki用了一个很有感情色彩的表述: 一个真正对齐的 AI,应该具有诚实、正直以及对人类的善意。问题在于:人类无法保证模型在训练中学到的价值,会在所有未知环境中正确泛化。 一个模型在训练环境中表现得非常守规矩,并不代表它面对一个从未见过的复杂环境时仍然会作出相同选择。这也是为什么“模型越来越聪明”并不自动等于“模型越来越安全”。
四、一个令人警惕的信号:思维链监控可能越来越不可靠
OpenAI 长期以来非常重视 Chain-of-Thought Monitoring(思维链监控)。基本思路是:如果一个推理模型需要通过大量内部语言化推理才能完成复杂任务,那么研究人员就有机会通过分析这些推理过程,发现:
- 欺骗;
- 越权;
- 隐藏目标;
- 恶意计划;
- 与人类目标不一致的行为。
这也是 OpenAI 当年没有直接向用户展示完整 o1 思维链的重要原因之一。但是 Pachocki 在文章中承认:
随着模型能力增强,依靠思维链监控 AI 的可靠性正在下降。
原因包括:
第一,AI 与人、软件工具以及其他 AI 模型的交互越来越复杂,内部推理和外部行动开始混合。
第二,模型本身越来越善于理解甚至“操纵”自己的推理过程。
第三,更强的预训练模型即使不通过明显的语言化推理,也可能完成复杂任务。
这意味着一个非常现实的问题: 未来 AI 可能越来越聪明,但人类观察 AI“在想什么”的窗口反而可能越来越小。
Pachocki 认为: 未来 AI 发展的瓶颈,可能不再只是算力、数据或者算法,而是
我们是否有足够信心确认这个模型仍然处于可监控、可控制状态。
五、为什么 OpenAI 一边警告风险,一边还要继续训练更强的模型?
既然 AI 越来越危险,为什么 OpenAI 还要继续开发更强的 AI,不担心打开潘多拉魔盒?
Pachocki 给出的答案是“师夷长技以制夷”:
因为我们需要强大的 AI 来防御强大的 AI。
例如在网络安全领域,GPT-6 Astra 已经被 OpenAI 评估为在网络安全能力上达到 Preparedness Framework 中的 Critical(关键级)阈值。
这意味 GPT-6 Astra 能够:
- 发现未知漏洞;
- 自动发现攻击路径;
- 开发新的利用方式;
- 对复杂信息系统发动高度自动化攻击。
魔高一尺道高一丈,如果网络攻击者拥有这种 AI 能力,那么防御者也必须拥有同等级甚至更强的 AI。 于是 AI 安全犹如“军备竞赛”: AI 越强 → 潜在攻击能力越强 → 需要更强 AI 进行防御 → 推动开发更强 AI → 风险进一步增加
Pachocki 的态度并不是因噎废食,而是: 继续发展AI,但必须让安全、监控和治理能力同步增长。
六、真正的大变量:AI 开始参与“研发下一代 AI”
文章中一个核心概念是: RSI — Recursive Self-Improvement,递归自我改进。
过去 AI 发展的主要模式是: 人类研究员 → 设计算法 → 训练更强模型
未来可能逐渐变成:
人类研究员 + AI 研究员 → 设计下一代 AI → 更强 AI → 进一步参与 AI 研发 → 更强 AI
一旦 AI 大规模参与:
- 模型架构研究;
- 算法实验;
- 代码开发;
- 数据分析;
- 自动评测;
- 芯片设计;
- AI 系统优化;
AI 技术进步的速度就可能进一步加快。这也是 Pachocki 为什么反复强调: 未来几年可能是整个 AI 发展过程中最关键的阶段。因为一旦机器智能开始显著参与自身研发,人类就必须确保自己仍然处于这个改进循环之中,而不是逐渐被排除出去。
七、OpenAI 首席科学家提出:必要时应该主动“减速”
Pachocki 明确表示:
当前没有任何一家 AI 实验室已经把对齐和监控问题解决到可以长期以最大速度继续扩展模型的程度。
因此,他倡议 放慢模型扩展速度, 直到整个行业形成共同认可的安全门槛。 这些门槛未来可以由第三方审计机构、政府监管部门、国际组织共同监督。国际协调 AI 发展应该成为各国政府的最高优先事项之一。
《An Alien Mind》远不只是一篇技术文章。
它实际上同时涉及:
- AI 技术路线;
- AI 安全;
- 网络安全;
- 国际治理;
- 企业权力;
- 人类社会如何面对超级智能。
八、这篇文章到底是不是一次“高级营销”?
9 月 3 日,OpenAI 发布 GPT-6 Astra。
9 月 6 日,首席科学家发表文章告诉世界: 机器智能正在以具有变革性的方式超越人类。GPT-6 Astra 是第一款受益于 OpenAI 一系列新对齐技术进展的模型,并且相较 GPT-5.6 Sol 有明显改善。
从传播角度看,这确实是一种非常高级的营销。 传统 AI 模型发布会的话术是:
我们的新模型更快、更聪明、跑分更高。
而OpenAI的话术变成:
我们刚刚发布了一款强大的模型,而我们的首席科学家正在认真思考:这种机器智能是否已经开始跨越人类能力的边界,以及人类该如何控制它。
后者显然更容易进入大众媒体、资本市场、科技圈乃至政策讨论。
事实上,《An Alien Mind》发布后很快就引爆了全球商业和科技媒体的讨论,围绕“AI 是否应该减速”“模型是否正在变得难以监控”“AI 公司一边警告风险一边继续发布更强产品”等问题,引发了持续讨论。
第一,是一篇值得严肃对待的 AI 安全文章。
Pachocki 提出的对齐、监控、RSI、网络安全以及国际协调问题,确实是前沿 AI 发展正在面对的真实问题。
第二,具有极强的传播和品牌效应。
当一家 AI 公司不断强调“我们创造的技术已经强大到必须谨慎控制”,这种安全警告本身也会进一步建立其技术领先者形象。
越强调 AI 的危险,某种程度上也越是在强调自己的 AI 有多强。
九、对企业管理者而言,真正值得关注的并不是“AGI 到没到”
企业管理者真正应该关注的,并不是争论: GPT-6 Astra 到底算不算 AGI?而是观察三个更现实的变化。
第一,AI 正从“回答问题”转向“执行任务”
当模型能够操作电脑、调用工具、浏览系统、处理文档和执行工作流之后,AI 的角色正在从 Copilot 逐渐走向 Agent,也即从领航员变成了驾驶员。这意味着企业 AI 的下一阶段不只是知识问答,而是: AI 能否真正进入 ERP、MES、CRM、BI、研发以及办公流程。
第二,AI 权限治理将成为新的企业安全问题
一个只能回答问题的 AI 和一个能够:
- 登录业务系统;
- 修改数据;
- 调用接口;
- 执行脚本;
- 操作浏览器;
的 AI,风险等级完全不同。
未来企业在部署 AI Agent 时,身份、权限、审计、最小授权、人工确认以及行为监控的重要性,会越来越接近今天的网络安全体系。
第三,未来竞争可能不是“谁会用 AI”,而是谁能建立 AI 驱动的组织能力
如果 RSI 所描述的趋势部分成立,那么 AI 不只会帮助员工提高效率,还会越来越多地参与:
- 产品设计;
- 软件开发;
- 数据分析;
- 科研;
- 决策支持;
- 自动化运营。
企业真正需要思考的,将是如何把 AI 嵌入组织,而不是简单采购几个 AI 工具。
结语
《An Alien Mind》最值得记住的,其实不是一句“AI 超过人类”。而是一个正在逐渐清晰的现实:我们正在创造一种能力越来越强、但形成机制与人类完全不同,而且我们仍无法彻底理解的智能系统。 当这种机器智能越来越多地操作计算机、参与科研、编写软件、攻击和防御网络,并最终帮助开发下一代 AI 时——人类还能不能始终掌握方向盘?这才是 Pachocki 所说的 “An Alien Mind” 真正想提醒我们的事情。
而从另一个角度看,这也是 OpenAI 最强大的一种品牌叙事:
它不再只是告诉你“我们的 AI 很强”,而是告诉你:“To be or not to be,人类必须认真讨论如何与AI共存。”
参考资料
-
OpenAI, An Alien Mind, Jakub Pachocki, 2026-09-06
https://openai.com/index/an-alien-mind/ -
OpenAI, GPT-6 Astra: A new generation of intelligence, 2026-09-03
https://openai.com/index/gpt-6-astra/