← 返回首页目录
# 前OpenAI与Anthropic研究员指控:两家公司正在“拿生命开玩笑”
**作者:吉祥法师**
## 一、核心概念提取
本文围绕人工智能安全领域的一起重大人事变动与公开指控展开,核心概念包括:
1. **AI预训练(Pré-treinamento)** :AI模型吸收海量信息的初始阶段,是模型能力形成的基础环节。
2. **超级智能(Superinteligência)** :指能够自我改进、超越人类智能水平的AI系统。
3. **递归自我完善(Autoaperfeiçoamento Recursivo)** :AI系统能够以极少的人类参与来设计和训练下一代AI,形成自我迭代的加速循环。
4. **AI安全承诺与撤回**:Anthropic曾在安全信中承诺,若无法控制风险则暂停模型开发,但于2026年2月撤回了该承诺。
5. **行业竞赛困境(Corrida Armamentista)** :企业明知风险却因竞争压力无法单方面停止,形成“囚徒困境”式的集体行动难题。
6. **政府监管缺位**:缺乏有效的政府干预与协调机制来为AI发展设置“刹车”。
## 二、逻辑结构梳理
文章的逻辑结构可清晰划分为以下几个层次:
**第一层:事件引入——核心人物的离职与指控**
文章以Jacob Coxon的离职事件为切入点,直接引出其对OpenAI和Anthropic的严厉指控。Coxon的背景交代(27岁英国人、三年预训练经验、先OpenAI后Anthropic)为指控提供了专业可信度背书。
**第二层:指控内容——AI灭绝风险的真实性**
Coxon在社交平台X上的发言构成文章的核心论点:AI从业者真诚地相信AI可能在本十年内导致人类灭绝,且这并非营销手段。Anthropic安全总监Evan Hubinger的公开回应——“我们确实相信AI可能杀死人类”——以及其个人评估的“十年内超过10%的风险概率”,为这一论点提供了来自行业内部的佐证。
**第三层:行业背景——竞赛逻辑与安全承诺的弱化**
文章进一步揭示了Anthropic的内部矛盾:一方面理解风险,另一方面因竞争压力而陷入“必须自己先做”的困境。2026年2月撤回安全承诺、7月千名员工联名呼吁政府建立刹车机制、OpenAI首席科学家的谨慎表态,构成了一系列论据链条。
**第四层:隐含结论——个体无力与系统性风险**
Coxon的离职本身构成一种无声的结论:在缺乏政府干预和协调减速的前提下,任何单一企业或个人都无法负责任地开发超越人类的AI。
## 三、主要论点与论据分析
### 论点一:AI企业正在“拿生命开玩笑”,缺乏负责任的行为
**论据:**
- Coxon直接引述:“没有一家公司以负责任的方式行事。它们正直奔向一种能够自我完善的超级智能,并拿我们的生命做赌注。”
- Anthropic安全总监Evan Hubinger公开认同Coxon的判断,并给出“十年内超过10%的灭绝风险”的个人评估。
- Anthropic于2026年2月从安全信中删除“若无法控制风险则暂停开发”的承诺。
### 论点二:AI从业者真诚相信AI可能导致人类灭绝
**论据:**
- Coxon强调“这不是营销手段”,意在驳斥外界将AI灭绝论视为炒作的观点。
- Hubinger以安全总监身份公开确认“我们确实相信AI可能杀死人类”。
- 行业领袖普遍认为业界正接近“递归自我完善”阶段。
### 论点三:行业陷入竞赛困境,单方面负责任不可行
**论据:**
- Coxon指出,Anthropic理解风险但“被困在抢先到达的竞赛中”,因为他们相信“没有其他人会负责任地行动,所以尽管有风险也必须自己来做”。
- 2026年7月底,包括Anthropic CEO Dario Amodei在内的千余名员工联名请求华盛顿建立刹车机制。
- OpenAI首席科学家Jakub Pachocki表态“当前时刻需要极度谨慎”和国际协调。
### 论点四:缺乏政府干预和协调减速,负责任开发不可能实现
**论据:**
- Coxon明确表示:“没有任何企业能在没有政府干预或协调减速的情况下,负责任地开发出超越人类的AI。”
- 千名员工联名呼吁政府建立刹车机制的行动本身,即是对政府干预必要性的集体背书。
## 四、去噪处理与内容扩充
本文原始素材来自巴西G1新闻网站,其中包含大量与主题无关的导航链接、广告、其他新闻推荐(如足球比赛、政治新闻、娱乐八卦等)。经去噪处理后,仅保留与AI安全、企业责任、行业监管相关的核心内容。
在此基础上,以下对文章内容进行深入解析与充分扩充:
### 4.1 Jacob Coxon其人及其离职的象征意义
Jacob Coxon,27岁英国籍研究员,在短短三年内先后任职于OpenAI和Anthropic——全球最具影响力的两家AI公司。他从事的“预训练”工作是AI模型能力形成的源头环节,这意味着他对模型能力的演进速度有着第一手的直观感受。他的离职并非普通的职业变动,而是一种带有公共指控性质的抗议行为。值得注意的是,他的职业路径本身具有象征意义:从OpenAI跳槽至Anthropic,本是因为认为后者“更为审慎”,然而在Anthropic工作不足一年后,他最终选择彻底离开整个行业。这条路径暗示了一个令人不安的结论:即便是在被认为更注重安全的公司,系统性的风险依然无法被有效控制。
### 4.2 超级智能与递归自我完善的技术含义
文章提及的“递归自我完善”是AI安全讨论中的关键概念。它指的是AI系统具备设计、训练下一代AI系统的能力,且所需人类参与极少。一旦进入这一阶段,AI能力的增长速度可能远超人类社会的监管和适应能力。行业领袖普遍认为业界正在接近这一阶段,这意味着我们可能正处于一个临界点:此后的发展速度将不再由人类决策主导。Coxon的警告因此不只是对当前状态的批评,更是对即将到来的失控风险的紧急示警。
### 4.3 Anthropic安全承诺撤回的深层意涵
Anthropic于2026年2月从安全信中撤回“若无法控制风险则暂停开发”的承诺,这一行为具有多重含义。首先,它标志着企业自愿性安全约束的脆弱性——在商业竞争和资本压力面前,道德承诺可以被轻易修改。其次,Anthropic当时正准备上市,这一时间节点与承诺撤回之间的关联耐人寻味。再者,这一撤回与Coxon的离职几乎同时发生,两者共同构成了一幅图景:即便是行业内最注重安全的公司,也在竞争压力下逐步放弃自我约束。
### 4.4 “竞赛困境”的博弈论本质
Coxon描述的Anthropic心态——“他们相信没有其他人会负责任地行动,所以尽管有风险也必须自己来做”——是典型的“囚徒困境”式博弈。在缺乏强制性外部监管的情况下,任何单方面的减速都意味着将竞争优势拱手让给对手。这种结构性困境解释了为何千名员工需要联名请求政府介入:个体的道德选择无法解决系统性的集体行动问题。只有政府层面的协调机制——如国际条约、强制性安全标准、开发许可制度等——才能将各企业从这一困境中解放出来。
### 4.5 从“营销论”到“真实信仰”的认知转变
外界长期存在一种观点,认为AI公司的灭绝警告是一种营销策略,旨在吸引监管关注或塑造品牌形象。Coxon明确驳斥了这一解读:“这不是营销手段。”Hubinger以安全总监的身份公开确认“我们确实相信AI可能杀死人类”,并以个人名义给出“超过10%”的风险概率,这进一步强化了“真实信仰”而非“营销话术”的判断。当行业内部人士以个人信誉和职业声誉为代价做出此类表态时,外界有理由给予严肃对待。
### 4.6 政府监管的必要性与紧迫性
文章结尾处提及的三项事实——Anthropic撤回安全承诺、千名员工联名呼吁刹车机制、OpenAI首席科学家强调“极度谨慎”与国际协调——共同指向一个结论:行业自律已经不足以应对AI安全挑战。Coxon的立场明确而激进:没有政府干预或协调减速,负责任的AI开发不可能实现。这一立场将AI安全问题的解决路径从企业伦理层面提升到了公共政策层面。
## 五、结语
Jacob Coxon的离职与公开指控,是AI安全领域一个具有标志性意义的事件。它不仅揭示了两家领先AI公司内部的安全文化现状,更暴露了整个行业在商业竞争与人类安全之间的深层张力。当行业内部人士——包括安全总监级别的高管——公开确认AI灭绝风险的真实性并以个人名义给出风险概率时,这一问题已不再属于科幻范畴,而是迫在眉睫的公共政策议题。缺乏政府干预与协调减速机制,任何单一企业的负责任行为都将在竞争压力下难以为继。Coxon的离职或许只是个人选择,但它所揭示的系统性困境,值得整个社会严肃面对。