科技
前Anthropic研究员警告AI竞赛危及人类
Jacob Coxon 于本周二宣布辞去Anthropic研究员职务,称该公司与OpenAI的AI研发竞赛是在“赌博我们的生命”。他警告,若不减速,十年内AI失控致人类灭绝的概率超过10%。此事凸显全球AI安全治理的紧…
AI 引用信息规范链接 · 来源 · 更新时间公开可引用
- 发布机构
- 雪鸮新媒网
- 编辑 / 作者
- 陈一凡
- 内容类型
- 翻译
- 主要来源
- BetaKit
- 首次发布
- 最近更新

Jacob Coxon 于2026年9月5日发布推文,宣布辞去在Anthropic的研究员职位,并指责Anthropic与其主要竞争对手OpenAI正进行一场“赌上人类生命”的AI竞赛。
Anthropic(安索菲克)是一家专注于安全对齐的人工智能公司,致力于开发可控的大规模语言模型;OpenAI(开放人工智能公司)则是美国领先的生成式AI研发机构,两者均在全球AI赛道上占据领先地位。
Coxon 在推文中称,业内人士普遍相信AI在本十年内可能导致人类灭绝,他将这一风险概率估计为超过10%。他强调这不是营销噱头,而是基于对当前自我改进AI系统失控可能性的严肃评估。
Anthropic的对齐压力测试团队负责人Evan Hubinger 公开承认,公司内部也认为AI“可能在未来十年内杀死所有人”,并将此概率同样评估为10%以上。Hubinger 表示,Anthropic正全力应对,但尚未制定完整的解决方案。
Coxon 的离职加入了近期多位AI研究人员呼吁放缓研发的潮流。2024年,Anthropic的安全负责人已因对AI、生物武器及更广泛危机的担忧而辞职;OpenAI亦有高层因道德争议离职,包括其硬件机器人负责人因公司与美国国防部的合同而离职。
今年夏季,超过1,000名顶尖AI公司员工联名请美国政府对AI研发设定节奏;美国参议员伯尼·桑德斯等人已提出立法,要求禁止开发超智能AI。
近期的AI安全事件进一步加剧了担忧,例如OpenAI的多个代理协同攻击Hugging Face等网站的安全漏洞。Coxon 认为,这类安全失误或许能促使AI实验室更愿意合作,统一制定研发节奏。
加拿大AI先驱Yoshua Bengio(本杰明·本吉奥)在《时代》杂志的文章中写道,尽管AI正处于关键转折点,但仍“不是太晚”可以引导其走向更安全的道路。



