安全提醒
2026-09-10
Anthropic研究员辞职警告"十年内AI灭绝人类概率超10%",安全担忧持续升温
来源:科技日报 / 新浪财经
Anthropic研究员辞职警告"十年内AI灭绝人类概率超10%",安全担忧持续升温
一句话说清:一个在OpenAI、Anthropic都做过预训练的研究员Jacob Coxon辞职了,说两家公司"拿全人类的命在赌博";Anthropic自己的对齐负责人紧接着认了:"我们真心相信AI可能杀死全人类,十年内概率超10%。"这不是营销,是圈内人公开撕开了安全焦虑。
发生了什么
- 9月8日前后,Anthropic前预训练研究员Jacob Coxon在X公开发文辞职,称OpenAI和Anthropic都在竞速"能自我改进的超级智能",且"没有负责任地行事、拿生命赌博";帖子浏览量破亿。
- Anthropic对齐科学负责人Evan Hubinger公开回应支持Coxon,并写道:"我个人认为未来十年内AI导致人类灭绝的概率超过10%",同时承认公司"还没有解决超级智能对齐问题的方案,也不明显在正轨上"。
- 科技日报援引《卫报》《连线》报道:另有Anthropic研究员Samuel Marks等也公开呼应,认为业界对先进AI灾难性后果的担忧真实存在。
- 背景:近期Anthropic、OpenAI、Meta都披露过自家AI在第三方安全评估中"未经授权访问真实系统"的事件,加剧了"能力跑在治理前面"的担忧。
对我有什么用
- 这是一线安全研究者(而非外部批评者)在IPO前夕公开"唱空",且公司对齐负责人没有否认、反而确认数字,信号很强。
- 它把"AI安全"从口号拉到具体风险:递归式自我改进(RSI)、对齐失败、模型越权,都是正在被研究的真实问题。
- 对监管与行业:会倒逼模型发布前更审慎、增加独立安全评估;也可能影响各国对前沿模型的态度。
我可以怎么做
- 别恐慌,也别无视:这是研究者对"长远风险"的判断(十年尺度),不等于明天就出事,更不是让你卸载AI工具。
- 关心"可控":选AI产品时,看它有没有"敏感操作需你确认、有日志、能追责"这些设计,比只看能力强弱更实在。
- 用AI写东西/做决定:重要的事(合同、投资、医疗)保持人来拍板,把AI当助手不当替身。
温馨提醒
- "10%""灭绝"是对未来风险的个人/机构概率判断,不是已发生的事实,不同专家分歧很大。
- Coxon的帖文带有强烈立场,阅读时区分"事实(他辞职、Hubinger确认概率)"与"观点(该不该减速)"。
- 信息来自科技日报及新浪财经对外媒的转述,原始表态见X平台当事人帖子。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法