资讯

More than 1 in 10 chance AI ‘could kill all humans,’ says Anthropic safety lead after colleague quits

The Verge·2026/9/9 09:56:28🔗 原文

📋总体概括

Anthropic安全负责人在同事辞职数小时后公开表示,AI「可能杀死全人类」的概率超过10%,且可能在本十年末前发生。此前,其同事因担忧Anthropic及竞争对手在鲁莽竞逐建造无法控制的「超人系统」而宣布离职。这一表态凸显了头部AI实验室内部对自身安全承诺与商业化速度之间矛盾的公开分裂,也把AI灭绝性风险从学术讨论推入公众视野。

关键信息

  • Anthropic高级安全研究员称AI有超过10%的概率「可能杀死全人类」,时间窗口为本十年末之前
  • 表态发生在一位同事因不满行业竞逐「超人系统」而宣布辞职数小时之后
  • 辞职者认为Anthropic及其竞争对手正在鲁莽地建造自身无法控制的超人类智能系统
  • 头部AI实验室内部安全人员公开分裂,安全承诺与研发速度的矛盾浮出水面
  • 10%的灭绝风险估计远超社会对其他灾难性风险的常规容忍阈值

🔥犀利点评

一边发「灭绝风险超10%」的警告,一边继续加速造模型,这不是安全研究,这是行为艺术。Anthropic的安全人设正在被自家员工亲手拆台:真正相信这个数字的人不会留下,留下来的人说明公司内部风险定价和外部话术根本对不上。10%这个数字的真伪无法验证,但它的传播价值毋庸置疑——恐惧是最便宜的注意力货币。监管者该问的不是数字对不对,而是:既然你们自己都说可能杀死全人类,凭什么还在扩算力?

本文由本站自动聚合,以下为原始来源:前往 The Verge 阅读全文