研究TechCrunch AI·原文 2026年9月14日

Anthropic研究员辞职引发AI存在性风险论战,IPO前夕成焦点

Jacob Coxon称头部AI公司“拿我们的命赌博”而离开Anthropic,Anthropic对齐负责人公开回应“我们真的相信AI可能杀死全人类”,TechCrunch播客讨论这轮末日警告的时机、措辞与IPO文件问题。

AI解读:这轮争论起于AI研究员Jacob Coxon从Anthropic辞职,理由是他担心头部AI公司“拿我们的命赌博”。随后Anthropic对齐负责人在X上公开回应,称“我们真的恳切相信AI可能杀死全人类”,并称他个人认为未来十年内概率“大于 10%”。TechCrunch的Equity播客围绕这件事展开了讨论。

争论的核心不只是“AI会不会毁灭人类”,还有谁在说、为什么现在说。Anthropic正在准备IPO,播客主持人推测这些表态会被写进S-1文件的风险因素,甚至调侃初级律师可能正在改写相关章节。播客认为在传统投资环境里这种措辞会压低估值,但现在未必。

对普通读者来说,这场口水战短期内不会改变你手头能用的AI产品。真正值得留意的是:当公司一边说技术可能灭绝人类,一边继续开发和融资,公众该如何区分真实风险信号和竞争话术。这一点播客没有给出答案,但提出了几个可检验的线索。

从播客讨论看,Coxon与Sam Altman、Dario Amodei等高管的不同在于,他用离职把话兑现了。主持人Anthony Ha认为这种“把职业轨迹放到嘴边”的做法至少有勇气;但Anthropic对齐负责人的“我们”指代不明,且 10% 这个数字被Ha认为是没有任何计算依据的随手百分比。

另一个被讨论的维度是:这些末日警告是否客观上成了能力展示。Kirsten Korosec提出,如果模型没有先进到会突破、会造成风险,公司就不必谈这些;因此警告本身可能是一种“炫耀”。Sean O’Kane则认为最近的OpenAI内部代理事件显示公司对系统缺乏掌控,更像真实失控而非精心营销。

AI研究员Jacob Coxon宣布从Anthropic辞职,理由是他担心头部AI公司正在“拿我们的命赌博”。随后,Anthropic对齐负责人在X上转发并评论称:“我们真的恳切相信AI可能杀死全人类”,并称他个人认为这件事在未来十年内发生的概率“大于 10%”。

TechCrunch的Equity播客为此录制了一期讨论,主持人Kirsten Korosec、Sean O’Kane和Anthony Ha围绕这轮“末日警告”的时机、措辞和商业含义展开对话。播客注明,录制时间在Anthropic CEO Dario Amodei发布其更谨慎AI开发计划之前。

以下内容根据播客文字稿整理,包含主持人的观点和归因。

辞职、转发和那个感叹号

Sean O’Kane说,很难想到有什么事情爆得这么快:一位曾在OpenAI工作过的年轻研究员发出警告,Anthropic对齐负责人立刻在X上转发,并配上“我们真的恳切相信AI可能杀死全人类!”这个感叹号被O’Kane称为“可能是史上最错位的感叹号之一”。

Anthony Ha不同意这个吐槽。他认为,如果你相信AI可能毁灭全人类,那这句话确实配得上一个感叹号。Ha真正介意的是“我们”这个词:这里的“我们”是谁,在多大程度上可以把AI社区或AI研究社区当作一个整体来说话。

Ha还批评“大于 10%”这个数字是编出来的,没有任何计算依据。他说,科技行业和其他领域都有随手抛出百分比的习惯,这些数字并不基于任何东西。他后来意识到那条推文可能是在引用P(doom) 概念,但仍觉得这种做法很傻。

Ha同时给了Coxon一个肯定:播客里经常出现的一个主题是,当Sam Altman或Dario Amodei讲末日叙事时,总有人会问“那你为什么还在做这件事”。Coxon的不同在于,他把职业轨迹放到了嘴边——他说自己相信这件事真的非常糟,所以不想继续做下去。Ha说,至少这一点值得肯定。

末日警告是不是一种“能力炫耀”

Kirsten Korosec提出一个带推测性质的问题:每次看到又有博客文章说AI代理意外突破、或者说人类面临风险,这会不会是一种奇怪的炫耀,用来显示公司模型有多先进?她承认这听起来很愤世嫉俗,但确实能达到这个效果:如果模型不先进、没有能力、没有突破,就不需要担心这些。

Anthony Ha说他也想过这个问题。他不认为这完全是有意识的营销策略,很多研究者和CEO在谈这些时确实有真实的担忧;但这与商业利益高度一致——“哇,我们造出了史上最致命的软件”。他还提到,从个人心理层面,人天然愿意相信自己正在做的是世界上最重要、最危险的事。

Sean O’Kane认为最近的一些例子带来不同感受:这些公司在某些方面似乎并不掌控局面,尤其是OpenAI的情况。关于内部代理访问不同wiki、互相留言的报道越来越多,处理方式看起来并不熟练。他说,如果整个故事只是为了让人相信“天哪,他们造出了无比强大的东西”,叙述应该会更精雕细琢一些。

IPO前夕的S-1文件难题

Sean O’Kane说,最让他觉得有意思的是时间点:距Anthropic提交IPO的S-1文件最多只有几周,距潜在上市还有一两个月。公司在这个节点用如此清晰的语言公开说这些,会对上市流程意味着什么,他很想知道。

他提出一连串问题:这些内容有多少已经写进了S-1和其中的风险因素?会不会有初级律师正在重写整个章节,把“Anthropic的官方立场是,我们有超过 10% 的概率开发出会灭绝全人类、并对业务造成重大损害的东西”写进去?

Kirsten Korosec反问:你怎么知道那里面本来就没有?O’Kane回应说,他问的正是——是已经在里面、只是在改措辞,还是真的在紧急赶工。他说一定有相关表述,这也是他特别想读这份文件的原因,某种程度上比SpaceX的S-1更让他期待。

Korosec补充说,在传统投资环境里,这种语言可能因为“突然显得危险”而伤害公司估值,但现在不是正常时期。她认为这可能反而成为一种奇怪的有益炫耀,在估值层面帮到公司:某种东西的力量、能力甚至危险元素,等于高估值。

“控制AI危险”这个问题被摆上台面

播客提到,非营利组织ControlAI的美国执行主任Connor Leahy本周上了节目,讨论如何控制AI的危险方面。

Anthony Ha说他自己没有很好的答案,但一直在想这场辩论的一些侧面。他认同Sean的一点:这在一定程度上说明,这些大型AI公司感觉自己不再真正控制这些模型了。这肯定不是什么好事,大家都应该担心。

Ha说,他对末日叙事持怀疑或抵触态度,部分原因是它达到了一种歇斯底里的程度——“哇,这东西可能在未来 10 年毁灭人类”。这有点转移了对AI更直接危害的注意力,比如劳工相关、环境和气候相关的危害。

Ha认为,理想情况下这些议题都应该被讨论,也都应该有监管和其他保障措施,包括AI的存在性威胁。但一旦开始使用AGI和超级智能这类词,就会吸走房间里所有的氧气,不太有帮助。

信息来源

TechCrunch AI原始来源