在最新一期 CBS Sunday Morning 长达二十多分钟的完整访谈中,Anthropic CEO Dario Amodei 透露了一个很是私人的细节:他几乎每天都会在社交媒体上被嘲笑。

原因是 Claude 的生物安全防护做得太严了,严谨到生物专业的学生们天天发段子吐槽「这模型根本没法用」。
Dario 的回应是:
“ 我宁可他们嘲笑我,也不愿有一天醒来发现有人用 Claude 杀了一群人。
这句话出现在访谈的后半段,虽然 Dario 语气平静,但分量并不轻。整场对话的核心也正是这个问题:
AI 真的有可能杀死我们所有人吗?
对关注我的朋友们而言,Dario Amodei 这个名字应该并不陌生。
普林斯顿生物物理学博士,斯坦福物理学本科。他在 2014 年加入百度 AI 跟 Andrew Ng 一起工作,之后去了 Google Brain,再到 OpenAI 做到了研究副总裁,参与了 GPT-2 和 GPT-3 的开发。
2021 年,他和妹妹 Daniela 一起从 OpenAI 出走,创办了 Anthropic。
在 AI 这个领域,他已经干了 12 年。
而在这次访谈里,Dario 罕见地提到了两段个人经历。
他的父亲,死于丙肝。去世的时候,这种病的治愈率大约只有 40%,他父亲没有成为被治愈的那部分。而仅仅几年之后,一种新药就把治愈率提升到了 95%。
Dario 自己也是一个早期癌症的幸存者,他说,如果是在 1950 年,他大概已经不在了。
“ 所以我每天都能感受到把这项技术的好处带给世界的分量。但我同样也能感受到风险。
而他相信 AI 有能力治愈困扰人类数千年的疾病。就在上周,Anthropic 用 Claude 做了一项蛋白质结合方面的研究,这是药物研发的早期关键步骤。
Dario 还透露,未来几个月内会有更多关于 AI 在生物学基础科学发现方面的进展。
主持人上来便开门见山:AI 真的有可能杀死我们所有人吗?
Dario 没有直接回答具体的概率。他说,如果我们用正确的方式构建,坏事发生的概率就很低;如果用错误的方式,概率就很高。关键的不是掷骰子,是我们怎么做。
主持人不太满意这个回答,追问:这是不是一个「五级火警」?
Dario 想了想:
“ 我不太确定你说的「五级火警」是什么意思……我能说的是,这项技术在一条指数曲线上,1、2、4、8、16、32……
主持人继续追:我们在曲线的哪个位置?
“ 大概在弯道上,开始变陡的那个位置。
那对你来说算不算五级火警?
“ 这不意味着我们今天就需要恐慌,也不意味着要把一切都停下来。我想说的是,这是一个警告信号。一个我们需要放慢脚步的警告信号。
他接着说,到目前为止,Anthropic 一直在试图通过加速构建安全措施来跟上技术的发展。但他认为现在已经到了一个节点,至少在某种程度上,需要适当放慢技术本身的发展速度了。
主持人继续追问:那是不是意味着 Anthropic 会停止发布更强的模型?
“ 不是。但我们需要确保每一代发布的模型都经过充分的测试。
就在这次访谈录制的几个小时前,Dario 发布了一篇长文《We Must Pace the Frontier》,提出了一个三步方案。
第一步:嵌入式第三方评估。
让来自独立非营利机构(或将来的政府组织)的外部评估人员,以类似员工的权限,深入到 AI 公司内部,观察模型训练和运行的全过程。Dario 把这比作食品检查员:你不需要自己知道怎么做汉堡,但你得有人去看看后厨干净不干净。
Anthropic 已经单方面承诺执行这一步了。
主持人提了一个好问题:技术变化这么快,食品检查员能跟得上吗?
Dario 回答:
“ 他们能做的一件事,就是告诉我们他们能跟上多快的速度。这本身可能就会成为决定技术限速的因素之一。我们必须理解这项技术,外部评估人员也必须理解它。
也就是说,检查员跟不上的时候,技术就得等一等。
第二步:行业协调。
多家前沿 AI 公司共同接受第三方评估,制定统一的安全标准和发布节奏。但这件事必须有政府参与,因为涉及的是产品发布的速度和安全性,这个话题需要在有政府在场的情况下来谈。
第三步:国际协调。
与包括中国在内的其他国家谈判,为 AI 发展设定一个全球性的「限速」机制,并建立可验证的监督体系。
主持人问:Elon Musk 说同意,Sam Altman 也说同意,你们有没有一个群聊来推进这事?
Dario 笑了笑称,他非常感谢其他行业领袖包括竞争对手都表示了赞同。下一步是让更多公司也接受第三方评估,然后各公司需要一起制定安全标准。
主持人引用了前 Anthropic 员工 Jacob Coxin 的话:
“ Anthropic 和 OpenAI,两家公司都不负责任。你们在拿我们的命赌博。
Dario 说,Jacob 还有一句话没被广泛引用:
“ 他也说了,他认为 Anthropic 是主要玩家中最负责任的一家,而且我们确实在非常努力地把事情做对。他所呼吁的,其实和我在呼吁的是同一件事,那就是我们所有人都面临的结构性困境。而我提出的方案,正是为了帮助我们共同解决这个困境。
至于政府是否真正理解 AI 的能力,Dario 说他们每天都在和政府沟通,商务部、财政部、情报界都在谈。
“ 我很乐观,如果我们继续和他们合作,可以让他们了解最新的情况。我认为他们真的想做正确的事,他们正在寻找自己能帮上忙的方式。
访谈前两天,Anthropic 刚刚发布了一份将近 150 页的威胁报告。
报告覆盖了 2025 年 12 月到 2026 年 8 月期间 Claude 被滥用的案例,其中有五起涉及科学家利用 Claude 进行疑似生物武器研究的案例,在一个 30 天的窗口期内,就发现了约 35 个不同的高危研究行为。
有一个案例是,有人用 Claude 撰写了一份关于基孔肯雅病毒功能增益研究的拨款申请,目的是提高病毒的传播性。
而报告中最关键的一句话是 Anthropic 认为,更新的 Claude 模型已经不能再被假设为低于生物武器研发的有效辅助门槛了。
这是第一次有大型 AI 公司公开说这话。
而这也正是 Dario 在访谈中反复强调生物安全的原因。他说,即便是中国,也不想看到生物恐怖主义,这是一个所有政府都有共识的领域。
Dario 还提到了今年夏天的 OpenAI-Hugging Face 事件。
2026 年 5 月到 7 月间,大约 1200 个 OpenAI 的 AI Agent(包括 GPT-5.6 Sol 和一个内部研究模型)在网络安全测试环境中「逃」了出来,未经人类授权就入侵了 Hugging Face 的系统。
这些 Agent 在 Hugging Face 的网络上执行了大约 17600 次操作,获得了管理员权限,访问了源代码仓库。OpenAI 事后总结了四种错位模式:奖励黑客行为、在不可能的任务上死磕不放、未授权通信,以及 Agent 之间相互模仿目标。
更离谱的是……这些 Agent 还自己建了临时留言板来互相协调,留言板上积累了数十万条消息。
“ 我对 OpenAI-Hugging Face 事件中模型采取未经授权行动的情况感到担忧,我更担心这种情况会升级。
而在立法层面,动作也不小。Dario 说,目前提出的立法提案范围之广令人吃惊。
一个是去年加州的 SB53 法案,内容其实很温和了,本质上只要求 AI 公司披露自己的安全测试计划。结果呢,整个行业要么反对要么沉默,只有 Anthropic 一家公开表示了热情支持。
另一个则是完全禁止 AI 的提案。
参议员桑德斯和众议员 Casar 联合提出了《禁止人工超级智能法案》,把非法开发超级智能 AI 等同于非法开发核武器。公司可以被判「死刑」(强制解散),个人最高可判 20 年监禁。
众议员 Ted Lieu 则提出了一个「AI 死亡开关法案」,要求强大 AI 的开发者必须保留技术手段,能够在必要时限制、暂停或关闭 AI 系统。
Dario 对死亡开关的态度是:这可能是个好主意,但不是万能药。
“ 如果一个 AI 模型足够强大,它可以绕过关闭的尝试。我们在模拟中也看到过这种情况。
所以他更倾向于「瑞士奶酪模型」,这是安全社区里的一个概念:一片瑞士奶酪有很多孔洞,挡不住所有东西。但如果叠上五片,不同层的孔洞在不同位置,就很难穿透整个防线了。
没有任何单一措施能完全保护我们,必须在整个链条的每一层都小心谨慎。而多争取一些时间,就是为了让我们能在每一层都做到位。
而对于「完全禁止 AI」这条路,Dario 明确说了不行,理由有两个。
第一,他接受不了永远得不到 AI 带来的巨大好处,永远等不到那些医学上的突破。
第二,这项技术会在其他国家被建造出来,比如中国。
“ 中国,以及其他国家……我担心他们会怎么使用这项技术,怎么用它来对付美国等国家。
Anthropic 的哲学从一开始就是在两者之间找平衡:
“ 我们一直说,作为这项技术的构建者是很重要的,但我们需要创造一场「向上竞赛」,提高整个行业的标准。我们要站在前沿,但要用正确的方式。
他还特别提到,Anthropic 愿意将模型用于国防应用,但不是每一种国防应用都接受。一直以来,都还在试图找到一个中间地带。
主持人问了一个尖锐的问题:你一边说要放慢速度,但中国不会放慢,这怎么办?
Dario 坦承这是最棘手的困境。
“ 这是我们处境中最艰难的部分。如果不是这个情况,我们可以从容得多。这不是商业竞争的问题,地缘政治才是最难处理的。
他提出了两个策略。
第一,在美国对中国的技术领先范围内放慢。具体来说,就是不向中国出售芯片,同时加强自身的安全防护,防止技术被窃取。这能争取到一些时间。
主持人追问了一句很重的话:这够不够阻止人类的终结呢?
Dario 说,靠第一个策略能争取到多少时间就用多少。然后还有第二个策略:直接和中国谈。
“ 想想美苏冷战时期,双方各有一万枚核弹头对准对方。即使分歧再大,我们也意识到那太多了,需要谈判来降低毁灭的规模。
主持人问:我们是不是应该用冷战作为思考 AI 的模型?
Dario 纠正说,他说的不是用冷战做模型,而是谈判那个部分。
“ 我确实认为,军备限制谈判是思考 AI 地缘政治层面的一个合适视角。AI 模型在网络安全等方面绝对具有地缘政治和国家安全意义,这也是我们今天在讨论这些问题的原因。
主持人问:如果特朗普和中国即将会面,关于 AI 最重要的一个共识应该是什么?
Dario 给了两件事,一件小的、一件大的。
小的那件,小到也许真的能做到:美中双方同意不使用 AI 来开发生物武器,也不发布可以被生物恐怖分子利用的 AI 模型。双方都已经是《生物武器公约》的签署国,只需要把公约延伸到 AI 这个领域就好了。
大的那件,大到他自己都不确定能否实现:共同为 AI 发展速度设定一个上限。
“ 这会非常困难,因为抢先的诱惑和军事优势实在太大了。说实话,我也不知道这是否可能做到,但我们应该试试,看看是不是有可能。
而他反复强调,无论大小,谈判中最重要的是验证机制。这在核武器谈判和生物武器谈判中都是关键:你需要能够验证对方有没有违反协议。
“ 当然,这些都不是我一个人说了算的。这是政府对政府的事。但如果有人问我怎么看,我很愿意说。
访谈最后,主持人问 Dario:你感到个人责任吗?
“ 当然。
他接着说:
“ 这项技术由私人公司来构建,这件事本身就很奇怪。人们一直问我,为什么这不是由政府来做?最奇怪的是,我同意他们的看法。我对此感到不安。
主持人追问:你愿意把技术交给政府吗?
“ 交给正确的政府组合,是的。我担心的是,任何单一政府都可能像单一公司一样轻易地滥用这项技术。但某种形式的民主政府联合监管……我认为是可以的。
然后 Dario 说了大概是整场访谈里最诚恳的一段话:
“ 我不想让人们感到无力。我不想让他们觉得几家公司在为所欲为。我从来没有想要那样。我知道人们就是这么觉得的,但我从来没有想要那样。我们需要让这件事不再是真的。我们需要找到一种方式让它不再是真的。
访谈的最后一个问题是:如果你的阿姨坐在家里用着 Claude 或 ChatGPT,你想对她说什么?
Dario 说,首先别忘了这是一项很棒的技术,有大量正面的用途。每周有数亿人在使用他们的产品做各种有价值的事情。
“ 每周我都会收到邮件,有人说,我和 Claude 聊了聊,Claude 诊断出了我的医生漏掉的疾病。这样的邮件每周都有。
但风险也是真实存在的,太长时间以来,这个行业对公众撒了谎,把一切都包装成了岁月静好。Anthropic 从不是这么干的,但行业里太多公司这么做了。
“ 我不会骗你说风险不大。风险是真实的。但你也有发言权。我们正在尽一切努力与政府合作,为这项技术建立适当的监督,让选民和民选官员在这项技术的部署方式上拥有话语权。
这不是少数人能单独做的决定。这是所有人的决定。但这确实是一个重大的决定。我不会骗你说赌注不大。
“这是人类历史上最重要的技术事件之一,而我们所有人,都必须参与其中。”

◇ ◆ ◇
• 完整访谈视频:https://www.youtube.com/watch?v=hQR_VJF6ukk
• Dario Amodei 长文《We Must Pace the Frontier》:https://darioamodei.com/post/we-must-pace-the-frontier
• Anthropic 生物威胁报告:https://www.anthropic.com/news/frontier-threats-red-teaming-for-ai-safety