Anthropic首坦与五角大楼摩擦:安全派如何在AI军备竞赛中自处?

在Bloomberg资深记者Emily Chang的最新专访中,Anthropic联合创始人Dario和Daniela Amodei这对罕见的“同框组合”打破了行业默契,不仅回应了公司与美国国防部的合作边界,更剖析了在AI竞赛“先发优势”与“安全底线”之间的艰难平衡。这期访谈的价值,在于它将弥漫在硅谷AI实验室桌下的安全焦虑,第一次以如此具体的细节形式摆上桌面。

“与五角大楼的摩擦”并非空穴来风。此前业界猜测Anthropic与国防机构的互动将引发安全派内部的剧烈争议。访谈中,Amodei没有回避“邪恶用途”的潜在风险,明确表示公司在评估任何合作时都将“检查终端用户场景”作为核心流程。这实际上呼应了OpenAI在2023年修改公司章程并谋求与军方协作时引发的剧烈反弹——区别在于,Anthropic选择了更公开化、更具过程透明度的处理方式。Dario Amodei补充称,在AI堆栈中的底层通信或安全加固服务,与直接构建武器控制系统的参与完全不同,这实质上定义了“合规参与”与“核心军事用例”的分界线。

“安全派”的底层逻辑在本次对话中得到了罕见贯通。Anthropic的核心理念——强调“可解释性”与“前置评估”——直接体现在其Claude系列产品的发布节奏上。相比竞争对手将模型直接投入市场进行“社会实验”,Anthropic坚持先通过“红队测试”和宪法AI方法进行约束。Daniela Amodee指出,如果安全在AI部署中被视为“成本项”而非“核心要求”,整个产业的信任体系将面临崩塌。这是一种本质上的工业化思维与学术安全框架之间的对抗,而Anthropic试图在二者之间搭建一条窄路。

然而,理想与现实之间的张力正不断加剧。尽管Anthropic将“Claude Fable 5”和“Claude Mythos 5”定位为前沿安全研究的里程碑,但开源模型的崛起与闭源巨头的大规模扩张正在迫使所有安全派玩家在商业营收压力下做出妥协。在访谈中,Amodei夫妇承认“研究进度”与“产品交付”之间长期存在拉扯,而他们选择向外界暴露这种拉扯,本身就是在为行业设定一种治理底线:一个完全将安全让位于速度的组织,可能在未来引发难以挽回的连锁反应。

对于AI政策制定者和安全从业者而言,这次对话提供了两份关键资产。一是具体的、可操作的合作边界判断框架(即“终端场景审核”机制);二是一种坦诚的对抗性叙事——当公司主动暴露与军事机构的摩擦而非掩盖时,它反而获得了更牢固的道德立足点。

行业趋势判断:AI安全正从“隐性成本”变为“战略资产”。能够主动建构完整安全叙事(包括与争议方的博弈过程)的公司,未来将在融资、监管合规和人才吸引上占据压倒性优势。可以预见,类似Anthropic的“透明摩擦”将成为AI领域头部公司的标配沟通策略,而非可选的公关选项。