Anthropic双创始人揭秘:如何与五角大楼合作又不失安全初心

当大模型竞赛日趋白热化,一家估值达到9650亿美元的AI公司选择公开其对安全优先原则的坚持,这本身就是对行业价值观的一次硬核拷问。在Bloomberg的深度访谈中,Anthropic联合创始人Dario与Daniela Amodei罕见同框,共同揭开了该公司表面平静之下的激烈博弈——尤其是与五角大楼的谈判分歧,揭示了AI安全与商业扩张之间难以调和的张力。

安全派的底层逻辑:约束是增强竞争力的手段

Anthropic始终将自己定位为“安全派”AI公司的代表。但与OpenAI等竞争对手相比,其特殊之处在于,它将“约束”内化为公司治理的核心机制。与五角大楼的摩擦正是这种理念的集中体现:当军方客户提出某些数据隐私或部署场景需求时,Anthropic团队坚持必须保留对模型行为的最终控制权,拒绝在军事场景中牺牲可解释性。这种看似“僵化”的立场,实则在行业中树立了一个清晰的信号——在AI安全领域,妥协的成本远高于坚守。Daniela Amodei在访谈中直言,每次谈判都是一次价值观的“压力测试”,而公司选择以公开讨论的方式呈现这种摩擦,本身就是对行业透明度的一次强势推动。

创业起源与竞争格局:从AI研究员到公司决策者的身份切换

两位创始人从AI研究员转型为企业高管的历程,是理解Anthropic独特文化的一把钥匙。他们早期在OpenAI的经历,使他们对“先放行、后补救”的产品策略有着切身的警惕。这种学术背景让他们在商业扩张上采取了更保守但更具防御性的路径:优先构建可验证的安全技术栈,而非争夺C端用户量。在当前的竞争格局中,这看起来更像一场“龟兔赛跑”——当OpenAI和Google快速迭代模型时,Anthropic却在审慎地优化其“宪法AI”框架,试图从底层减少模型偏差和错误输出。这种路径选择的风险在于,如果安全无法被量化证明,它可能会在商业竞争中失去先机;但潜在收益也同样巨大:一旦监管环境收紧,Anthropic可能成为唯一能够提供合规性证明的玩家。

趋势判断:AI安全将从“可选”变为“必选项”

Anthropic与五角大楼的博弈,本质上是全球AI治理体系构建中的一个缩影。2025年,AI安全已不再是实验室里的学术议题,而是关系到企业存亡的战略抉择。对于AI从业者和政策制定者而言,这场对话的核心启示在于:与其争论“是否应该安全”,不如探讨“安全如何被定义和执行”。Anthropic给出了一个颇具参考价值的答案:将安全约束前置,通过可审计的技术手段(如基于规则的奖励模型)来对冲不可预知的风险。未来三年,预计会有更多AI公司效仿这一模式,将安全治理从“事后修补”转向“事前设计”。在这个意义上,Anthropic或许不是最快的跑者,但它为整个行业提供了一副值得仔细推敲的地图——那条看似曲折的“安全之路”,最终可能是最短的捷径。