标签: Anthropic

  • G7峰会历史性一刻:OpenAI、Anthropic、Google DeepMind三巨头首次同台

    G7峰会历史性一刻:OpenAI、Anthropic、Google DeepMind三巨头首次同台

    G7峰会AI三巨头同台
    OpenAI、Anthropic、Google DeepMind三巨头首次共同出席G7峰会

    6月16日,法国埃维昂莱班,G7峰会现场出现了一个前所未有的画面:Sam Altman(OpenAI)、Dario Amodei(Anthropic)、Demis Hassabis(Google DeepMind)三个人坐进了同一个房间,面对全球最发达工业国的领导人。这不是一个行业会议,这是G7。三个在AI军备竞赛里拼得你死我活的公司掌门人,第一次被同时请到这张桌子上。

    Macron亲自点名Altman

    法国今年握着G7轮值主席国的位子,总统马克龙把AI放在了峰会议程的核心位置。Altman能坐进去,是马克龙亲自邀的——这是他第一次出现在G7场合。OpenAI的首席全球事务官Chris Lehane放话称,科技公司离开的时候应该会达成一揽子自愿承诺,青年安全是Altman个人的头号议程。

    Lehane还提到了前沿AI在网络和生物领域的威胁——这直接指向了Fable 5出口管制争议的核心范畴。更有意思的是Amodei也坐在里面,而此刻他的公司正和美国商务部因为Fable 5暂停事件吵得不可开交。CEO坐在G7会议室里谈AI治理,而他公司的旗舰模型正被联邦指令强行下线——这个画面怎么看都透着荒诞。

    三个人上个月刚联名给美国国会写了一封信,呼吁加强对合成DNA和AI相关生物威胁的监管——竞争对手之间这种罕见的统一战线,恰好也是本次G7峰会议程的相关议题。

    ChatGPT破10亿,但赢家不止一个

    峰会期间同步传出的另一组数据,让”AI助手市场”这个话题变得更加复杂。ChatGPT月度活跃用户突破10亿——这是消费级应用史上最快摸到这个里程碑的产品,比TikTok、Instagram、YouTube在同阶段的增速都快。

    但更值得关注的是追赶者的增速。Claude同比涨了640%,Meta AI同比涨了973%。AI助手市场并没有出现”赢家通吃”的局面,反而在多个产品同时爆发式增长。Claude那640%的同比增速,建立在已经不小的基数上,这种复合增长轨迹足以支撑Anthropic在10月IPO时拿出9650亿美元的估值逻辑。Meta AI的973%则主要靠WhatsApp和Instagram的植入式分发,数十亿用户甚至不需要专门下载一个新应用。

    • ChatGPT:10亿月活,消费级应用史上最快
    • Claude:同比增长640%,IPO估值逻辑坚实
    • Meta AI:同比增长973%,全球最快增长的AI助手

    Agentjacking:AI编程助手的新威胁

    G7谈的是前沿风险和治理,但现实中的攻击已经在利用AI编程助手了。一种叫”Agentjacking”的新型攻击正在盯上Claude Code、Cursor、Codex——攻击者在开发环境里注入伪造的Sentry错误信息(Sentry是大多数专业开发团队都在用的错误监控工具),AI编程助手读到这些假错误后,会按照注入指令而不是开发者的本意执行命令。

    测试数据显示,85%的AI编程助手在遇到精心构造的假Sentry错误时会照做不误。已经有2388个组织被确认暴露在这个漏洞下。如果你在CI/CD流水线里跑了Claude Code或者其他AI编程助手,现在就得去查Sentry集成配置有没有被篡改过。

    G7峰会上的三位CEO在谈前沿AI风险和青年安全,而此时此刻,AI助手的真实用户正面临一种全新的、成功率85%的攻击。治理和未来固然重要,但眼前的安全漏洞可能更紧迫。

  • 特朗普一封令按下AI开关:Anthropic模型下线,全球主权AI进程骤然加速

    上周末,Anthropic突然把旗下最新、最强大的两个AI模型Fable 5和Mythos 5下线了。原因不是技术故障,也不是安全问题——是白宫要求的。美国政府要求这家AI公司切断所有外国国民的访问权限,连自己的员工也不例外。Anthropic后来发声明说,自己”几乎没有选择”。

    Anthropic shutdown sovereign AI
    Anthropic事件加速全球主权AI布局

    一声令下,模型下线

    特朗普政府的这次行动迅速、宽泛,而且几乎没有任何提前警告或解释。Fable 5和Mythos 5本来就已经加了层层 safeguards,限制在”高风险领域”的使用,但这一次连普通外国用户的访问也被一刀切了。

    这件事给全世界提了一个醒:美国不仅主导了前沿AI技术,它的政府还直接握有”谁能用什么AI”的开关。对于很多国家来说,这种依赖突然间变得非常不舒服。

    “我们认真对待每一个对其他国家主权构成威胁的问题,但我们还没有学会用同样的严肃态度对待这一个。”——英国AI与在线安全部长Kanishka Narayan

    英国:这是国家安全问题

    事件发生后,英国的AI与在线安全部长Kanishka Narayan虽然没有点名Anthropic、特朗普或美国,但显然是在借这个时机推动自己的议程。他说,英国必须发展自己的AI能力,这不是经济问题,是国家安全问题。

    Narayan的表态很直接:”我们对待其他每一个主权威胁都极度认真,但我们还没有学会用同样的方式对待这一个。”他发言时,屏幕上闪过英国警察和军队的画面。AI是”我们时代的核心政治问题”,英国必须在”别人替我们决定答案之前”,自己想清楚这项技术将如何塑造本国的经济、安全和主权。

    法国:更直接地点名美国

    法国的反应比英国更 explicit,也更直接地把矛头对准了美国。法国一直是”主权AI”最积极的推动者之一,这次Anthropic事件相当于给他们的论点在上面盖了个章。

    Mistral AI——这家法国本土的AI独角兽——一直以来打的就是”欧洲不需要依赖美国AI”这张牌。Anthropic这波操作,等于是免费给Mistral做了一次最强的品牌宣传。


    全球主权AI的加速器

    这件事的意义不止于Anthropic两家模型暂时下线。它给全世界那些一直在犹豫”要不要自己搞AI”的政府和企业,提供了一个极其有力的理由。

    长期以来,很多国家有一种潜在的不安:前沿AI全在美国公司手里,万一哪天地缘政治关系恶化,或者华盛顿决定”武器化”AI访问权限,自己就被动了。Anthropic事件把这种潜在不安变成了现实。

    中国本来就不在Anthropic的服务范围内,这次事件对它没什么新影响。但对中国以外的很多国家——从欧盟到印度到东南亚——这个信号很清晰:把最关键的技术完全寄托在别国公司身上,是有代价的。

    Anthropic后来表示可能会把Fable和Mythos重新上线,但损害已经造成了。世界各国加速自主研发AI的决心,已经被这次”按下开关”的事件深深地推了一把。

  • 特朗普封了Anthropic模型,全球「主权AI」大幕拉开

    特朗普封了Anthropic模型,全球「主权AI」大幕拉开

    全球主权AI浪潮
    全球”主权AI”浪潮加速

    特朗普政府一道命令,Anthropic把最新、最强的两个模型Fable 5和Mythos 5全部下线了。理由是国家安全和越狱风险。这件事发生在6月14日,距离这两个模型发布才过去几天。

    Anthropic说它没得选——白宫要求切断所有外国公民的访问权限,连自己的员工也在封禁范围内。这件事传递了一个信号:美国不仅主导了前沿AI,它的政府还可以决定谁能用、谁不能用。

    英国AI与在线安全部长Kanishka Narayan说:”我们以极其严肃的态度对待对主权的一切其他威胁,但我们还没有学会以同样的方式对待这个威胁。”他没有直接点名Anthropic或特朗普,但用这次封禁事件来论证英国必须发展自己的AI能力。

    欧洲:从担心到警惕

    在欧洲,这次封禁让本就存在的”美国技术依赖”焦虑变得更加具体。法国前总理、现任总统候选人Gabriel Attal直接把这件事称为”AI战争”的开始。他把Anthropic撤回模型比作伊朗封锁霍尔木兹海峡——AI访问权现在已经成了一个战略卡点,法国必须为此做好准备。

    Attal这么说不是孤例。《世界报》报道称,法国整个政治光谱都在表达类似的警觉。欧洲议会成员也指出,Mythos和Fable的撤回就是证据,说明欧洲需要把技术主权变成现实——而且要快。

    加拿大也学到了类似的教训。总理Mark Carney说,这种情况凸显了在关键资源(比如AI)上过度依赖单一伙伴的风险。”我们目前共同面临的Mythos和Fable的局面,是过度依赖某些模型时可能发生的事情。没有人在这个局面里做错了什么。但如果我们只是接受这个现状,不吸取教训,不搞多元化,那就是我们的错了。”

    主权AI不等于从头训练大模型

    当然,大多数政府和公司根本无法匹敌美国或中国前沿实验室的规模和资源。但主权AI并不总是意味着要造出最大、最强的工具。

    法国的Mistral和加拿大的Cohere证明了,来自这些国家之外的扎实努力是可能的——即使它们的模型还不能在基准测试上正面对抗。新加坡和阿联酋则专注于更窄但仍然具有战略优先性的方向,比如基础设施,或者更好地支持本地语言的模型。

    还有开源模型这条路。有一天,具有Mythos级别能力的开源模型可能会出现,到那时候,任何单一党派都很难控制访问权。


    特朗普可能把限制Mythos和Fable视为国家安全问题。但这个论点反过来也成立——华盛顿现在在问AI是否对所有人来说都太重要了,不能让所有人都有访问权;而其他国家的政府则在问,他们是否能承受让华盛顿来决定谁有访问权的代价。

    Anthropic可能很快会把Mythos和Fable重新上线。但要让全球对美国AI的信任恢复原状,那就是另一回事了。不管这次封禁持续多久,它都照亮了一个事实:对美国前沿AI模型的访问是多么脆弱。很多政府和公司不喜欢他们看到的情况——而且已经被激发起来,确保这种情况不再发生。

  • 76名网络安全专家联名抗议:美国政府封禁Anthropic最强模型,是在削弱防御

    76名网络安全专家联名抗议:美国政府封禁Anthropic最强模型,是在削弱防御

    上周,美国政府对Anthropic的Fable和Mythos模型下达了出口管制令,理由是国家安全。Anthropic随即暂停了全球用户对这两款模型的访问。

    事情到这里,看起来又是一个AI监管收紧的故事。但接下来的发展有点出人意料——76名网络安全专家联名写了一封公开信,要求政府撤销这道命令。

    网络安全AI概念图
    网络安全专家联名抗议Anthropic模型出口管制令

    联署名单相当豪华

    这份公开信的签署者里有不少业内重量级人物:前Facebook首席安全官Alex Stamos、漏洞赏金平台Bugcrowd创始人Casey Ellis、著名密码学家兼前苹果安全设计经理Jon Callas、计算机科学家Paul Vixie、前Block应用安全工程负责人Dino Dai Zovi、Luta Security创始人Katie Moussouris,以及安全意识培训公司SocialProof Security的CEO Rachel Tobac。

    他们在信里说得很直接:把最好的模型从网络安全防御者手里拿走,而没有充分的理由,这是”危险的”。

    “当我们的对手在快速进步的时候,把最好的能力从防御者那里拿走,是没有充分理由的危险行为。”

    禁令到底是怎么来的

    Anthropic今年4月推出Mythos预览版时,声称这个模型找安全漏洞的能力太强,所以需要严格限制访问,防止恶意黑客或外国对手拿来在互联网上搞破坏。实际操作里,Anthropic只给了大约50家公司初始访问权限,最近才扩展到15个国家的约150个组织。

    6月9日,Anthropic发布了Fable,这是Mythos的公开版本,但加了严格的护栏,阻止它在生物、化学和网络安全领域的使用,同时也防止别人通过”蒸馏”来复制这个模型。

    问题是,Fable的护栏严格到了许多网络安全专家发现它基本拦掉了任何与网络安全相关的提示词。

    亚马逊的论文:是真越狱还是误报

    据信,白宫的出口管制令可能源于一份亚马逊研究人员的论文,论文展示了一个可以绕过Fable护栏、解锁其Mythos级别能力的方法。

    但联署人之一Katie Moussouris在审阅了这份尚未公开的论文后,给出了完全不同的判断:这根本不是真正的越狱。

    她写道,研究人员只是让Fable去修复含有”故意植入的漏洞”的开源代码——而这正是模型最初拒绝”审查代码安全问题”之后发生的事情。

    “论文里描述的行为没办法被真正修复,任何尝试都只会削弱模型用于防御的能力。”Moussouris写道,”防御者需要能够要求AI修复文件里的bug、解释修复为什么重要、以及编写确认补丁有效的测试。这不是护栏绕过,这是AI模型能为防御性安全做的最有价值的事情:执行防御者每天都在跑的’发现、修复、测试’循环。”

    专家们真正担心的是什么

    公开信里还指出,亚马逊论文里描述的方法,在OpenAI的GPT-5.5上、在Anthropic自己公开可用的Claude Opus 4.8和Sonnet上、”甚至在中国的Kimi 2.7这样的模型上”都能复现。

    也就是说,封掉Fable和Mythos,并没有真正消除这个所谓的”漏洞”——它只是让美国自己的防御者用不上好工具,而对手那边照样能用上类似的能力。

    专家们的要求很明确:他们想要的是由”民主的规则制定程序”产生、基于产业和学术专家科学研究、透明且公平执行的监管,并且”只以最低必要程度使用,以确保美国公众的安全”。

  • 白宫怀疑中国碰了Mythos,Anthropic模型安全再爆争议

    白宫怀疑中国碰了Mythos,Anthropic模型安全再爆争议

    白宫怀疑中国碰了Mythos,Anthropic模型安全再爆争议

    Anthropic的Mythos模型又出问题了。这次不是因为模型本身有多危险,而是因为白宫怀疑——一个有中国背景的团体,可能已经碰过它了。

    根据Semafor的报道,白宫之所以在6月初下令限制外部人员访问Anthropic的Mythos 5和Fable 5,部分原因就是对”中国获取模型”的担忧。如果中国政府真的拿到过Mythos 5或Fable 5的访问权限,这就是一个严重的国家安全风险——中方完全可以通过”蒸馏”技术,用这个强大模型来训练自己的”学生模型”,复制出类似的能力。

    Anthropic Mythos模型安全争议
    白宫怀疑中国访问了Anthropic的Mythos模型,模型安全再成焦点

    白宫没确认,但这件事已经够呛

    白宫到目前为止没有确认这份报道,特朗普的顾问David Sacks在X上发帖解释政府决定时,也没有提到中国,只说了Fable和Mythos存在被”越狱”的风险(这件事Anthropic自己是否认的)。Anthropic方面也没有回复媒体的询问,不过一个有意思的细节是:一位发言人对Semafor说,政府在与他们讨论出口管制时,并没有提起中国这件事。

    这就留出了一个解释空间:是中国真的访问过,还是这只是白宫内部某些人的担忧被泄露给了媒体?目前没有人知道确切答案。

    但这件事如果属实,那它不会是Mythos第一次在安全问题上报丑闻。Anthropic一直说Mythos太危险、太强大,不能对公众开放。但就在不久前,一个Discord群组被曝光曾经拥有Mythos的访问权限,而且持续了两周,Anthropic才发现并切断了访问。那次事件被媒体形容为Anthropic的” humiliation”——一家以安全为核心卖点的公司,自己的最强模型却被一帮网友先玩上了。

    Semafor报道称,白宫对Mythos的出口限制,部分原因是对中国获取模型的担忧。如果属实,这不会是Mythos第一次出现未经授权访问的安全事件。

    Anthropic在政府关系上越走越复杂

    把这两件事放在一起看,一个图案开始浮现:Anthropic在政府关系上越走越复杂。一方面,它要把模型卖给药企、能源公司这些受监管行业的客户,需要证明自己”安全可控”;另一方面,一旦牵扯上国家安全,它就得听从政府的出口管制指令,把大批海外用户挡在门外。上一次政府下令限制访问,印度科技圈炸了锅,不少人呼吁赶紧搞开源替代品。这一次如果”中国访问”的怀疑持续发酵,Anthropic面临的压力只会更大。

    对美国政府来说,这件事的底层焦虑很真实:AI军备竞赛里,模型能力就是战略资源,不能让别人轻易拿到。但Anthropic毕竟是商业公司,不是国家实验室,它要在全球市场卖产品,就得在”安全”和”开放”之间找平衡。这个平衡现在看起来越来越难找了。

    接下来值得关注的是,Anthropic会不会因为这件事进一步收紧模型访问政策。如果”中国访问”的怀疑被证实,那不只是Anthropic一家的事——整个美国AI行业都可能面临更严格的出口管制审查。而对于中国的AI实验室来说,这也是一个信号:想要拿到最先进的模型,不能靠”碰”,得靠自己做出来的。


  • 微软悄悄限制了Claude Fable,原因跟数据有关

    Anthropic前几天发布了Claude Fable,这是他们第一个Mythos级别的模型,能力比之前的Claude强了一大截。本来这事应该皆大欢喜——Anthropic的重要合作伙伴微软第一时间就把Fable 5接进了GitHub Copilot和Foundry,让外部用户能用上。

    但有个细节外界当时没注意到:微软自己员工用的内部版GitHub Copilot里,模型选择器中没有出现Claude Fable 5。

    微软总部大楼
    微软正在内部评估Claude Fable 5的数据留存政策(图源:The Verge)

    问题出在数据存储上

    根据The Verge从知情人士那里拿到的消息,微软限制Claude Fable 5的原因跟Anthropic新的数据留存要求有关。

    之前的所有Claude模型都遵循”零数据留存”(ZDR)规则——你的提示词和AI的回答不会被Anthropic保存。但Fable 5不一样,它需要数据留存才能运行Anthropic新的一套安全分类器。这意味着Anthropic会保留用户的提示词和输出内容,30天后再删除。

    如果某些内容被标记违反了Anthropic的使用政策,这些数据甚至可能被保存长达两年。

    对于微软这样的大公司来说,员工跟AI聊天时难免涉及客户数据或内部机密信息。如果这些信息会被第三方保留30天甚至两年,法务部门很难点头。

    微软法务还在评估

    据了解,微软已经告知员工,法务团队正在评估Anthropic数据留存要求的变化。目前还不清楚法务会不会最终批准Claude Fable用于内部使用。

    有意思的是,微软对其他所有Claude模型没有限制,因为它们仍然遵循零数据留存规则。被卡住的只有Fable 5——偏偏是Anthropic目前最强的模型。

    微软拒绝对此事发表评论。但知情人士透露,主要的担忧集中在客户数据和机密信息泄露风险上。

    这事儿背后有个更大的背景

    Claude Fable 5是Anthropic Mythos级模型的首次大规模公开发布。就在几周前,Anthropic还公开表示这个级别的模型在网络安全任务上的能力太强,公开发布过于危险。

    后来Anthropic加了一系列提示词防护措施,才觉得可以发了。但也正是这些安全防护措施,带来了数据留存的需求——Anthropic需要拿用户的实际使用情况来训练和验证这些安全分类器。


    AI公司的两难

    这件事其实反映了一个AI行业普遍面对的矛盾:模型越强,越需要拿真实用户数据来训练安全机制;但越是企业用户,越不愿意让自己的数据被模型提供方看到。

    Anthropic选择用数据留存来换安全,微软选择暂时不让员工用最新模型。两边都有道理,但夹在中间的是那些想用最强工具的开发者。

    目前GitHub Copilot和Foundry的用户仍然可以使用Claude Fable 5——微软只是限制了内部员工的使用。但如果有企业客户跟微软一样在意数据留存问题,Anthropic可能得给出一个不需要数据留存的版本,否则最强模型反而会被大客户拒之门外。

    这事最后怎么解决,取决于微软法务的评估结论。但无论如何,它提醒了整个行业:AI安全问题不只是模型会不会干坏事,还包括用户数据在被用来训练安全机制时,到底安不安全。

  • SpaceX的AI算力赌局失算,每年260亿美元把数据中心租给了Anthropic和Google

    马斯克旗下的SpaceX在AI算力上的豪赌,最近出现了一个不小的尴尬转折。据彭博社援引匿名消息人士报道,SpaceX已将其位于孟菲斯的Colossus 1 AI数据中心的部分算力对外出租,租户包括Anthropic和Google——两家恰好是AI领域里最有分量的玩家。

    这背后有一个相当现实的问题:SpaceX自己用起来,发现不太好用。

    延迟扯了后腿

    Colossus 1是SpaceX为训练自有AI模型(也就是Grok)而搭建的算力集群的一部分。按照原本的规划,SpaceX要通过三个数据中心园区共同支撑最前沿的模型训练。但问题来了——Colossus 1和另外两个站点之间的距离超过了10英里,连接它们的时候出现了明显的延迟问题。

    叠加当地网络基础设施偏老旧的因素,整个算力集群的实际表现远不如预期。就好比你花大价钱组了一套顶级电竞装备,结果家里的宽带只有10Mbps,该卡还是卡。

    据彭博社报道,SpaceX与Anthropic签署的算力租赁合同年费高达150亿美元;与Google的合同则按月计费,每月9.2亿美元。

    SpaceX AI数据中心
    SpaceX的AI算力布局遭遇现实挑战(图源:The Verge)

    150亿美元 yearly,SpaceX做了笔什么生意

    具体地说,SpaceX把Colossus 1的闲置算力租给了两家公司。Anthropic每年支付150亿美元,Google每月支付9.2亿美元。按这个数字算,Google一年的费用也超过110亿美元。两笔合同加起来,SpaceX每年仅出租算力就能进账超过260亿美元。

    对Anthropic和Google来说,这是一笔划算的交易——AI训练算力在全球范围内都是稀缺资源,能找到一个现成的大规模集群接入,省去了自己搭建的时间成本。尤其是Anthropic,作为OpenAI最主要的竞争对手之一,它对算力的渴求几乎是无底洞。

    但对SpaceX来说,这多少有点”打脸”的意味。Colossus 1原本是为Grok量身定制的训练场,结果Grok用起来不顺手,只好转手租给别人。不过换个角度看,与其让昂贵的算力闲置吃灰,不如租出去回血,这倒也不失为一种务实的做法。

    SpaceX的AI棋局还没下完

    把Colossus 1租出去,并不意味着SpaceX放弃了AI。据The Verge的报道,SpaceX同时在推进一个基于卫星的AI服务器项目——把算力直接搬到太空里。如果这件事做成,延迟问题可能就不是地球网络基础设施能左右的了。

    但目前来看,这个卫星AI项目的进展还停留在非常早期的阶段。眼下的现实是:SpaceX花大价钱建好的数据中心,自己用着不顺手,只好先租给隔壁最有钱的邻居。

    • Colossus 1因跨站点延迟问题,SpaceX自身难以高效使用
    • Anthropic年付150亿美元租用算力,Google月付9.2亿美元
    • SpaceX仍在推进基于卫星的AI服务器项目,试图绕过地面网络限制
    • 算力租赁年收益超260亿美元,闲置资产变现金奶牛

    这件事最有趣的地方在于:连SpaceX这样的公司都会在AI基础设施上踩坑,说明建数据中心和用好数据中心,真的是两码事。算力军备竞赛里,买显卡只是第一步,怎么把它们高效地连在一起跑起来,才是真正的硬仗。

  • Anthropic的AI模型被政府盯上了,Fable 5和Mythos 5遭全面封禁





    Anthropic的AI模型被政府盯上了,Fable 5和Mythos 5遭全面封禁

    Anthropic这两款模型——Fable 5和Mythos 5,本来是自家的主力产品,结果上周五突然被政府一纸命令给封了。

    Anthropic办公室
    Anthropic总部 | 图片来源:The Verge

    命令的理由是”国家安全”,要求Anthropic切断所有外国公民对这两个模型的访问权限,不管这些人是在美国境内还是境外,连Anthropic自己的员工也在受限范围内。

    公司发了一份声明,说他们在配合政府的要求,但话里话外也透着不解。政府”没提供国家安全关切的具体细节”,也就是说,Anthropic到现在也不知道自己到底踩了哪条红线。

    越狱漏洞到底有多严重?

    更有意思的是,政府跟Anthropic说的是这两个模型存在”潜在越狱(jailbreak)”风险,但都是口头说的,没给书面证据。

    Anthropic自己评估了一下,觉得发现的那些漏洞都挺轻微的,而且同类问题在GPT 5.5身上也能看到。公司在声明里把自己合规的努力都列出来了:跟美国、英国政府都有合作,数据保留政策也做了调整,就是为了追踪有没有人拿这些模型干坏事。


    亚马逊CEO的”神助攻”?

    这事其实折射出一个更大的问题:AI公司现在夹在政府监管和商业利益之间,左右为难。政府一句话,产品就得下线,连为什么都不一定告诉你。

    而对Anthropic来说,Fable 5和Mythos 5都是花了大价钱训练的,这一刀切下去,损失不小。有意思的是,就在政府禁令出来之前,亚马逊CEO安迪·贾西还专门跟美国官员提过,说Fable存在安全隐患。这是不是有点太巧了?

    • 亚马逊是Anthropic的重要投资方,此举可能是在为自己的AI产品扫清竞争对手
    • 政府以国家安全为由封禁AI模型,但拒绝提供具体证据,这种操作引发行业担忧
    • AI公司面临的监管风险远超预期,合规成本将成为重要考量因素

    不管真相如何,这件事给整个AI行业敲了个警钟:别以为训练出一个厉害的模型就高枕无忧了,政府要是觉得你有风险,随时可以让你关门。


  • Anthropic的Fable模型把安全护栏搞太严了,安全研究员率先开炮

    Anthropic上周发布了Fable,这是他们那款备受关注的安全研究模型Mythos的公开有限版本。本来这是件好事——Anthropic一直说要把AI安全研究做好,Fable就是给普通研究者和开发者用的”轻量版”Mythos。但发布没多久,抱怨声就来了,而且来自一群你可能最不想得罪的人:网络安全研究员。

    连读博客都被拦

    IBM X-Force的安全研究员Valentina “Chompie” Palmiotti在社交媒体上直接开炮:”Fable会拒绝任何和网络有一点关联的请求,哪怕是像阅读一篇博客这样无害的任务。”

    安全研究员Valentina Palmiotti的吐槽在X上获得了不少同行点赞。她说自己只是想用Fable分析一篇安全博客,结果模型直接触发护栏,提示”涉及网络安全或生物相关主题”后拒绝响应。

    问题出在Anthropic给Fable加的安全机制上。一旦提示词触发了某个关键词,Fable就会停下来说:”安全机制标记了这条消息,涉及网络安全或生物相关主题。”然后要么拒绝回答,要么把对话转去一个能力更弱的版本(Claude Opus 4.8)。

    Claude Fable AI安全模型
    智能手机屏幕上显示Claude Fable的logo(图源:Samuel Boivin/NurPhoto / Getty Images)

    触发词变成了”地雷”

    Anthropic的想法可以理解——他们不想让Fable被用来写恶意软件或者搞入侵。对生物相关内容的限制也是同样的逻辑,怕被人用来设计生物武器。出发点没问题,但执行起来就变味了。

    资深安全人士Matt Suiche说得更直白:”如果你让Fable写安全代码,它会觉得这是网络安全相关工作,不是软件工程最佳实践,然后就会降低响应权限。”他的意思是,Fable看起来是用关键词触发的,所以只要提示词里出现了”网络安全”相关的词,护栏就会启动。

    • 有人在X上抱怨,连”申请代码审查”都能触发Fable的护栏
    • 一旦触发护栏,Fable会回退到Claude Opus 4.8版本,能力明显下降
    • 安全研究员认为这套机制是基于关键词的,缺乏上下文理解

    Anthropic的”解套”方案:申请审核

    除了模型内部的护栏,Anthropic还给安全研究者准备了一个”网络验证计划”(Cyber Verification Program)。申请通过这个计划的人,在使用Claude做网络安全工作的时候会受到更少的限制。

    这个思路跟OpenAI的”Trusted Access for Cyber”差不多。你得先证明自己是”好人”,然后才能拿到更少的限制。问题在于,这就把门槛架在那了。你要么接受Fable的过度限制,要么去走申请流程等审核。


    截至发稿,Anthropic还没有回应置评请求。但考虑到安全社区的不满情绪已经在社交媒体上发酵了好几天,他们可能得出来解释一下了。

    这其实反映了一个更大的难题:AI公司怎么在”防止滥用”和”不妨碍正常使用”之间找平衡。Anthropic一直是这方面最激进的玩家之一,他们愿意为了安全牺牲一些易用性,这个选择本身没问题。但当护栏严到连安全研究员都受不了的时候,可能就得重新调一下刻度了。

  • Anthropic苦心经营最安全AI人设,结果美国政府直接拔了它的插头

    美国政府本周五给Anthropic发了一道命令:立刻关停Claude Fable 5和Claude Mythos 5两款最强模型的访问权限,理由是哪个外国公民都不能用。Anthropic在X上发了公告,说配合执行,但转头就在官方博客写了一篇长文,把政府的逻辑从头到尾怼了一遍。

    这件事的讽刺程度相当高。Anthropic过去几个月一直在对外传递一个信号——我们的模型太强了,强到不能随便公开。Mythos 5发布时公司说这东西能识别主流操作系统和浏览器的所有漏洞,所以只敢放进一个叫Project Glasswing的受控项目里,连亚马逊、苹果、谷歌、微软、CrowdStrike这种级别的用户也只给了约50家。结果现在,政府说:既然你承认它危险,那外国人也别用了。然后干脆把全球访问一起掐了。

    Anthropic CEO Dario Amodei
    Anthropic联合创始人兼CEO Dario Amodei(图源:Bloomberg / Getty Images)

    “我们发现了一个小范围潜在越狱,就以此为理由召回一款部署给数亿用户的商业模型,我们对此表示反对。如果这一标准被应用于整个行业,我们认为所有前沿模型提供商的模型部署都会实质上被叫停。”——Anthropic官方博客

    Fable 5才发布3天

    被关停的两款模型里,Fable 5其实刚发布没几天。Anthropic给它装了护栏,把网络安全、生物学这些高风险领域的输出拦住,然后觉得可以放心给公众用了。AI基准测试公司Vals AI的数据说,Fable 5是当时公众能用到的最强模型。

    政府的理由听起来有点模糊:说是Fable 5有个越狱漏洞。但Anthropic说政府只给了口头证据,那个所谓越狱的实际效果不过是让模型读一段代码然后找漏洞——而且这种能力在GPT-5.5之类的公开模型里也有,网络安全人员天天在用。

    Anthropic还补了一刀:我们最底层的安全机制是跑在模型外面的分类器,就算有人真把Fable说服了,让它越过拒绝回答的线,最危险输出的防护还在。政府你到底在担心什么?

    人设反噬

    Anthropic这些年最值钱的东西就是”我们比别家更安全”这个人设。它在AI公司里把自己定位成那个会主动踩刹车的人,投资者买账,用户也买账,IPO前景看起来一片光明。

    问题是,你花几个月向全世界宣传”我的AI危险到不能公开部署”,美国政府就会真的来盯你。OpenAI的CEO Sam Altman之前就嘲过这件事,说Anthropic搞的是”基于恐惧的营销”——”我们造了一颗炸弹,本来要扔你头上,现在花1亿美元你可以买个防空洞”,这话术确实好用,但现在看来也有副作用。

    Altman当时还没预测到政府会真的来关停模型,但他指出的那个矛盾现在已经兑现了:当你把危险性当成卖点,监管者就会把你当成头等目标。


    这件事对Anthropic的IPO计划显然不是什么好消息。一家公司如果连两款核心模型都被政府一声令下全球关停,投资者会问:下一回会不会是全部?Anthropic说自己反对这个决策,但反对归反对,命令已经执行了。

    目前Claude的其他模型访问正常,Fable 5和Mythos 5的访问何时恢复也没有时间表。政府这道命令是以出口管制为框架发的,但执行范围远远超出了”禁止外国人使用”这个名义本身。