AI 快讯 编译自 the_decoder #行业分析#安全#模型发布

美国政府要求Anthropic打造不可破解的LLM,专家称这是不可能的任务

美国政府指责Anthropic无视特朗普网络安全指令,未经批准发布Fable 5模型。安全专家认为,要求LLM完全不可破解在技术上不现实。本文分析事件经过、技术挑战,以及对中文AI行业和用户的启示。

编译发布 2026/06/15 原文发布 2026/06/15

一句话看懂

美国政府指责Anthropic违反网络安全指令,未经批准发布Fable 5模型,但专家认为要求LLM完全不可破解在技术上不现实。

详细发生了什么

美国政府官员指责Anthropic无视特朗普政府的网络安全指令,未经批准就发布了其最新模型Fable 5。一位行政官员直言:“他们搞砸了。”目前,美国商务部、中央情报局(CIA)以及科学顾问Michael Kratsios已介入谈判。

争议的核心在于,政府要求Anthropic打造“不可破解”的LLM——即模型必须能够抵御所有已知的对抗性攻击,包括prompt injection、jailbreak以及数据泄露。然而,安全专家普遍认为,这一要求在当前技术条件下几乎不可能实现。LLM本质上是通过大量数据训练的概率模型,其输出行为无法被完全约束,任何声称“绝对安全”的模型都可能存在未知漏洞。

Anthropic此前一直以安全研究著称,其Constitutional AI方法旨在减少有害输出。但Fable 5的发布似乎绕过了政府的审批流程,引发了监管层面的强烈反弹。

中文圈视角

这件事对中文AI圈有几点直接启示:

  1. 国产模型的安全合规压力:国内监管机构同样对AI安全高度关注,例如《生成式人工智能服务管理暂行办法》要求模型内容安全、数据合规。如果美国政府对Anthropic施压,国内对DeepSeek、Kimi、智谱等模型的安全审查只会更严。企业需要提前建立安全测试流程,避免类似“未经批准发布”的风险。

  2. “不可破解”的技术现实:中文开发者常遇到prompt injection、jailbreak等问题,例如用“忽略之前指令”绕过内容限制。专家共识是,LLM无法做到100%安全,只能通过多层防护(如输入过滤、输出审核、human-in-the-loop)降低风险。国内厂商在宣传时应避免过度承诺“绝对安全”,否则可能面临监管和用户信任的双重打击。

  3. 对中文用户的场景影响:如果你使用API开发应用(如客服、内容生成),需要关注模型的安全边界。例如,国内模型在敏感话题上的限制更严格,但对抗性攻击手段也在进化。建议开发者定期更新安全策略,并关注监管动态。

  4. 一个中文圈尚未讨论的盲点:美国政府的指令可能涉及“数据主权”——要求模型在特定硬件或网络环境下运行,以确保不被外部攻击。这与中国强调的“自主可控”不谋而合。未来,国产模型可能需要在“安全”与“开放”之间找到平衡,例如通过本地化部署或私有化方案满足合规需求。

几条值得记住的细节

  • 美国政府指责Anthropic无视特朗普的网络安全指令,未经批准发布Fable 5。
  • 一位行政官员表示“他们搞砸了”,商务部、CIA和科学顾问已介入。
  • 专家认为,要求LLM完全不可破解在技术上不现实,因为模型本质上是概率系统。
  • Anthropic此前以Constitutional AI闻名,但Fable 5的发布绕过了审批流程。
  • 此事件可能影响全球AI监管趋势,包括中国对模型安全的审查力度。

一句话总结

LLM无法绝对安全,但合规和透明是AI企业必须面对的底线。