Anthropic 重新部署 Claude Fable 5:出口管制解除后新增安全分类器,99% 阻断越狱
Anthropic 于 7 月 1 日恢复 Claude Fable 5 全球访问,此前因美国出口管制暂停。新增安全分类器可 99% 阻断亚马逊报告的绕过技术,并将可疑请求路由至 Opus 4.8。同时与 Amazon、Microsoft、Google 提出四维越狱严重性框架。本文详解事件经过、新机制及对中文用户的影响。
一句话看懂
Anthropic 在出口管制解除后于 7 月 1 日重新部署 Claude Fable 5,新增安全分类器阻断越狱技术,并与科技巨头共推越狱严重性评分框架。
详细发生了什么
Anthropic 于 6 月 9 日发布 Claude Fable 5 和 Mythos 5,两者共享同一基础模型。Fable 5 面向通用用户,带有强安全防护;Mythos 5 则对防御性网络安全合作伙伴开放部分防护。6 月 12 日,美国出口管制指令生效,限制模型仅限非外国国民使用。Anthropic 因无法实时验证国籍,暂停了所有用户的访问。
触发暂停的是亚马逊研究人员发现的一种绕过 Fable 5 防护的技术:通过特定提示让模型识别多个软件漏洞,并在一个案例中生成了利用代码。Anthropic 测试后发现,该技术并非 Fable 5 独有,包括 Claude Opus 4.8、GPT-5.5、Kimi K2.7 在内的多个模型都能复现。
6 月 26 日,政府批准恢复 Mythos 5 对部分美国组织的访问;6 月 30 日,出口管制完全解除。7 月 1 日,Fable 5 全球重新上线。
为堵住漏洞,Anthropic 训练了一个改进的安全分类器,可 99% 以上阻断该特定技术。被阻断的请求不会被直接拒绝,而是路由到 Claude Opus 4.8 处理,用户会收到通知。美国商务部 CAISI 测试后认为新防护“极其强大”,但代价是日常编码和调试中的误报增加。
此外,Anthropic 与 Amazon、Microsoft、Google 等 Glasswing 合作伙伴共同起草了越狱严重性评分框架,基于四个维度:能力增益、能力增益广度、武器化难易度、可发现性。对于最严重等级,Anthropic 将立即部署初步缓解措施,并建立 24/7 的越狱提交渠道监控。
中文圈视角
对国内用户意味着什么? 首先,Claude Fable 5 重新部署对中文用户是利好,但访问仍需通过 Anthropic 官方平台或 API,且需要海外支付方式。国内用户可通过 API 调用(需海外信用卡)或使用 Claude.ai 网页版(需稳定网络环境)。
国产平替对比: 在 Fable 5 暂停期间,智谱 AI 发布了 GLM-5.2(开源权重,MIT 协议),独立评测称其为“最强开源模型”。GLM-5.2 采用 MoE 架构,约 750B 总参数,每 token 激活 40B,价格仅为 Fable 5 的十分之一($1.40/$4.40 vs $10/$50 per 1M tokens)。在 Semgrep 的 IDOR 基准上,GLM-5.2 以 39% F1 击败 Claude Code 的 32%。但 Fable 5 在 AA-Briefcase 基准上以 1587 Elo 领先,且安全防护更强。
中文用户场景: Fable 5 擅长长上下文、agentic 任务,如代码库迁移(Stripe 用其一天完成 5000 万行 Ruby 代码迁移)、金融分析、视觉转代码等。对于国内开发者,若需处理超长上下文或复杂 agent 任务,Fable 5 仍是首选,但成本较高;GLM-5.2 则适合预算有限、需要开源可控的场景。
监管合规: 此次事件凸显了 AI 模型出口管制对全球用户的影响。国内用户使用海外模型需注意数据出境合规,而国产模型在安全审查方面更符合本地要求。
几条值得记住的细节
- Fable 5 定价:$10/百万输入 token,$50/百万输出 token,通过 July 7 前 Pro/Max/Team 计划免费使用(覆盖 50% 周配额)。
- 新安全分类器阻断率 >99%,被阻断请求自动路由到 Opus 4.8,不直接拒绝。
- 越狱严重性框架四维度:能力增益、广度、武器化难易度、可发现性。
- GLM-5.2 开源权重(MIT),1M token 上下文,价格约 $1.40/$4.40,在 IDOR 基准上 F1 39% 优于 Claude Code 的 32%。
- Fable 5 在 Hebbia 金融基准上得分最高,擅长图表、表格和文档推理。
一句话总结
Claude Fable 5 回归并加固了安全防线,但国产 GLM-5.2 以更低价格和开源优势提供了有力替代,中文用户可按需选择。