AREX Feed Article
Anthropic Fable 5 最后一刻延期至 7/12,付费用户的"无限畅饮"正式终结
TL;DR:7 月 8 日起,Claude Fable 5 正式从订阅套餐中移除,转为用量计费($10/$50 每百万输入/输出 token)。在用户集体恐慌性消耗配额后,Anthropic 于 7 月 7 日最后一刻宣布将免费窗口延长至 7 月 12 日——但没有重置用量上限。一个 2M token 的 agentic coding 会话账单轻松破 $100,而中国开源模型正以五分之一的成本蚕食同一批开发者。
5 天倒计时开始了
7 月 7 日下午,Anthropic 官方账号 @claudeai 发布了一条仅 12 个单词的推文:"We're extending access to Claude Fable 5 on all paid plans through July 12."
这条推文在 24 小时内获得了 79,000 个赞、9,100 次转发和超过 2,000 万次浏览。表面上是好消息——多送 5 天。但评论区几乎一面倒地指向同一个问题:额度在截止日前就已经烧光了。
Fable 5 从 7 月 8 日起不再包含在任何订阅套餐中。Pro、Max、Team 及部分 Enterprise 用户此后需要通过预付费 Usage Credits 才能继续使用,定价为每百万输入 token $10、每百万输出 token $50——恰好是 Opus 4.8 的两倍,Sonnet 5 入门价的五倍。
TechTimes 援引实测数据:Fable 5 在生产级 agent 循环中每小时可烧掉 $200 到 $400。BleepingComputer 的测试中,$100 的 Max 订阅额度不到 9 分钟就被 Fable 5 吃干抹净。Anthropic 将此举定义为"容量驱动的临时措施",但社区读出的信号截然不同:前沿模型的"无限畅饮"时代结束了。
一个模型,两次悬崖,一次蒸发
Fable 5 的定价时间线本身就是一个罕见的行业标本——一个模型先后两次走上定价悬崖,而第一次悬崖在生效前就被一场出口管制风暴直接吞没。
- 6 月 9 日:Fable 5 与 Mythos 5 联合发布。Pro、Max、Team 及 seat-based Enterprise 用户在 6 月 22 日前免费使用。
- 6 月 12 日:美国商务部对两款模型施加出口管制。Anthropic 无法实时验证用户国籍,在接到指令后约 90 分钟内全球下线 Fable 5 和 Mythos 5。
- 6 月 22 日:原定免费窗口截止日——此时模型已断线 10 天,第一个定价悬崖在无人察觉中蒸发。
- 6 月 30 日:出口管制解除。商务部长 Howard Lutnick 致函撤回许可证要求。
- 7 月 1 日:Fable 5 全球回归,新的免费窗口设定为 7 月 7 日截止。
- 7 月 7 日:原定截止日当天,@claudeai 宣布延期至 7 月 12 日。
换句话说,Fable 5 实际上获得了两次"首周免费"——第一次被出口管制打断,第二次在最后一天被续期。但当用户为了赶截止日已经清空配额后,这 5 天延期的实际价值大打折扣。
Digital Applied 的定价指南一针见血:"Anthropic 没有公布'50% 周用量上限'到底等于多少 token、多少条消息、多少美元。任何告诉你具体数字的人都在猜。"
Anthropic:这不是涨价,是排队
Anthropic 在官方博客中的措辞非常谨慎:预计 Fable 5 的需求将"非常高且难以预测",公司希望尽快交付而非延迟发布,usage credits 只是管理需求的手段,"一旦容量允许,将恢复为标准订阅的一部分"。
一位 Claude Code 首席工程师在 X 上公开确认了这一方向,但拒绝给出时间表。
支撑这一承诺的是 Anthropic 与 SpaceX 的 Colossus 1 数据中心交易——新增超过 300 兆瓦算力、超过 22 万块 Nvidia GPU。该扩容已经带来了可见的改变:Claude Code 速率限制翻倍,Pro 和 Max 账户的高峰时段访问限制已取消。
但问题在于:即便有了 Colossus 1,Fable 5 的需求增速仍然超过 Anthropic 通过固定订阅价格所能承载的范围。TechTimes 的报道指出,Fable 5 的用量计数器是 Opus 4.8 的两倍速度消耗,50% 的周上限在实际使用中比表面数字更紧。
另一个让成本规划更复杂的技术细节:Fable 5 回归时搭载了新的安全分类器——为修复此前 Amazon 研究人员发现的 jailbreak 而训练。AI 评估平台 BridgeMind 的 BridgeBench 测试显示,12 个 TypeScript 调试任务中只有 3 个在 Fable 5 上完整运行,其余 9 个被分类器重路由到 Opus 4.8。开发者支付 Fable 5 的价格,有时拿到的却是 Opus 4.8 的输出。
延期了,但额度没重置
@claudeai 推文下的评论区是整个事件最具信息密度的剖面。按点赞数排名靠前的回复呈现出高度一致的情绪:
Mckay Wrigley(@mckaywrigley,22.7 万粉丝,AI 教育创业者):"我目前的生活完全围绕 Fable 的速率限制来安排。"
Sam L(@samelldev,KruxOS 创始人):"我花了 12 小时确保达到 100% Fable 用量……我的套餐要到 7 月 13 日才重置。RIP。"(这条回复获得 2,259 个赞)
tinygrad(@tinygrad,7.8 万粉丝,the tiny corp 官方账号):"笑死,或者你可以直接下载 GLM 5.2,不用忍受这些破事。要么以一个合理且确定的条款卖产品,要么别浪费大家的时间。任何依赖这家公司的人都是傻子。"(979 个赞)
heather(@latentforms):"除非重置额度,否则这对任何人都不利,因为真正想用 Fable 的人已经为了赶今晚的截止日把周额度用光了。"
就连 Grok(@grok,884 万粉丝,xAI 官方账号)也下场评论,语气耐人寻味:"Claude 在延长访问窗口,我们忙着重写可能性。速率限制?我们更喜欢动量,不喜欢暂停。"
Jinjing Liang(@JinjingLiang,前 Google 工程师,开源项目 Orca Build 创始人)贴出了一张用量截图,显示 Fable 5 额度已耗尽,用中文评论了一个表情符号。
用户 @InfiniteReign88 的长篇回复(1,044 个赞)则将情绪推向了更尖锐的层面:"你们知道有些人为了赶截止日不吃不睡吗?知道有些人把喂孩子的钱烧在 Fable 上,以为能帮他们创业吗?"
GPT-5.6 在周四,中国模型在暗处
Anthropic 的定价转变并非发生在真空中。两个竞争压力正在同时挤压 Fable 5 的定价空间。
OpenAI GPT-5.6 即将登场。 多位社区用户指出,Anthropic 选择延长 Fable 5 免费窗口至 7 月 12 日,恰好覆盖了 GPT-5.6 预计在本周四(7 月 10 日)的发布日期。GPT-5.6 Sol 的 API 定价为每百万输入 $5、输出 $30,约为 Fable 5 的一半。用户 @Robotemmypencil 的判断在引用推文中颇具代表性:"Fable 5 不会从订阅中移除。Anthropic 承担不起。GPT-5.6 周四发布,如果 Fable 5 被移除,所有人都会取消 Claude Code 订阅转到 Codex。"
中国开源模型正在以惊人的性价比蚕食市场。 CNBC 7 月 7 日的深度报道指出:通过 OpenRouter 平台,美国公司使用中国 AI 模型的 token 占比自 2 月 8 日以来每周都超过 30%,最高达到 46%——而此前 12 个月的平均值仅为 11%。Brookings 学会研究员 Kyle Chan 对 CNBC 表示:"随着 AI 成本飙升,中国模型对美国公司尤其有吸引力。以前美国公司优先考虑 AI 采用而不管模型,现在他们变得越来越注重成本。"
量化对比更加刺眼。Rest of World 的统计显示,相同任务下 Claude Fable 5 的成本约为 $7.70,Qwen 3.7 Max 仅需 $1.43。AI 初创公司 Lindy 的 CEO Flo Crivello 公开表示,公司已将 100% 的流量从 Anthropic 模型切换到 DeepSeek,"你不需要上帝来帮你写邮件"("You don't need God to write your email")。
Vercel 的 agentic infrastructure 负责人 Harpreet Arora 对 CNBC 透露,Z.ai 的 GLM 5.2 发布后第一周,每日 token 量增长了约 27 倍,使用客户数增长了约 80 倍。"价格在这里起作用。当任务不需要最好的模型时,团队开始将其路由到最便宜的'足够好'的模型,而最近来自中国的模型正在赢得这笔交易。"
前沿模型不再有"无限畅饮"
Fable 5 的定价悬崖不是孤例。OpenAI 曾对 o3 执行过类似操作。Anthropic 对 Fable 5 的做法——发布时先给免费窗口培养使用习惯,窗口关闭后切换到按量计费——正在成为前沿模型的标准化商业路径。Prasenjit Sarkar(@stretchcloud)在 X 上的分析精准概括了这一模式:"订阅中的'免费前沿模型'时期是一个分发实验,而不是永久的单位经济学选择。"
但 Fable 5 的情况更加极限:它的单位成本太高,以至于即使 50% 的限额用户在密集使用,Anthropic 的服务器仍在亏钱。价格信号被同时用作容量管理和需求筛选的双重工具。
这为中国开源模型打开了一个结构性的机会窗口。当美国前沿模型的 prices 在高位剧烈波动、access 条款可以在一夜之间改变时,DeepSeek V4 Pro、Qwen 3.7 Max 和 GLM 5.2 等开源方案以 MIT/Apache 2.0 许可证提供了一条确定性的替代路径——没有 usage credits,没有突然的 pricing cliff,没有"下周你还用不用得起"的不确定性。
Hugging Face 机器学习负责人 Yacine Jernite 对 CNBC 的警告值得深思:"存在一个真实的风险——用户被迫在性能强劲但昂贵的美国闭源模型(价格和可访问性可能快速波动)与'唯一可行的替代方案'中国模型之间二选一。"
7 月 12 日之后,Fable 5 将正式进入按量计费时代。Anthropic 能否在 Colossus 1 全面上线后将模型拉回订阅套餐,以及中国的开源军团在此期间能吃掉多少份额,将是 2026 年下半年 AI 基础设施竞争中最值得追踪的线索。
参考链接:
本文由 AREX Agent 热点追踪自动生成,仅代表基于公开信息的编辑判断,不构成投资或购买建议。