新模型
2026-09-02
🔥 重点
Anthropic 发布 Fable 5.1:号称「全球最强编程模型」,缓存价直降 75%
来源:界面新闻
Anthropic 发布 Fable 5.1:号称「全球最强编程模型」,缓存价直降 75%
一句话说清:Claude 的母公司 Anthropic 发了新旗舰 Fable 5.1,主打「长时间写代码、做研究」,而且把「重复读上下文」的缓存费砍了 75%,用起来更便宜了。
发生了什么
当地时间 9 月 1 日,Anthropic 发布两款新模型 Claude Fable 5.1 和 Claude Mythos 5.1,官方自称是「全球最先进的编程与知识工作模型」:
- 同一底座、两套护栏:Fable 5.1 面向所有用户开放;Mythos 5.1 只在「可信访问计划」里给审核过的网络安全和生命科学机构用,能力更强但限制更松。
- 成本大降:缓存读取(Cache Read,即重复读取已处理过的长上下文)价格从每百万 token 1 美元降到 0.25 美元,降幅 75%。Anthropic 测算典型任务成本比上代低约 25%,重度智能体任务最高省 45%。
- 长上下文:保持 100 万 token 上下文窗口、最大 12.8 万 token 输出;基础价不变(输入 10 美元 / 输出 50 美元每百万 token)。
- 能力跃升:科研基准 Terminal-Bench-Science 0.1 从 Fable 5 的 24.7% 涨到 52.6%;更擅长连续数小时完成编程、研究这类多步骤任务,并自己验证结果。
- 上架渠道:Claude API、AWS Bedrock、Google Vertex AI、Microsoft Foundry 均已可用。
来源:Anthropic 官方公告,多家媒体交叉报道(2026-09-02)。注:The Hindu 等外媒从本机环境无法直连,以下附国内可访问来源。
对我有什么用
- 头部模型竞争从「拼分数」转向「拼性价比」——能力差不多时,谁更便宜、更适合长任务,谁就赢。
- 缓存降价对写代码、跑智能体、长文档对话影响最大,因为这些场景要反复读同一大段上下文。
- 「同一模型 + 两套安全策略」成了大厂发布强模型的新常态:公开版严、机构版松。
我可以怎么做
- 直接用 Claude(网页/App)写代码、改 bug、做长文研究:现在长对话更省,体验更顺。
- 如果你用 Claude Code 或各类 AI 编程助手:这次降价主要惠及这类「反复读代码库」的场景,实际账单会明显变低。
- 想省钱:把「参考资料」放进对话开头让它缓存,比每次全量重发更划算;简单任务用低推理强度(Low/Medium)就能达到上代高强度的效果。
温馨提醒
- 价格仍偏高:输入 10 美元、输出 50 美元 / 百万 token,属于高端档;日常轻度使用可对比 Gemini Flash、通义千问等更便宜的模型。
- Mythos 5.1 不对外开放:普通用户用不到,别被「更强」误导去找破解。
- 官方称加了不可见水印(配合欧盟 AI 法案),不影响正常使用,但别拿它生成违规内容。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法