Claude Fable 5:完整规格、定价、API访问与应用场景(2026)
什么是 Claude Fable 5?
Claude Fable 5 是 Anthropic 于2026年6月9日发布的长时推理大型语言模型,具备100万Token上下文窗口,支持文本/图像输入并输出文本,API定价为每100万输入Token收取10美元、每100万输出Token收取50美元(截至2026年7月)。
Anthropic将 Claude Fable 5 定位为其最强大的广泛发布Claude模型,适用于高要求推理、编程以及长周期智能代理工作流。该模型自2026年6月9日起,通过 Claude API、AWS Claude Platform、Amazon Bedrock、Google Cloud 和 Microsoft Foundry正式开放使用。
用户通常关注 Claude Fable 5,旨在了解其更高成本、更长上下文窗口及智能代理推理能力是否适用于如自主软件开发、大型文档分析和多步骤企业知识工作等场景。相关历史Claude页面,如Claude 3.5 Sonnet模型规格,有助于团队对比早期Claude与新一代长时模型。
Claude Fable 5 的主要规格与定价
| 字段 | 数值 |
|---|---|
| 提供方 | Anthropic(截至2026年7月) |
| 模型系列 | Claude / Fable(截至2026年7月) |
| 模型类型 | 长时推理大型语言模型,支持视觉输入(截至2026年7月) |
| 发布日期 | 2026年6月9日(截至2026年7月) |
| 上下文窗口 | 标准定价下为100万Token(截至2026年7月) |
| 输入定价 | 每100万输入Token收取10美元(截至2026年7月) |
| 缓存输入定价 | 缓存命中/刷新:每100万Token收取1美元;5分钟缓存写入:每100万Token收取12.5美元;1小时缓存写入:每100万Token收取20美元(截至2026年7月) |
| 输出定价 | 每100万输出Token收取50美元(截至2026年7月) |
| 定价单位 | MTok / 100万Token(截至2026年7月) |
| 模态支持 | 支持文本与图像输入,输出文本(截至2026年7月) |
| 支持的输入类型 | 文本、图像、文件/PDF内容(Claude工具支持时);图表、图示、表格等详见Anthropic Fable页面(截至2026年7月) |
| 支持的输出类型 | 输出文本(截至2026年7月) |
| API访问 | Claude API、AWS Claude Platform、Amazon Bedrock、Google Cloud、Microsoft Foundry;Gate.AI网关访问方式见下文,需用户提供模型ID(截至2026年7月) |
| 模型ID | Claude API:claude-fable-5;Gate.AI用户提供ID:anthropic/claude-fable-5(截至2026年7月) |
| 可用性 | Claude API及各云平台全面开放;Claude.ai面向Pro、Max、Team及Enterprise用户开放(截至2026年7月) |
| 知识截止时间 | 截至2026年7月,官方未确认。 |
| 速率限制 | 截至2026年7月,官方未确认。 |
| 微调支持 | 截至2026年7月,官方未确认。 |
| 流式支持 | 通过Claude Messages流式API模式支持(截至2026年7月) |
| 批量API支持 | Claude Fable 5批量定价为每100万输入Token收取5美元、每100万输出Token收取25美元(截至2026年7月) |
| 工具/函数调用 | 与Claude Opus 4.8一致,采用Messages API及工具调用模式;代码执行工具版本已列出(截至2026年7月) |
| 结构化输出/JSON模式 | 截至2026年7月,Fable专属官方资料未确认。 |
| 许可/使用限制 | 需30天数据保留以进行安全监控;根据迁移文档,不支持零数据保留(截至2026年7月) |
Claude Fable 5 在生产环境中的主要优势
长周期智能代理工作流。 Claude Fable 5 专为多阶段任务设计,智能代理可规划、检查中间结果并持续跨长会话推进。适用于代码迁移、企业调研和项目执行,但高自主性应用仍需监控、回滚方案及评估机制。
软件工程与代码审查。 Anthropic称Fable 5适合高难度编程项目、大规模迁移及复杂实现。对于团队对比如OpenAI o3复杂问题解决模型时具有参考价值,最终选择需考虑延迟、成本、安全策略及集成需求。
大型文档与视觉分析。 Fable 5支持视觉输入,能够处理图表、图示、表格及大量文档材料。适用于技术审查、分析、架构及商业文档,但输出仍需与原始资料核对,尤其在监管或高风险领域。
超大上下文推理。 100万Token上下文窗口支持大型提示、代码库级上下文及长周期研究包。了解大上下文模型行为依然重要,因为更大窗口并不保证每个Token都能被完美推理或记忆。
Claude Fable 5 支持哪些模态?
| 模态 | 是否支持 | 说明 |
|---|---|---|
| 文本输入 | 是 | 当前所有Claude模型均支持文本输入。 |
| 图像输入/视觉 | 是 | Fable 5支持视觉,官方描述能理解图表、图示和表格。 |
| 文件/PDF分析 | Claude工作流支持文件/PDF输入时可用 | Anthropic描述文件和PDF中嵌入的表格、图示、图表。 |
| 音频输入 | 截至2026年7月,官方未确认Fable 5支持音频输入。 | 除非API接口明确支持,否则不建议假设支持音频输入。 |
| 视频输入 | 截至2026年7月,官方未确认Fable 5支持视频输入。 | 经查证资料未列为Fable 5官方输入模态。 |
| 文本输出 | 是 | 当前所有Claude模型均支持文本输出。 |
| 图像/音频/视频输出 | 截至2026年7月,官方未确认Fable 5支持上述输出。 | 除非后续文档变更,Fable 5仅支持文本输出。 |
Claude Fable 5 的局限性有哪些?
Claude Fable 5 每Token价格高于多数生产环境LLM。官方定价为每100万输入Token收取10美元、每100万输出Token收取50美元,若无缓存、批量处理、截断或路由控制,长上下文或高输出场景成本较高。
该模型还存在安全访问限制。Anthropic要求Fable需30天数据保留以便安全监控,迁移指南说明不支持零数据保留。对于严格数据保留政策的组织,这一点尤为重要。
部分规格在官方资料中尚未确认,包括知识截止时间、速率限制、微调支持及Fable专属结构化输出支持。这并不意味着功能不可用,只是未获得官方验证前不宜作为已确认特性宣传。
此外,属于通用AI局限(非模型特有):Claude Fable 5仍可能出现幻觉、误读原始资料、生成不完整代码或过度压缩上下文。法律、医疗、金融、网络安全及安全关键领域输出需专家审查与独立验证。
Claude Fable 5 最适合哪些场景?
| 应用场景 | Fable 5适用原因 | 重要限制 |
|---|---|---|
| 长时编程智能代理 | 针对高难度编程及多日自主会话设计。 | 需测试、审查及成本控制。 |
| 大型代码库迁移 | 100万Token上下文有助于纳入大量技术上下文。 | 大上下文不保证对代码库的完美理解。 |
| 企业调研与分析 | 支持复杂、多阶段知识工作。 | 必须核查引用、数据及源材料解释。 |
| 视觉文档审查 | 支持图像输入,可解读图表、图示和表格。 | OCR提取及视觉推理仍可能出错。 |
| 工具驱动智能工作流 | 支持Claude Messages API工具调用模式。 | 工具行为需沙盒隔离并监控。 |
Claude Fable 5 与 Claude Opus 4.8、Gemini 2.5 Pro 的对比
| 对比维度 | Claude Fable 5 | Claude Opus 4.8 | Gemini 2.5 Pro | 场景适配 |
|---|---|---|---|---|
| 提供方 | Anthropic | Anthropic | 比较Anthropic连续性与Google模型时适用。 | |
| 上下文窗口 | 100万Token(截至2026年7月) | 100万Token(截至2026年7月) | 1,048,576 Token(截至2026年7月) | 三者均适用于大上下文工作流。 |
| 输入/输出价格 | 每100万Token输入10美元/输出50美元(截至2026年7月) | 每100万Token输入5美元/输出25美元(截至2026年7月) | Gemini 2.5 Pro标准付费档次为≤20万Token每100万输入1.25美元/输出10美元,超出20万Token价格更高(截至2026年7月) | 成本敏感团队可考虑路由方案而非单一模型选择。 |
| 模态 | 文本/图像输入,文本输出 | 文本/图像输入,文本输出 | 文本、图像、音频、视频输入;文本输出(引用模型页面截至2026年7月) | Gemini适用于更广泛输入需求,Claude适合Claude生态工作流。 |
| 推理/智能代理能力 | 长周期智能代理及最高Claude能力。 | 复杂智能代理编程与企业工作 | 多用途编程及复杂推理模型。 | 根据工作流、治理、延迟及预算选择。 |
| 接入方式 | Claude API、主流云平台、Gate.AI网关详见下文。 | Claude API及支持平台 | Gemini API / Google Cloud。 | 平台约束可能决定部署路径。 |
没有哪款模型是“最佳”通用选择。当工作负载需要Anthropic最高能力、超长上下文及长周期智能代理时,Claude Fable 5是强力选项;Claude Opus 4.8适合追求更低价格的Anthropic团队;Gemini 2.5 Pro适合重视Google多模态输入及Gemini生态集成的团队。
如何通过 Gate.AI 接入 Claude Fable 5?
Gate.AI文档确认统一网关,支持API密钥管理、自动路由、OpenAI兼容配置及Anthropic兼容端点。标准配置使用https://api.gate.ai/openai/v1,Anthropic兼容消息端点为https://api.gate.ai/anthropic/v1/messages。Gate.AI文档还展示了提供方/模型名称格式,如anthropic/claude-sonnet-4.6;本文对应Gate.AI模型ID为anthropic/claude-fable-5。
Gate.AI价格页面说明平台价格与提供方价格同步,支持OpenAI与Anthropic协议迁移。具体Fable 5单模型价格需在Gate.AI控制台实时核查后再投入生产。
Python 示例
from openai import OpenAIimport osclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)response = client.chat.completions.create(model="anthropic/claude-fable-5",messages=[{"role": "user", "content": "Summarize the main risks in long-context AI workflows."}],)print(response.choices[0].message.content)
curl 示例
curl https://api.gate.ai/anthropic/v1/messages \-H "x-api-key: $GATEAI_API_KEY" \-H "content-type: application/json" \-H "anthropic-version: 2023-06-01" \-d '{"model": "anthropic/claude-fable-5","max_tokens": 512,"messages": [{"role": "user", "content": "Explain Claude Fable 5 in one paragraph."}]}'
通过 Gate.AI,开发者可采用网关模式实现模型路由、API密钥、用量可视化及跨OpenAI与Anthropic协议迁移,同时在部署前确保模型可用性、预算规则及合规设置。
常见问题解答
Claude Fable 5 的上下文窗口是多少?
Claude Fable 5 标准定价下上下文窗口为100万Token(截至2026年7月)。大上下文有助于处理长文档及大型代码库,但仍需检索设计、分块及输出核查。
Claude Fable 5 的价格是多少?
Anthropic公布Claude Fable 5为每100万输入Token收取10美元、每100万输出Token收取50美元(截至2026年7月)。缓存命中每100万Token收取1美元,缓存写入价格视时长而定。
开发者如何接入 Claude Fable 5?
开发者可通过 Claude API、AWS Claude Platform、Amazon Bedrock、Google Cloud 和 Microsoft Foundry接入 Claude Fable 5。本文还提供 Gate.AI 网关示例,模型ID为anthropic/claude-fable-5。
Claude Fable 5 适用于哪些场景?
Claude Fable 5 可用于长周期编程智能代理、大型文档分析、复杂企业调研、视觉文档审查及多步骤工作流。法律、医疗、金融、网络安全等高风险领域输出仍需专家审查,不可替代专业判断。


