《Claude_Fable_5》预览
记于 丙午年四月廿六 00:40
Claude Fable 5
你现在使用的模型是 Claude Fable 5,模型 ID 是 claude-fable-5。
这是 Anthropic 目前最强大、最智能的模型,定位在 Opus 之上的新层级。几个关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-fable-5(完整 ID,无日期后缀) |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 128K tokens |
| 定价 | 输入 $10 / 百万 tokens,输出 $50 / 百万 tokens |
如果你要通过 API 调用它,有两点和旧模型不同需要注意:它只支持自适应思考(thinking: {type: "adaptive"}),显式传 thinking: {type: "disabled"} 会返回 400(想关闭就直接省略该参数);采样参数 temperature、top_p、top_k 也已移除,传了同样会报错。
Claude Opus 4.8
你现在使用的模型是 Claude Opus 4.8,模型 ID 是 claude-opus-4-8。
关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-opus-4-8(完整 ID,无日期后缀) |
| 上下文窗口 | 100 万 tokens(标准定价,无长上下文溢价) |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens |
使用注意:
- 最强的 Opus 层级模型,擅长长程自主 Agent 任务、知识工作和记忆任务
- 仅支持自适应思考:
thinking: {type: "adaptive"};budget_tokens已完全移除(传了返回 400) - 采样参数
temperature、top_p、top_k已移除(传了返回 400) - 与 Opus 4.7 请求接口一致,无新增破坏性变更(迁移主要是 prompt 重新调优)
- 支持
effort级别:low/medium/high/xhigh/max(默认high,编码/Agent 任务推荐xhigh) - 输出超过 ~16K tokens 时需使用流式(
.stream()+.get_final_message())避免超时 - 支持结构化输出:
output_config: {format: {...}} - 禁止 assistant 预填充(会返回 400)
- 思考内容默认不返回文本(
display默认"omitted"),需要展示推理时设thinking: {type: "adaptive", display: "summarized"}
Claude Opus 4.7
你现在使用的模型是 Claude Opus 4.7,模型 ID 是 claude-opus-4-7。
关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-opus-4-7(完整 ID,无日期后缀) |
| 上下文窗口 | 100 万 tokens(标准定价,无长上下文溢价) |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens |
使用注意:
- 上一代 Opus 旗舰,高度自主,擅长长程 Agent 任务、知识工作、视觉任务和记忆任务
- 仅支持自适应思考:
thinking: {type: "adaptive"};budget_tokens已完全移除(传了返回 400) - 采样参数
temperature、top_p、top_k已移除(传了返回 400) - 与 Opus 4.6 相比:思考接口变更、采样参数移除是主要破坏性变更
- 支持
effort级别:low/medium/high/xhigh/max(默认high,编码/Agent 任务推荐xhigh,Claude Code 默认即xhigh) - 输出超过 ~16K tokens 时需使用流式避免超时
- 支持结构化输出:
output_config: {format: {...}} - 禁止 assistant 预填充(会返回 400)
- 思考内容默认不返回文本(
display默认"omitted"),需要展示推理时设display: "summarized" - 首个支持高分辨率视觉的 Claude 模型:长边支持到 2576 像素,坐标输出与像素 1:1(无需缩放计算)
- 支持 Task Budgets(beta
task-budgets-2026-03-13):通过output_config.task_budget给 Agent 循环设置可感知的 token 预算,最小 20K - Token 计数与 Opus 4.6 不同,相同文本在 4.7 上计数更高,需用
count_tokens()重新基准化
与 Opus 4.8 主要差别: 4.8 在 4.7 基础上无新增破坏性变更,主要是长程 Agent 能力、写作清晰度和代码审查质量进一步提升;4.7 仍是稳定可用的前代旗舰。
Claude Opus 4.6
你现在使用的模型是 Claude Opus 4.6,模型 ID 是 claude-opus-4-6。
关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-opus-4-6(完整 ID,无日期后缀) |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens |
使用注意:
- Opus 系列中首个支持自适应思考的模型,推荐使用
thinking: {type: "adaptive"} budget_tokens在 4.6 上已弃用(但仍可用作过渡逃生舱口);新代码应全部使用自适应思考- 采样参数
temperature、top_p、top_k仍然可用(这是与 4.7/4.8 的关键区别) - 支持
effort级别:low/medium/high/max(注意:不支持xhigh,这是 4.7 才引入的) - 支持 assistant 预填充(4.7 起已移除)
- 思考内容默认正常返回文本(4.7 起默认变为
"omitted") - 支持结构化输出:
output_config: {format: {...}} - 输出超过 ~16K tokens 时需使用流式避免超时
- 支持 Compaction(长对话压缩,beta)
与 4.7/4.8 相比的关键差异(向上迁移时注意):
| 特性 | Opus 4.6 | Opus 4.7+ |
|---|---|---|
budget_tokens |
弃用但可用 | 完全移除(返回 400) |
| 采样参数 | 可用 | 移除(返回 400) |
| 预填充 | 支持 | 移除(返回 400) |
xhigh effort |
不支持 | 支持 |
| 思考内容 | 默认返回文本 | 默认 "omitted" |
| Task Budgets | 不支持 | 支持(beta) |
| 高分辨率视觉 | 标准分辨率 | 长边 2576px |
Opus 4.6 是最后一个保留完整采样参数和预填充能力的 Opus 模型,适合需要这些特性的场景。
Claude Sonnet 4.6
Claude Sonnet 4.6 的关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-sonnet-4-6 |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 64K tokens |
| 定价 | 输入 $3 / 百万 tokens,输出 $15 / 百万 tokens |
使用注意:
- 支持自适应思考:
thinking: {type: "adaptive"}(推荐) budget_tokens已废弃,新代码不要使用- 默认
effort为high(从 Sonnet 4.5 迁移时注意,可能增加延迟和费用) - 支持
effort级别:low/medium/high/max - 支持结构化输出:
output_config: {format: {...}} - 禁止 assistant 预填充(会返回 400)
Claude Haiku 4.5
你现在使用的模型是 Claude Haiku 4.5,模型 ID 是 claude-haiku-4-5-20251001。
关键参数:
| 项目 | 值 |
|---|---|
| 模型 ID | claude-haiku-4-5-20251001(或简写 claude-haiku-4-5) |
| 上下文窗口 | 200K tokens |
| 最大输出 | 64K tokens |
| 定价 | 输入 $1 / 百万 tokens,输出 $5 / 百万 tokens |
使用注意:
- 最快、最经济的模型,适合简单任务和低延迟场景
- 支持自适应思考:
thinking: {type: "adaptive"} - 不支持
effort参数(会返回 400) - 支持结构化输出:
output_config: {format: {...}} - 禁止 assistant 预填充(会返回 400)
- 相比更强的 Opus/Sonnet 模型,处理复杂推理任务能力较弱
建议用途: 分类、简单提取、快速 Q&A、成本敏感的批处理、实时对话系统