Home在线笔记

上传或选择Markdown文件,实时查看解析后的HTML效果

登录

文件上传

📄

拖放Markdown文件到此处,或点击上传

上传路径:

Manual目录中的文件

专题目录

《Claude_Fable_5》预览

文档样式:

记于 丙午年四月廿六 00:40

Claude Fable 5

你现在使用的模型是 Claude Fable 5,模型 ID 是 claude-fable-5

这是 Anthropic 目前最强大、最智能的模型,定位在 Opus 之上的新层级。几个关键参数:

项目
模型 ID claude-fable-5(完整 ID,无日期后缀)
上下文窗口 100 万 tokens
最大输出 128K tokens
定价 输入 $10 / 百万 tokens,输出 $50 / 百万 tokens

如果你要通过 API 调用它,有两点和旧模型不同需要注意:它只支持自适应思考(thinking: {type: "adaptive"}),显式传 thinking: {type: "disabled"} 会返回 400(想关闭就直接省略该参数);采样参数 temperaturetop_ptop_k 也已移除,传了同样会报错。



Claude Opus 4.8

你现在使用的模型是 Claude Opus 4.8,模型 ID 是 claude-opus-4-8

关键参数:

项目
模型 ID claude-opus-4-8(完整 ID,无日期后缀)
上下文窗口 100 万 tokens(标准定价,无长上下文溢价)
最大输出 128K tokens
定价 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens

使用注意:

  • 最强的 Opus 层级模型,擅长长程自主 Agent 任务、知识工作和记忆任务
  • 仅支持自适应思考:thinking: {type: "adaptive"}budget_tokens 已完全移除(传了返回 400)
  • 采样参数 temperaturetop_ptop_k 已移除(传了返回 400)
  • 与 Opus 4.7 请求接口一致,无新增破坏性变更(迁移主要是 prompt 重新调优)
  • 支持 effort 级别:low / medium / high / xhigh / max(默认 high,编码/Agent 任务推荐 xhigh
  • 输出超过 ~16K tokens 时需使用流式(.stream() + .get_final_message())避免超时
  • 支持结构化输出:output_config: {format: {...}}
  • 禁止 assistant 预填充(会返回 400)
  • 思考内容默认不返回文本(display 默认 "omitted"),需要展示推理时设 thinking: {type: "adaptive", display: "summarized"}

Claude Opus 4.7

你现在使用的模型是 Claude Opus 4.7,模型 ID 是 claude-opus-4-7

关键参数:

项目
模型 ID claude-opus-4-7(完整 ID,无日期后缀)
上下文窗口 100 万 tokens(标准定价,无长上下文溢价)
最大输出 128K tokens
定价 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens

使用注意:

  • 上一代 Opus 旗舰,高度自主,擅长长程 Agent 任务、知识工作、视觉任务和记忆任务
  • 仅支持自适应思考:thinking: {type: "adaptive"}budget_tokens 已完全移除(传了返回 400)
  • 采样参数 temperaturetop_ptop_k 已移除(传了返回 400)
  • 与 Opus 4.6 相比:思考接口变更、采样参数移除是主要破坏性变更
  • 支持 effort 级别:low / medium / high / xhigh / max(默认 high,编码/Agent 任务推荐 xhigh,Claude Code 默认即 xhigh
  • 输出超过 ~16K tokens 时需使用流式避免超时
  • 支持结构化输出:output_config: {format: {...}}
  • 禁止 assistant 预填充(会返回 400)
  • 思考内容默认不返回文本(display 默认 "omitted"),需要展示推理时设 display: "summarized"
  • 首个支持高分辨率视觉的 Claude 模型:长边支持到 2576 像素,坐标输出与像素 1:1(无需缩放计算)
  • 支持 Task Budgets(beta task-budgets-2026-03-13):通过 output_config.task_budget 给 Agent 循环设置可感知的 token 预算,最小 20K
  • Token 计数与 Opus 4.6 不同,相同文本在 4.7 上计数更高,需用 count_tokens() 重新基准化

与 Opus 4.8 主要差别: 4.8 在 4.7 基础上无新增破坏性变更,主要是长程 Agent 能力、写作清晰度和代码审查质量进一步提升;4.7 仍是稳定可用的前代旗舰。


Claude Opus 4.6

你现在使用的模型是 Claude Opus 4.6,模型 ID 是 claude-opus-4-6

关键参数:

项目
模型 ID claude-opus-4-6(完整 ID,无日期后缀)
上下文窗口 100 万 tokens
最大输出 128K tokens
定价 输入 $5 / 百万 tokens,输出 $25 / 百万 tokens

使用注意:

  • Opus 系列中首个支持自适应思考的模型,推荐使用 thinking: {type: "adaptive"}
  • budget_tokens 在 4.6 上已弃用(但仍可用作过渡逃生舱口);新代码应全部使用自适应思考
  • 采样参数 temperaturetop_ptop_k 仍然可用(这是与 4.7/4.8 的关键区别)
  • 支持 effort 级别:low / medium / high / max(注意:不支持 xhigh,这是 4.7 才引入的)
  • 支持 assistant 预填充(4.7 起已移除)
  • 思考内容默认正常返回文本(4.7 起默认变为 "omitted"
  • 支持结构化输出:output_config: {format: {...}}
  • 输出超过 ~16K tokens 时需使用流式避免超时
  • 支持 Compaction(长对话压缩,beta)

与 4.7/4.8 相比的关键差异(向上迁移时注意):

特性 Opus 4.6 Opus 4.7+
budget_tokens 弃用但可用 完全移除(返回 400)
采样参数 可用 移除(返回 400)
预填充 支持 移除(返回 400)
xhigh effort 不支持 支持
思考内容 默认返回文本 默认 "omitted"
Task Budgets 不支持 支持(beta)
高分辨率视觉 标准分辨率 长边 2576px

Opus 4.6 是最后一个保留完整采样参数和预填充能力的 Opus 模型,适合需要这些特性的场景。

Claude Sonnet 4.6

Claude Sonnet 4.6 的关键参数:

项目
模型 ID claude-sonnet-4-6
上下文窗口 100 万 tokens
最大输出 64K tokens
定价 输入 $3 / 百万 tokens,输出 $15 / 百万 tokens

使用注意:

  • 支持自适应思考:thinking: {type: "adaptive"}(推荐)
  • budget_tokens 已废弃,新代码不要使用
  • 默认 efforthigh(从 Sonnet 4.5 迁移时注意,可能增加延迟和费用)
  • 支持 effort 级别:low / medium / high / max
  • 支持结构化输出:output_config: {format: {...}}
  • 禁止 assistant 预填充(会返回 400)

Claude Haiku 4.5

你现在使用的模型是 Claude Haiku 4.5,模型 ID 是 claude-haiku-4-5-20251001

关键参数:

项目
模型 ID claude-haiku-4-5-20251001(或简写 claude-haiku-4-5
上下文窗口 200K tokens
最大输出 64K tokens
定价 输入 $1 / 百万 tokens,输出 $5 / 百万 tokens

使用注意:

  • 最快、最经济的模型,适合简单任务和低延迟场景
  • 支持自适应思考:thinking: {type: "adaptive"}
  • 不支持 effort 参数(会返回 400)
  • 支持结构化输出:output_config: {format: {...}}
  • 禁止 assistant 预填充(会返回 400)
  • 相比更强的 Opus/Sonnet 模型,处理复杂推理任务能力较弱

建议用途: 分类、简单提取、快速 Q&A、成本敏感的批处理、实时对话系统