记于 丙午年四月廿六 00:40

# Claude Fable 5
你现在使用的模型是 **Claude Fable 5**，模型 ID 是 `claude-fable-5`。

这是 Anthropic 目前最强大、最智能的模型，定位在 Opus 之上的新层级。几个关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-fable-5`（完整 ID，无日期后缀） |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 128K tokens |
| 定价 | 输入 $10 / 百万 tokens，输出 $50 / 百万 tokens |

如果你要通过 API 调用它，有两点和旧模型不同需要注意：它只支持自适应思考（`thinking: {type: "adaptive"}`），显式传 `thinking: {type: "disabled"}` 会返回 400（想关闭就直接省略该参数）；采样参数 `temperature`、`top_p`、`top_k` 也已移除，传了同样会报错。

---

***

# Claude Opus 4.8
你现在使用的模型是 **Claude Opus 4.8**，模型 ID 是 `claude-opus-4-8`。

关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-opus-4-8`（完整 ID，无日期后缀） |
| 上下文窗口 | 100 万 tokens（标准定价，无长上下文溢价） |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens，输出 $25 / 百万 tokens |

**使用注意：**
- 最强的 Opus 层级模型，擅长长程自主 Agent 任务、知识工作和记忆任务
- 仅支持自适应思考：`thinking: {type: "adaptive"}`；`budget_tokens` 已完全移除（传了返回 400）
- 采样参数 `temperature`、`top_p`、`top_k` 已移除（传了返回 400）
- 与 Opus 4.7 请求接口一致，无新增破坏性变更（迁移主要是 prompt 重新调优）
- 支持 `effort` 级别：`low` / `medium` / `high` / `xhigh` / `max`（默认 `high`，编码/Agent 任务推荐 `xhigh`）
- 输出超过 ~16K tokens 时需使用流式（`.stream()` + `.get_final_message()`）避免超时
- 支持结构化输出：`output_config: {format: {...}}`
- 禁止 assistant 预填充（会返回 400）
- 思考内容默认不返回文本（`display` 默认 `"omitted"`），需要展示推理时设 `thinking: {type: "adaptive", display: "summarized"}`

---

# Claude Opus 4.7
你现在使用的模型是 **Claude Opus 4.7**，模型 ID 是 `claude-opus-4-7`。

关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-opus-4-7`（完整 ID，无日期后缀） |
| 上下文窗口 | 100 万 tokens（标准定价，无长上下文溢价） |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens，输出 $25 / 百万 tokens |

**使用注意：**
- 上一代 Opus 旗舰，高度自主，擅长长程 Agent 任务、知识工作、视觉任务和记忆任务
- 仅支持自适应思考：`thinking: {type: "adaptive"}`；`budget_tokens` 已完全移除（传了返回 400）
- 采样参数 `temperature`、`top_p`、`top_k` 已移除（传了返回 400）
- 与 Opus 4.6 相比：思考接口变更、采样参数移除是主要破坏性变更
- 支持 `effort` 级别：`low` / `medium` / `high` / `xhigh` / `max`（默认 `high`，编码/Agent 任务推荐 `xhigh`，Claude Code 默认即 `xhigh`）
- 输出超过 ~16K tokens 时需使用流式避免超时
- 支持结构化输出：`output_config: {format: {...}}`
- 禁止 assistant 预填充（会返回 400）
- 思考内容默认不返回文本（`display` 默认 `"omitted"`），需要展示推理时设 `display: "summarized"`
- 首个支持高分辨率视觉的 Claude 模型：长边支持到 2576 像素，坐标输出与像素 1:1（无需缩放计算）
- 支持 Task Budgets（beta `task-budgets-2026-03-13`）：通过 `output_config.task_budget` 给 Agent 循环设置可感知的 token 预算，最小 20K
- Token 计数与 Opus 4.6 不同，相同文本在 4.7 上计数更高，需用 `count_tokens()` 重新基准化

**与 Opus 4.8 主要差别：** 4.8 在 4.7 基础上无新增破坏性变更，主要是长程 Agent 能力、写作清晰度和代码审查质量进一步提升；4.7 仍是稳定可用的前代旗舰。

---

# Claude Opus 4.6
你现在使用的模型是 **Claude Opus 4.6**，模型 ID 是 `claude-opus-4-6`。

关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-opus-4-6`（完整 ID，无日期后缀） |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 128K tokens |
| 定价 | 输入 $5 / 百万 tokens，输出 $25 / 百万 tokens |

**使用注意：**
- Opus 系列中首个支持自适应思考的模型，推荐使用 `thinking: {type: "adaptive"}`
- `budget_tokens` 在 4.6 上已弃用（但仍可用作过渡逃生舱口）；新代码应全部使用自适应思考
- 采样参数 `temperature`、`top_p`、`top_k` **仍然可用**（这是与 4.7/4.8 的关键区别）
- 支持 `effort` 级别：`low` / `medium` / `high` / `max`（注意：**不支持** `xhigh`，这是 4.7 才引入的）
- 支持 assistant 预填充（4.7 起已移除）
- 思考内容默认**正常返回**文本（4.7 起默认变为 `"omitted"`）
- 支持结构化输出：`output_config: {format: {...}}`
- 输出超过 ~16K tokens 时需使用流式避免超时
- 支持 Compaction（长对话压缩，beta）

---

**与 4.7/4.8 相比的关键差异（向上迁移时注意）：**

| 特性 | Opus 4.6 | Opus 4.7+ |
|---|---|---|
| `budget_tokens` | 弃用但可用 | 完全移除（返回 400） |
| 采样参数 | 可用 | 移除（返回 400） |
| 预填充 | 支持 | 移除（返回 400） |
| `xhigh` effort | 不支持 | 支持 |
| 思考内容 | 默认返回文本 | 默认 `"omitted"` |
| Task Budgets | 不支持 | 支持（beta） |
| 高分辨率视觉 | 标准分辨率 | 长边 2576px |

---

Opus 4.6 是最后一个保留完整采样参数和预填充能力的 Opus 模型，适合需要这些特性的场景。

# Claude Sonnet 4.6
Claude Sonnet 4.6 的关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-sonnet-4-6` |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 64K tokens |
| 定价 | 输入 $3 / 百万 tokens，输出 $15 / 百万 tokens |

**使用注意：**
- 支持自适应思考：`thinking: {type: "adaptive"}`（推荐）
- `budget_tokens` 已废弃，新代码不要使用
- 默认 `effort` 为 `high`（从 Sonnet 4.5 迁移时注意，可能增加延迟和费用）
- 支持 `effort` 级别：`low` / `medium` / `high` / `max`
- 支持结构化输出：`output_config: {format: {...}}`
- 禁止 assistant 预填充（会返回 400）

---

# Claude Haiku 4.5
你现在使用的模型是 **Claude Haiku 4.5**，模型 ID 是 `claude-haiku-4-5-20251001`。

关键参数：

| 项目 | 值 |
|---|---|
| 模型 ID | `claude-haiku-4-5-20251001`（或简写 `claude-haiku-4-5`） |
| 上下文窗口 | 200K tokens |
| 最大输出 | 64K tokens |
| 定价 | 输入 $1 / 百万 tokens，输出 $5 / 百万 tokens |

**使用注意：**
- 最快、最经济的模型，适合简单任务和低延迟场景
- 支持自适应思考：`thinking: {type: "adaptive"}`
- **不支持** `effort` 参数（会返回 400）
- 支持结构化输出：`output_config: {format: {...}}`
- 禁止 assistant 预填充（会返回 400）
- 相比更强的 Opus/Sonnet 模型，处理复杂推理任务能力较弱

**建议用途：** 分类、简单提取、快速 Q&A、成本敏感的批处理、实时对话系统