> ## Documentation Index
> Fetch the complete documentation index at: https://docs.4096bytes.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 支持的模型和价格

> 查看 4096bytes 当前展示的模型调用成本

本页按每 `1M tokens` 展示模型输入、输出、缓存、官方价格和折扣倍率，方便你把 Codex、Claude Code 或 SDK 的调用量换算成成本。

<Warning>
  模型可用范围、价格、折扣和标签可能随套餐、分组或发布时间变化。实际调用前，请以控制台当前展示为准。
</Warning>

## Claude Code - 标准

仅可在 Claude Code 中使用，Claude Code Pro + Max 号池。当前展示 `9` 个模型，折扣倍率为 `0.3x`。

| 模型名                        | 输入价格（1M tokens） | 输出价格（1M tokens） | 缓存价格（1M tokens）        | 官方价格（1M tokens） | 折扣倍率 |
| -------------------------- | --------------- | --------------- | ---------------------- | --------------- | ---- |
| claude-opus-4-8            | \$1.5           | \$7.5           | 缓存写入：$1.875；缓存读取：$0.15 | 输入：$5；输出：$25    | 0.3x |
| claude-opus-4-7            | \$1.5           | \$7.5           | 缓存写入：$1.875；缓存读取：$0.15 | 输入：$5；输出：$25    | 0.3x |
| claude-opus-4-6            | \$1.5           | \$7.5           | 缓存写入：$1.875；缓存读取：$0.15 | 输入：$5；输出：$25    | 0.3x |
| claude-opus-4-5-20251101   | \$1.5           | \$7.5           | 缓存写入：$1.875；缓存读取：$0.15 | 输入：$5；输出：$25    | 0.3x |
| claude-sonnet-4-6          | \$0.9           | \$4.5           | 缓存写入：$1.125；缓存读取：$0.09 | 输入：$3；输出：$15    | 0.3x |
| claude-sonnet-4-5-20250929 | \$0.9           | \$4.5           | 缓存写入：$1.125；缓存读取：$0.09 | 输入：$3；输出：$15    | 0.3x |
| claude-sonnet-4-20250514   | \$0.9           | \$4.5           | 缓存写入：$1.125；缓存读取：$0.09 | 输入：$3；输出：$15    | 0.3x |
| claude-haiku-4-5-20251001  | \$0.3           | \$1.5           | 缓存写入：$0.375；缓存读取：$0.03 | 输入：$1；输出：$5     | 0.3x |
| claude-haiku-4-5           | \$0.3           | \$1.5           | 缓存写入：$0.375；缓存读取：$0.03 | 输入：$1；输出：$5     | 0.3x |

## GPT Codex - 标准

支持 Codex 客户端，也支持第三方客户端。支持 `image-2` 生成图片。当前展示 `10` 个模型，折扣倍率为 `0.1x`。

| 模型名                         | 输入价格（1M tokens） | 输出价格（1M tokens） | 缓存价格（1M tokens） | 官方价格（1M tokens）  | 折扣倍率 |
| --------------------------- | --------------- | --------------- | --------------- | ---------------- | ---- |
| gpt-image-2                 | \$0.5           | \$1             | 缓存读取：\$0.125    | 输入：$5；输出：$10     | 0.1x |
| gpt-5.5-openai-compact      | \$0.5           | \$3             | 缓存读取：\$0.05     | 输入：$5；输出：$30     | 0.1x |
| gpt-5.5                     | \$0.5           | \$3             | 缓存读取：\$0.05     | 输入：$5；输出：$30     | 0.1x |
| gpt-5.4-openai-compact      | \$0.25          | \$1.5           | 缓存读取：\$0.025    | 输入：$2.5；输出：$15   | 0.1x |
| gpt-5.4-mini-openai-compact | \$0.25          | \$1.5           | 缓存读取：\$0.025    | 输入：$2.5；输出：$15   | 0.1x |
| gpt-5.4-mini                | \$0.075         | \$0.45          | 缓存读取：\$0.0075   | 输入：$0.75；输出：$4.5 | 0.1x |
| gpt-5.4                     | \$0.25          | \$1.5           | 缓存读取：\$0.025    | 输入：$2.5；输出：$15   | 0.1x |
| gpt-5.3-codex-spark         | \$0.175         | \$1.4           | 缓存读取：\$0.0175   | 输入：$1.75；输出：$14  | 0.1x |
| gpt-5.3-codex               | \$0.175         | \$1.4           | 缓存读取：\$0.0175   | 输入：$1.75；输出：$14  | 0.1x |
| codex-auto-review           | \$0.5           | \$3             | 缓存读取：\$0.05     | 输入：$5；输出：$30     | 0.1x |

## 字段说明

| 字段              | 说明                            |
| --------------- | ----------------------------- |
| 输入价格（1M tokens） | 模型处理输入内容的成本。                  |
| 输出价格（1M tokens） | 模型生成输出内容的成本。                  |
| 缓存价格（1M tokens） | 缓存写入或缓存读取的成本。不同模型可能只展示缓存读取价格。 |
| 官方价格（1M tokens） | 官方输入和输出标价，用于对比折扣后价格。          |
| 折扣倍率            | 当前分组相对官方价格的倍率。                |

## 使用建议

* 做成本估算时，先区分输入、输出、缓存写入和缓存读取量。
* 选择模型时，同时考虑价格、任务难度、响应质量和客户端支持情况。
* 在客户端或 SDK 中填写模型名时，请复制控制台展示的完整模型名。
* 如果某个 Key 所属分组不包含目标模型，请在控制台调整分组或创建新的 API Key。

## 下一步

继续 [获取 API Key](/quickstart/get-api-key)，或选择你要接入的 [客户端](/clients/codex)。
