# 模型定价 (/zh-CN/docs/account-billing/model-pricing)

> 了解 Verdent 积分与提供商 token 定价之间的关系，以及在哪里查看当前模型费率



<Note>
  本页适用于 Verdent Desktop 和 Verdent for VS Code。
</Note>

## 概述 [#概述]

Verdent 集成了来自全球领先 AI 实验室的先进大语言模型，包括 Anthropic（Claude）、OpenAI（GPT）、Google（Gemini）、Moonshot（Kimi）、MiniMax、DeepSeek、Qwen 和 Z.AI（GLM）。为帮助用户了解每次 AI 交互背后的成本，我们在本文档中公开了 Verdent 当前内置模型阵容的提供商 token 定价。

所列所有价格均为提供商方公布的价格，单位为美元（$）每百万 token（1M tokens）。模型阵容已于 **2026 年 7 月 31 日**根据 [Verdent 实时模型目录](https://llm-proxy.verdent.ai/config/model_list)核验。

除非另有说明，表格采用各提供商的付费 Standard 短上下文价格。Claude 的缓存写入价格采用 5 分钟缓存时长。短横线（`-`）表示提供商未单独公布该项价格。核心价格来源包括 [Anthropic](https://platform.claude.com/docs/en/about-claude/pricing)、[OpenAI](https://developers.openai.com/api/docs/pricing)、[Google](https://ai.google.dev/gemini-api/docs/pricing)、[Kimi](https://platform.kimi.ai/docs/pricing/chat-k3)、[MiniMax](https://platform.minimax.io/subscribe/token-plan?tab=api-enterprise) 和 [DeepSeek](https://api-docs.deepseek.com/quick_start/pricing)。

## 关键概念 [#关键概念]

### Token [#token]

Token 是大语言模型进行文本处理的基本单位。一个 token 大约相当于 4 个英文字符或 1-2 个中文字符。模型定价基于消耗的输入和输出 token 数量，两者分别计费。

### 计费模式 [#计费模式]

Verdent 上的所有模型目前均采用按 token 计费模式，即根据每次交互中实际消耗的输入和输出 token 数量向你计费。

### 价格构成 [#价格构成]

每个模型的定价由以下几个维度构成：

* **输入价格：** 发送给模型的提示词（用户消息和上下文）的每 token 费用。
* **输出价格：** 模型生成的响应的每 token 费用。通常高于输入价格。
* **缓存写入价格：** 部分模型支持提示词缓存。这是首次创建缓存条目时的每 token 费用。
* **缓存读取价格：** 命中现有缓存条目时的每 token 费用。通常远低于标准输入价格，能有效降低重复上下文的成本。

## 模型定价详情 [#模型定价详情]

以下是 Verdent 上当前可用的所有模型的提供商价格，按提供商分类整理。所有价格单位均为美元每 1M token。

### Anthropic（Claude 系列） [#anthropicclaude-系列]

| **模型**            | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| ----------------- | ------------- | ------------- | --------------- | --------------- |
| Claude Fable 5    | $10.00        | $50.00        | $12.50          | $1.00           |
| Claude Opus 5     | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.8   | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.7   | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.6   | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Sonnet 5   | $2.00         | $10.00        | $2.50           | $0.20           |
| Claude Sonnet 4.6 | $3.00         | $15.00        | $3.75           | $0.30           |
| Claude Haiku 4.5  | $1.00         | $5.00         | $1.25           | $0.10           |

<Note>
  Claude Sonnet 5 使用 Anthropic 截至 2026 年 8 月 31 日的首发优惠价。Anthropic 公布的 2026 年 9 月 1 日起标准价格为：输入 $3.00、输出 $15.00、缓存写入 $3.75、缓存读取 $0.30（每 1M token）。
</Note>

**Claude Fable 5**（claude-fable-5）
Anthropic 智能水平最高的模型，适用于最困难的知识工作、编码和智能体任务。

**Claude Opus 5**（claude-opus-5）
最新 Opus 模型，适用于高难度多文件功能、重构、深度推理和端到端智能体编码。

**Claude Opus 4.8**（claude-opus-4-8）
Verdent 上提供的最新 Opus 模型。专为复杂编码、智能体任务、企业级工作流和深度多步推理设计。

**Claude Opus 4.7**（claude-opus-4-7）
高性能 Opus 模型，适用于长时间运行的智能体、多步编码任务和复杂知识型工作。

**Claude Opus 4.6**（claude-opus-4-6）
旗舰级 Opus 模型，适用于复杂代码架构、深度分析和高难度问题解决任务。

**Claude Sonnet 5**（claude-sonnet-5）
最新 Sonnet 模型，支持自适应思考，适用于编码、智能体规划、长上下文分析和知识工作。

**Claude Sonnet 4.6**（claude-sonnet-4-6）
均衡型模型，性能出色且价格具有竞争力；推荐用于日常开发。

**Claude Haiku 4.5**（claude-haiku-4-5\@20251001）
快速轻量的模型，延迟低。最适合简单对话、快速查询和成本敏感型任务。

### OpenAI（GPT 系列） [#openaigpt-系列]

| **模型**        | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| ------------- | ------------- | ------------- | --------------- | --------------- |
| GPT-5.6 Sol   | $5.00         | $30.00        | $6.25           | $0.50           |
| GPT-5.6 Terra | $2.00         | $12.00        | $2.50           | $0.20           |
| GPT-5.6 Luna  | $0.20         | $1.20         | $0.25           | $0.02           |
| GPT-5.5       | $5.00         | $30.00        | -               | $0.50           |
| GPT-5.4       | $2.50         | $15.00        | -               | $0.25           |
| GPT-5.4 mini  | $0.75         | $4.50         | -               | $0.075          |
| GPT-5.3 Codex | $1.75         | $14.00        | -               | $0.175          |

**GPT-5.6 Sol**（gpt-5.6-sol）
面向最高难度智能体编码和推理任务的前沿 GPT-5.6 模型。

**GPT-5.6 Terra**（gpt-5.6-terra）
均衡型 GPT-5.6 模型，以更低成本提供强大的日常编码、工具调用和推理能力。

**GPT-5.6 Luna**（gpt-5.6-luna）
快速且极具成本效益的 GPT-5.6 模型，适用于常规开发、子智能体和高吞吐量工作流。

**GPT-5.5**（gpt-5.5）
Verdent 上提供的最新 GPT 模型，适用于前沿推理、代码生成和多步分析工作负载。

**GPT-5.4**（gpt-5.4）
旗舰级 GPT 模型，具有出色的推理能力和代码生成质量。

**GPT-5.4 mini**（gpt-5.4-mini）
高效的 GPT 模型，适用于高吞吐量工作负载、子智能体和成本敏感型编码任务。

**GPT-5.3 Codex**（gpt-5.3-codex）
针对编程任务优化的代码专用模型，包括大规模代码生成和重构。

### Google（Gemini 系列） [#googlegemini-系列]

| **模型**                | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| --------------------- | ------------- | ------------- | --------------- | --------------- |
| Gemini 3.6 Flash      | $1.50         | $7.50         | -               | $0.15           |
| Gemini 3.5 Flash-Lite | $0.30         | $2.50         | -               | $0.03           |
| Gemini 3.1 Pro        | $2.00         | $12.00        | -               | $0.20           |
| Gemini 3 Flash        | $0.50         | $3.00         | -               | $0.05           |

**Gemini 3.6 Flash**（gemini-3.6-flash）
快速的前沿 Gemini 模型，在编码、知识、多模态理解和 token 效率方面进一步提升。

**Gemini 3.5 Flash-Lite**（gemini-3.5-flash-lite）
高性价比 Gemini 模型，适用于高吞吐量智能体执行和轻量工作负载。

**Gemini 3.1 Pro**（gemini-3.1-pro-preview）
专业级模型，推理能力强，适用于复杂分析和深度思考任务。

**Gemini 3 Flash**（gemini-3-flash-preview）
超快速模型，成本效益出色。适合高吞吐量批处理任务。

### Moonshot（Kimi 系列） [#moonshotkimi-系列]

| **模型**         | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| -------------- | ------------- | ------------- | --------------- | --------------- |
| Kimi K3        | $3.00         | $15.00        | -               | $0.30           |
| Kimi K2.7 Code | $0.95         | $4.00         | -               | $0.19           |

**Kimi K3**（kimi-k3）
Moonshot 能力最强的编码模型，在复杂智能体工作流中具备更可靠的长上下文表现。

**Kimi K2.7 Code**（kimi-k2.7-code）
Moonshot 当前专注于编码的 Kimi 模型，专为长上下文编程任务和智能体代码工作流构建。

### MiniMax [#minimax]

| **模型**     | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| ---------- | ------------- | ------------- | --------------- | --------------- |
| MiniMax M3 | $0.60         | $2.40         | -               | $0.12           |

**MiniMax M3**（MiniMax-M3）
高性价比长上下文模型，适用于可靠的多技能智能体工作流、工程任务和办公自动化。

### DeepSeek [#deepseek]

| **模型**          | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| --------------- | ------------- | ------------- | --------------- | --------------- |
| DeepSeek V4 Pro | $0.435        | $0.87         | -               | $0.003625       |

**DeepSeek V4 Pro**（deepseek-v4-pro）
面向数学与逻辑推理、编码和长上下文分析的先进模型。

### Qwen [#qwen]

| **模型**       | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| ------------ | ------------- | ------------- | --------------- | --------------- |
| Qwen3.7-Plus | $0.1794       | $0.7157       | $0.00           | $0.0364         |

**Qwen3.7-Plus**（qwen3.7-plus）
高性价比多模态模型，支持文本、图像和视频输入，具有出色的智能体和视觉语言能力。

### Z.AI（GLM 系列） [#zaiglm-系列]

| **模型**  | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| ------- | ------------- | ------------- | --------------- | --------------- |
| GLM-5.2 | $1.40         | $4.40         | -               | $0.26           |

**GLM-5.2**（glm-5.2）
长上下文工程模型，适用于项目级代码理解、稳定的长任务执行和符合规范的实现工作。

## 定价总览 [#定价总览]

下表汇总了所有当前启用模型的核心定价，按输出价格降序排列，便于比较：

| **模型**                | **提供商**   | **输入 ($/1M)** | **输出 ($/1M)** | **缓存写入 ($/1M)** | **缓存读取 ($/1M)** |
| --------------------- | --------- | ------------- | ------------- | --------------- | --------------- |
| Claude Fable 5        | Anthropic | $10.00        | $50.00        | $12.50          | $1.00           |
| GPT-5.6 Sol           | OpenAI    | $5.00         | $30.00        | $6.25           | $0.50           |
| GPT-5.5               | OpenAI    | $5.00         | $30.00        | -               | $0.50           |
| Claude Opus 5         | Anthropic | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.8       | Anthropic | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.7       | Anthropic | $5.00         | $25.00        | $6.25           | $0.50           |
| Claude Opus 4.6       | Anthropic | $5.00         | $25.00        | $6.25           | $0.50           |
| GPT-5.4               | OpenAI    | $2.50         | $15.00        | -               | $0.25           |
| Claude Sonnet 4.6     | Anthropic | $3.00         | $15.00        | $3.75           | $0.30           |
| Kimi K3               | Moonshot  | $3.00         | $15.00        | -               | $0.30           |
| GPT-5.3 Codex         | OpenAI    | $1.75         | $14.00        | -               | $0.175          |
| GPT-5.6 Terra         | OpenAI    | $2.00         | $12.00        | $2.50           | $0.20           |
| Gemini 3.1 Pro        | Google    | $2.00         | $12.00        | -               | $0.20           |
| Claude Sonnet 5       | Anthropic | $2.00         | $10.00        | $2.50           | $0.20           |
| Gemini 3.6 Flash      | Google    | $1.50         | $7.50         | -               | $0.15           |
| Claude Haiku 4.5      | Anthropic | $1.00         | $5.00         | $1.25           | $0.10           |
| GPT-5.4 mini          | OpenAI    | $0.75         | $4.50         | -               | $0.075          |
| GLM-5.2               | Z.AI      | $1.40         | $4.40         | -               | $0.26           |
| Kimi K2.7 Code        | Moonshot  | $0.95         | $4.00         | -               | $0.19           |
| Gemini 3 Flash        | Google    | $0.50         | $3.00         | -               | $0.05           |
| Gemini 3.5 Flash-Lite | Google    | $0.30         | $2.50         | -               | $0.03           |
| MiniMax M3            | MiniMax   | $0.60         | $2.40         | -               | $0.12           |
| GPT-5.6 Luna          | OpenAI    | $0.20         | $1.20         | $0.25           | $0.02           |
| DeepSeek V4 Pro       | DeepSeek  | $0.435        | $0.87         | -               | $0.003625       |
| Qwen3.7-Plus          | Qwen      | $0.1794       | $0.7157       | $0.00           | $0.0364         |
