模型定价
了解 Verdent 积分与提供商 token 定价之间的关系,以及在哪里查看当前模型费率
本页适用于 Verdent Desktop 和 Verdent for VS Code。
概述
Verdent 集成了来自全球领先 AI 实验室的先进大语言模型,包括 Anthropic(Claude)、OpenAI(GPT)、Google(Gemini)、Moonshot(Kimi)、MiniMax、DeepSeek、Qwen 和 Z.AI(GLM)。为帮助用户了解每次 AI 交互背后的成本,我们在本文档中公开了 Verdent 当前内置模型阵容的提供商 token 定价。
所列所有价格均为提供商方公布的价格,单位为美元($)每百万 token(1M tokens)。模型阵容已于 2026 年 7 月 31 日根据 Verdent 实时模型目录核验。
除非另有说明,表格采用各提供商的付费 Standard 短上下文价格。Claude 的缓存写入价格采用 5 分钟缓存时长。短横线(-)表示提供商未单独公布该项价格。核心价格来源包括 Anthropic、OpenAI、Google、Kimi、MiniMax 和 DeepSeek。
关键概念
Token
Token 是大语言模型进行文本处理的基本单位。一个 token 大约相当于 4 个英文字符或 1-2 个中文字符。模型定价基于消耗的输入和输出 token 数量,两者分别计费。
计费模式
Verdent 上的所有模型目前均采用按 token 计费模式,即根据每次交互中实际消耗的输入和输出 token 数量向你计费。
价格构成
每个模型的定价由以下几个维度构成:
- 输入价格: 发送给模型的提示词(用户消息和上下文)的每 token 费用。
- 输出价格: 模型生成的响应的每 token 费用。通常高于输入价格。
- 缓存写入价格: 部分模型支持提示词缓存。这是首次创建缓存条目时的每 token 费用。
- 缓存读取价格: 命中现有缓存条目时的每 token 费用。通常远低于标准输入价格,能有效降低重复上下文的成本。
模型定价详情
以下是 Verdent 上当前可用的所有模型的提供商价格,按提供商分类整理。所有价格单位均为美元每 1M token。
Anthropic(Claude 系列)
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | $12.50 | $1.00 |
| Claude Opus 5 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Sonnet 5 | $2.00 | $10.00 | $2.50 | $0.20 |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $3.75 | $0.30 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.25 | $0.10 |
Claude Sonnet 5 使用 Anthropic 截至 2026 年 8 月 31 日的首发优惠价。Anthropic 公布的 2026 年 9 月 1 日起标准价格为:输入 $3.00、输出 $15.00、缓存写入 $3.75、缓存读取 $0.30(每 1M token)。
Claude Fable 5(claude-fable-5) Anthropic 智能水平最高的模型,适用于最困难的知识工作、编码和智能体任务。
Claude Opus 5(claude-opus-5) 最新 Opus 模型,适用于高难度多文件功能、重构、深度推理和端到端智能体编码。
Claude Opus 4.8(claude-opus-4-8) Verdent 上提供的最新 Opus 模型。专为复杂编码、智能体任务、企业级工作流和深度多步推理设计。
Claude Opus 4.7(claude-opus-4-7) 高性能 Opus 模型,适用于长时间运行的智能体、多步编码任务和复杂知识型工作。
Claude Opus 4.6(claude-opus-4-6) 旗舰级 Opus 模型,适用于复杂代码架构、深度分析和高难度问题解决任务。
Claude Sonnet 5(claude-sonnet-5) 最新 Sonnet 模型,支持自适应思考,适用于编码、智能体规划、长上下文分析和知识工作。
Claude Sonnet 4.6(claude-sonnet-4-6) 均衡型模型,性能出色且价格具有竞争力;推荐用于日常开发。
Claude Haiku 4.5(claude-haiku-4-5@20251001) 快速轻量的模型,延迟低。最适合简单对话、快速查询和成本敏感型任务。
OpenAI(GPT 系列)
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.6 Terra | $2.00 | $12.00 | $2.50 | $0.20 |
| GPT-5.6 Luna | $0.20 | $1.20 | $0.25 | $0.02 |
| GPT-5.5 | $5.00 | $30.00 | - | $0.50 |
| GPT-5.4 | $2.50 | $15.00 | - | $0.25 |
| GPT-5.4 mini | $0.75 | $4.50 | - | $0.075 |
| GPT-5.3 Codex | $1.75 | $14.00 | - | $0.175 |
GPT-5.6 Sol(gpt-5.6-sol) 面向最高难度智能体编码和推理任务的前沿 GPT-5.6 模型。
GPT-5.6 Terra(gpt-5.6-terra) 均衡型 GPT-5.6 模型,以更低成本提供强大的日常编码、工具调用和推理能力。
GPT-5.6 Luna(gpt-5.6-luna) 快速且极具成本效益的 GPT-5.6 模型,适用于常规开发、子智能体和高吞吐量工作流。
GPT-5.5(gpt-5.5) Verdent 上提供的最新 GPT 模型,适用于前沿推理、代码生成和多步分析工作负载。
GPT-5.4(gpt-5.4) 旗舰级 GPT 模型,具有出色的推理能力和代码生成质量。
GPT-5.4 mini(gpt-5.4-mini) 高效的 GPT 模型,适用于高吞吐量工作负载、子智能体和成本敏感型编码任务。
GPT-5.3 Codex(gpt-5.3-codex) 针对编程任务优化的代码专用模型,包括大规模代码生成和重构。
Google(Gemini 系列)
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 |
Gemini 3.6 Flash(gemini-3.6-flash) 快速的前沿 Gemini 模型,在编码、知识、多模态理解和 token 效率方面进一步提升。
Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite) 高性价比 Gemini 模型,适用于高吞吐量智能体执行和轻量工作负载。
Gemini 3.1 Pro(gemini-3.1-pro-preview) 专业级模型,推理能力强,适用于复杂分析和深度思考任务。
Gemini 3 Flash(gemini-3-flash-preview) 超快速模型,成本效益出色。适合高吞吐量批处理任务。
Moonshot(Kimi 系列)
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | - | $0.30 |
| Kimi K2.7 Code | $0.95 | $4.00 | - | $0.19 |
Kimi K3(kimi-k3) Moonshot 能力最强的编码模型,在复杂智能体工作流中具备更可靠的长上下文表现。
Kimi K2.7 Code(kimi-k2.7-code) Moonshot 当前专注于编码的 Kimi 模型,专为长上下文编程任务和智能体代码工作流构建。
MiniMax
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| MiniMax M3 | $0.60 | $2.40 | - | $0.12 |
MiniMax M3(MiniMax-M3) 高性价比长上下文模型,适用于可靠的多技能智能体工作流、工程任务和办公自动化。
DeepSeek
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| DeepSeek V4 Pro | $0.435 | $0.87 | - | $0.003625 |
DeepSeek V4 Pro(deepseek-v4-pro) 面向数学与逻辑推理、编码和长上下文分析的先进模型。
Qwen
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| Qwen3.7-Plus | $0.1794 | $0.7157 | $0.00 | $0.0364 |
Qwen3.7-Plus(qwen3.7-plus) 高性价比多模态模型,支持文本、图像和视频输入,具有出色的智能体和视觉语言能力。
Z.AI(GLM 系列)
| 模型 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|
| GLM-5.2 | $1.40 | $4.40 | - | $0.26 |
GLM-5.2(glm-5.2) 长上下文工程模型,适用于项目级代码理解、稳定的长任务执行和符合规范的实现工作。
定价总览
下表汇总了所有当前启用模型的核心定价,按输出价格降序排列,便于比较:
| 模型 | 提供商 | 输入 ($/1M) | 输出 ($/1M) | 缓存写入 ($/1M) | 缓存读取 ($/1M) |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | $12.50 | $1.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | - | $0.50 |
| Claude Opus 5 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| GPT-5.4 | OpenAI | $2.50 | $15.00 | - | $0.25 |
| Claude Sonnet 4.6 | Anthropic | $3.00 | $15.00 | $3.75 | $0.30 |
| Kimi K3 | Moonshot | $3.00 | $15.00 | - | $0.30 |
| GPT-5.3 Codex | OpenAI | $1.75 | $14.00 | - | $0.175 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | $2.50 | $0.20 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 | |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $2.50 | $0.20 |
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 | |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $1.25 | $0.10 |
| GPT-5.4 mini | OpenAI | $0.75 | $4.50 | - | $0.075 |
| GLM-5.2 | Z.AI | $1.40 | $4.40 | - | $0.26 |
| Kimi K2.7 Code | Moonshot | $0.95 | $4.00 | - | $0.19 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 | |
| MiniMax M3 | MiniMax | $0.60 | $2.40 | - | $0.12 |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | $0.25 | $0.02 |
| DeepSeek V4 Pro | DeepSeek | $0.435 | $0.87 | - | $0.003625 |
| Qwen3.7-Plus | Qwen | $0.1794 | $0.7157 | $0.00 | $0.0364 |