Verdent Docs

模型定价

了解 Verdent 积分与提供商 token 定价之间的关系,以及在哪里查看当前模型费率

本页适用于 Verdent Desktop 和 Verdent for VS Code。

概述

Verdent 集成了来自全球领先 AI 实验室的先进大语言模型,包括 Anthropic(Claude)、OpenAI(GPT)、Google(Gemini)、Moonshot(Kimi)、MiniMax、DeepSeek、Qwen 和 Z.AI(GLM)。为帮助用户了解每次 AI 交互背后的成本,我们在本文档中公开了 Verdent 当前内置模型阵容的提供商 token 定价。

所列所有价格均为提供商方公布的价格,单位为美元($)每百万 token(1M tokens)。模型阵容已于 2026 年 7 月 31 日根据 Verdent 实时模型目录核验。

除非另有说明,表格采用各提供商的付费 Standard 短上下文价格。Claude 的缓存写入价格采用 5 分钟缓存时长。短横线(-)表示提供商未单独公布该项价格。核心价格来源包括 AnthropicOpenAIGoogleKimiMiniMaxDeepSeek

关键概念

Token

Token 是大语言模型进行文本处理的基本单位。一个 token 大约相当于 4 个英文字符或 1-2 个中文字符。模型定价基于消耗的输入和输出 token 数量,两者分别计费。

计费模式

Verdent 上的所有模型目前均采用按 token 计费模式,即根据每次交互中实际消耗的输入和输出 token 数量向你计费。

价格构成

每个模型的定价由以下几个维度构成:

  • 输入价格: 发送给模型的提示词(用户消息和上下文)的每 token 费用。
  • 输出价格: 模型生成的响应的每 token 费用。通常高于输入价格。
  • 缓存写入价格: 部分模型支持提示词缓存。这是首次创建缓存条目时的每 token 费用。
  • 缓存读取价格: 命中现有缓存条目时的每 token 费用。通常远低于标准输入价格,能有效降低重复上下文的成本。

模型定价详情

以下是 Verdent 上当前可用的所有模型的提供商价格,按提供商分类整理。所有价格单位均为美元每 1M token。

Anthropic(Claude 系列)

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
Claude Fable 5$10.00$50.00$12.50$1.00
Claude Opus 5$5.00$25.00$6.25$0.50
Claude Opus 4.8$5.00$25.00$6.25$0.50
Claude Opus 4.7$5.00$25.00$6.25$0.50
Claude Opus 4.6$5.00$25.00$6.25$0.50
Claude Sonnet 5$2.00$10.00$2.50$0.20
Claude Sonnet 4.6$3.00$15.00$3.75$0.30
Claude Haiku 4.5$1.00$5.00$1.25$0.10

Claude Sonnet 5 使用 Anthropic 截至 2026 年 8 月 31 日的首发优惠价。Anthropic 公布的 2026 年 9 月 1 日起标准价格为:输入 $3.00、输出 $15.00、缓存写入 $3.75、缓存读取 $0.30(每 1M token)。

Claude Fable 5(claude-fable-5) Anthropic 智能水平最高的模型,适用于最困难的知识工作、编码和智能体任务。

Claude Opus 5(claude-opus-5) 最新 Opus 模型,适用于高难度多文件功能、重构、深度推理和端到端智能体编码。

Claude Opus 4.8(claude-opus-4-8) Verdent 上提供的最新 Opus 模型。专为复杂编码、智能体任务、企业级工作流和深度多步推理设计。

Claude Opus 4.7(claude-opus-4-7) 高性能 Opus 模型,适用于长时间运行的智能体、多步编码任务和复杂知识型工作。

Claude Opus 4.6(claude-opus-4-6) 旗舰级 Opus 模型,适用于复杂代码架构、深度分析和高难度问题解决任务。

Claude Sonnet 5(claude-sonnet-5) 最新 Sonnet 模型,支持自适应思考,适用于编码、智能体规划、长上下文分析和知识工作。

Claude Sonnet 4.6(claude-sonnet-4-6) 均衡型模型,性能出色且价格具有竞争力;推荐用于日常开发。

Claude Haiku 4.5(claude-haiku-4-5@20251001) 快速轻量的模型,延迟低。最适合简单对话、快速查询和成本敏感型任务。

OpenAI(GPT 系列)

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
GPT-5.6 Sol$5.00$30.00$6.25$0.50
GPT-5.6 Terra$2.00$12.00$2.50$0.20
GPT-5.6 Luna$0.20$1.20$0.25$0.02
GPT-5.5$5.00$30.00-$0.50
GPT-5.4$2.50$15.00-$0.25
GPT-5.4 mini$0.75$4.50-$0.075
GPT-5.3 Codex$1.75$14.00-$0.175

GPT-5.6 Sol(gpt-5.6-sol) 面向最高难度智能体编码和推理任务的前沿 GPT-5.6 模型。

GPT-5.6 Terra(gpt-5.6-terra) 均衡型 GPT-5.6 模型,以更低成本提供强大的日常编码、工具调用和推理能力。

GPT-5.6 Luna(gpt-5.6-luna) 快速且极具成本效益的 GPT-5.6 模型,适用于常规开发、子智能体和高吞吐量工作流。

GPT-5.5(gpt-5.5) Verdent 上提供的最新 GPT 模型,适用于前沿推理、代码生成和多步分析工作负载。

GPT-5.4(gpt-5.4) 旗舰级 GPT 模型,具有出色的推理能力和代码生成质量。

GPT-5.4 mini(gpt-5.4-mini) 高效的 GPT 模型,适用于高吞吐量工作负载、子智能体和成本敏感型编码任务。

GPT-5.3 Codex(gpt-5.3-codex) 针对编程任务优化的代码专用模型,包括大规模代码生成和重构。

Google(Gemini 系列)

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
Gemini 3.6 Flash$1.50$7.50-$0.15
Gemini 3.5 Flash-Lite$0.30$2.50-$0.03
Gemini 3.1 Pro$2.00$12.00-$0.20
Gemini 3 Flash$0.50$3.00-$0.05

Gemini 3.6 Flash(gemini-3.6-flash) 快速的前沿 Gemini 模型,在编码、知识、多模态理解和 token 效率方面进一步提升。

Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite) 高性价比 Gemini 模型,适用于高吞吐量智能体执行和轻量工作负载。

Gemini 3.1 Pro(gemini-3.1-pro-preview) 专业级模型,推理能力强,适用于复杂分析和深度思考任务。

Gemini 3 Flash(gemini-3-flash-preview) 超快速模型,成本效益出色。适合高吞吐量批处理任务。

Moonshot(Kimi 系列)

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
Kimi K3$3.00$15.00-$0.30
Kimi K2.7 Code$0.95$4.00-$0.19

Kimi K3(kimi-k3) Moonshot 能力最强的编码模型,在复杂智能体工作流中具备更可靠的长上下文表现。

Kimi K2.7 Code(kimi-k2.7-code) Moonshot 当前专注于编码的 Kimi 模型,专为长上下文编程任务和智能体代码工作流构建。

MiniMax

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
MiniMax M3$0.60$2.40-$0.12

MiniMax M3(MiniMax-M3) 高性价比长上下文模型,适用于可靠的多技能智能体工作流、工程任务和办公自动化。

DeepSeek

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
DeepSeek V4 Pro$0.435$0.87-$0.003625

DeepSeek V4 Pro(deepseek-v4-pro) 面向数学与逻辑推理、编码和长上下文分析的先进模型。

Qwen

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
Qwen3.7-Plus$0.1794$0.7157$0.00$0.0364

Qwen3.7-Plus(qwen3.7-plus) 高性价比多模态模型,支持文本、图像和视频输入,具有出色的智能体和视觉语言能力。

Z.AI(GLM 系列)

模型输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
GLM-5.2$1.40$4.40-$0.26

GLM-5.2(glm-5.2) 长上下文工程模型,适用于项目级代码理解、稳定的长任务执行和符合规范的实现工作。

定价总览

下表汇总了所有当前启用模型的核心定价,按输出价格降序排列,便于比较:

模型提供商输入 ($/1M)输出 ($/1M)缓存写入 ($/1M)缓存读取 ($/1M)
Claude Fable 5Anthropic$10.00$50.00$12.50$1.00
GPT-5.6 SolOpenAI$5.00$30.00$6.25$0.50
GPT-5.5OpenAI$5.00$30.00-$0.50
Claude Opus 5Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.8Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.7Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.6Anthropic$5.00$25.00$6.25$0.50
GPT-5.4OpenAI$2.50$15.00-$0.25
Claude Sonnet 4.6Anthropic$3.00$15.00$3.75$0.30
Kimi K3Moonshot$3.00$15.00-$0.30
GPT-5.3 CodexOpenAI$1.75$14.00-$0.175
GPT-5.6 TerraOpenAI$2.00$12.00$2.50$0.20
Gemini 3.1 ProGoogle$2.00$12.00-$0.20
Claude Sonnet 5Anthropic$2.00$10.00$2.50$0.20
Gemini 3.6 FlashGoogle$1.50$7.50-$0.15
Claude Haiku 4.5Anthropic$1.00$5.00$1.25$0.10
GPT-5.4 miniOpenAI$0.75$4.50-$0.075
GLM-5.2Z.AI$1.40$4.40-$0.26
Kimi K2.7 CodeMoonshot$0.95$4.00-$0.19
Gemini 3 FlashGoogle$0.50$3.00-$0.05
Gemini 3.5 Flash-LiteGoogle$0.30$2.50-$0.03
MiniMax M3MiniMax$0.60$2.40-$0.12
GPT-5.6 LunaOpenAI$0.20$1.20$0.25$0.02
DeepSeek V4 ProDeepSeek$0.435$0.87-$0.003625
Qwen3.7-PlusQwen$0.1794$0.7157$0.00$0.0364