Verdent Docs

模型定價

了解 Verdent 點數與供應商 token 定價的關係,以及在哪裡查看目前的模型費率

本頁面同時適用於 Verdent Desktop 與 Verdent for VS Code。

概覽

Verdent 整合了來自全球領先 AI 實驗室的最先進大型語言模型,包括 Anthropic(Claude)、OpenAI(GPT)、Google(Gemini)、Moonshot(Kimi)、MiniMax、DeepSeek、Qwen 與 Z.AI(GLM)。為協助使用者了解每次 AI 互動背後的成本,我們在本文件中公開 Verdent 目前內建模型陣容的供應商 token 定價。

列出的所有價格均為供應商公開的價格,以每一百萬 token(1M tokens)計的美元($)價格。此模型陣容已於 2026 年 7 月 31 日 依據 Verdent 的即時模型目錄完成驗證。

除非另有說明,表格採用各供應商的付費、標準、短上下文費率。Claude 快取寫入價格採用五分鐘快取期限。破折號(-)表示供應商未針對該項目公布獨立價格。核心定價參考資料包括 AnthropicOpenAIGoogleKimiMiniMaxDeepSeek

核心概念

Token

Token 是大型語言模型處理文字的基本單位。一個 token 約等於 4 個英文字元或 1 至 2 個中文字元。模型定價依據消耗的輸入與輸出 token 數量計算,兩者分別計費。

計費模式

Verdent 上的所有模型目前皆採按 token 計費模式,也就是依據每次互動實際消耗的輸入與輸出 token 數量收費。

價格組成

每個模型的定價包含以下維度:

  • 輸入價格: 傳送至模型的提示詞(使用者訊息與上下文)之每 token 成本。
  • 輸出價格: 模型產生回應的每 token 成本。通常高於輸入價格。
  • 快取寫入價格: 部分模型支援提示詞快取。這是在首次建立快取項目時的每 token 成本。
  • 快取讀取價格: 命中既有快取項目時的每 token 成本。通常遠低於標準輸入價格,可有效降低重複上下文的成本。

模型定價詳情

以下依供應商整理目前 Verdent 上所有可用模型的供應商價格。所有價格均為每 1M token 的美元價格。

Anthropic(Claude 系列)

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
Claude Fable 5$10.00$50.00$12.50$1.00
Claude Opus 5$5.00$25.00$6.25$0.50
Claude Opus 4.8$5.00$25.00$6.25$0.50
Claude Opus 4.7$5.00$25.00$6.25$0.50
Claude Opus 4.6$5.00$25.00$6.25$0.50
Claude Sonnet 5$2.00$10.00$2.50$0.20
Claude Sonnet 4.6$3.00$15.00$3.75$0.30
Claude Haiku 4.5$1.00$5.00$1.25$0.10

Claude Sonnet 5 採用 Anthropic 截至 2026 年 8 月 31 日的首發優惠價。Anthropic 列出的 2026 年 9 月 1 日起標準價格為:每 1M token 輸入 $3.00、輸出 $15.00、快取寫入 $3.75,以及快取讀取 $0.30。

Claude Fable 5 (claude-fable-5) Anthropic 智慧程度最高的模型,適用於最困難的知識工作、程式設計與代理任務。

Claude Opus 5 (claude-opus-5) 最新的 Opus 模型,適用於困難的多檔案功能開發、重構、深度推理與端對端代理式程式設計。

Claude Opus 4.8 (claude-opus-4-8) 高能力 Opus 模型,適用於複雜程式設計、代理任務、企業工作流程與深度多步推理。

Claude Opus 4.7 (claude-opus-4-7) 適用於長時間執行的代理、多步程式設計任務與複雜知識工作的 Opus 模型。

Claude Opus 4.6 (claude-opus-4-6) 旗艦級 Opus 模型,適用於複雜程式碼架構、深度分析與困難問題解決任務。

Claude Sonnet 5 (claude-sonnet-5) 最新 Sonnet 模型,具備自適應思考能力,適用於程式設計、代理規劃、長上下文分析與知識工作。

Claude Sonnet 4.6 (claude-sonnet-4-6) 兼具強勁效能與競爭力價格的平衡型模型;建議用於日常開發。

Claude Haiku 4.5 (claude-haiku-4-5@20251001) 快速且輕量的低延遲模型。最適合簡單對話、快速查詢與成本敏感型任務。

OpenAI(GPT 系列)

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
GPT-5.6 Sol$5.00$30.00$6.25$0.50
GPT-5.6 Terra$2.00$12.00$2.50$0.20
GPT-5.6 Luna$0.20$1.20$0.25$0.02
GPT-5.5$5.00$30.00-$0.50
GPT-5.4$2.50$15.00-$0.25
GPT-5.4 mini$0.75$4.50-$0.075
GPT-5.3 Codex$1.75$14.00-$0.175

GPT-5.6 Sol (gpt-5.6-sol) 前沿 GPT-5.6 模型,適用於要求最高的代理式程式設計與推理任務。

GPT-5.6 Terra (gpt-5.6-terra) 平衡型 GPT-5.6 模型,以較低成本提供強勁的日常程式設計、工具使用與推理能力。

GPT-5.6 Luna (gpt-5.6-luna) 快速且極具成本效益的 GPT-5.6 模型,適用於例行開發、子代理與高量工作流程。

GPT-5.5 (gpt-5.5) 前沿 GPT 模型,適合推理、程式碼生成與多步分析工作負載。

GPT-5.4 (gpt-5.4) 旗艦 GPT 模型,具備強大的推理與程式碼生成品質。

GPT-5.4 mini (gpt-5.4-mini) 高效率 GPT 模型,適用於高量工作負載、子代理與成本敏感型程式設計任務。

GPT-5.3 Codex (gpt-5.3-codex) 針對程式設計任務最佳化的程式碼專用模型,包括大規模程式碼生成與重構。

Google(Gemini 系列)

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
Gemini 3.6 Flash$1.50$7.50-$0.15
Gemini 3.5 Flash-Lite$0.30$2.50-$0.03
Gemini 3.1 Pro$2.00$12.00-$0.20
Gemini 3 Flash$0.50$3.00-$0.05

Gemini 3.6 Flash (gemini-3.6-flash) 快速的前沿 Gemini 模型,具備更佳的程式設計、知識、多模態理解與 token 效率。

Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) 具成本效益的 Gemini 模型,適用於高吞吐量代理式執行與輕量工作負載。

Gemini 3.1 Pro (gemini-3.1-pro-preview) 專業級模型,具備強大推理能力,適用於複雜分析與深度思考任務。

Gemini 3 Flash (gemini-3-flash-preview) 超快速模型,具備出色的成本效益。非常適合高量批次處理。

Moonshot(Kimi 系列)

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
Kimi K3$3.00$15.00-$0.30
Kimi K2.7 Code$0.95$4.00-$0.19

Kimi K3 (kimi-k3) Moonshot 能力最強的程式設計模型,為複雜代理工作流程提供更可靠的長上下文能力。

Kimi K2.7 Code (kimi-k2.7-code) 專注於程式設計的 Kimi 模型,專為長上下文程式設計任務與代理式程式碼工作流程打造。

MiniMax

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
MiniMax M3$0.60$2.40-$0.12

MiniMax M3 (MiniMax-M3) 具成本效益的長上下文模型,適用於可靠的多技能代理工作流程、工程任務與辦公自動化。

DeepSeek

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
DeepSeek V4 Pro$0.435$0.87-$0.003625

DeepSeek V4 Pro (deepseek-v4-pro) 適用於數學與邏輯推理、程式設計及長上下文分析的進階模型。

Qwen

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
Qwen3.7-Plus$0.1794$0.7157$0.00$0.0364

Qwen3.7-Plus (qwen3.7-plus) 具成本效益的多模態模型,支援文字、圖片與影片輸入,並具備強大的代理與視覺語言能力。

Z.AI(GLM 系列)

模型輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
GLM-5.2$1.40$4.40-$0.26

GLM-5.2 (glm-5.2) 長上下文工程模型,適用於專案規模的程式碼理解、穩定的長任務執行,以及符合標準的實作工作。

定價總覽

下表彙整目前所有已啟用模型的核心定價,依輸出價格由高至低排序,方便比較:

模型供應商輸入($/1M)輸出($/1M)快取寫入($/1M)快取讀取($/1M)
Claude Fable 5Anthropic$10.00$50.00$12.50$1.00
GPT-5.6 SolOpenAI$5.00$30.00$6.25$0.50
GPT-5.5OpenAI$5.00$30.00-$0.50
Claude Opus 5Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.8Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.7Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.6Anthropic$5.00$25.00$6.25$0.50
GPT-5.4OpenAI$2.50$15.00-$0.25
Claude Sonnet 4.6Anthropic$3.00$15.00$3.75$0.30
Kimi K3Moonshot$3.00$15.00-$0.30
GPT-5.3 CodexOpenAI$1.75$14.00-$0.175
GPT-5.6 TerraOpenAI$2.00$12.00$2.50$0.20
Gemini 3.1 ProGoogle$2.00$12.00-$0.20
Claude Sonnet 5Anthropic$2.00$10.00$2.50$0.20
Gemini 3.6 FlashGoogle$1.50$7.50-$0.15
Claude Haiku 4.5Anthropic$1.00$5.00$1.25$0.10
GPT-5.4 miniOpenAI$0.75$4.50-$0.075
GLM-5.2Z.AI$1.40$4.40-$0.26
Kimi K2.7 CodeMoonshot$0.95$4.00-$0.19
Gemini 3 FlashGoogle$0.50$3.00-$0.05
Gemini 3.5 Flash-LiteGoogle$0.30$2.50-$0.03
MiniMax M3MiniMax$0.60$2.40-$0.12
GPT-5.6 LunaOpenAI$0.20$1.20$0.25$0.02
DeepSeek V4 ProDeepSeek$0.435$0.87-$0.003625
Qwen3.7-PlusQwen$0.1794$0.7157$0.00$0.0364