模型定價
了解 Verdent 點數與供應商 token 定價的關係,以及在哪裡查看目前的模型費率
本頁面同時適用於 Verdent Desktop 與 Verdent for VS Code。
概覽
Verdent 整合了來自全球領先 AI 實驗室的最先進大型語言模型,包括 Anthropic(Claude)、OpenAI(GPT)、Google(Gemini)、Moonshot(Kimi)、MiniMax、DeepSeek、Qwen 與 Z.AI(GLM)。為協助使用者了解每次 AI 互動背後的成本,我們在本文件中公開 Verdent 目前內建模型陣容的供應商 token 定價。
列出的所有價格均為供應商公開的價格,以每一百萬 token(1M tokens)計的美元($)價格。此模型陣容已於 2026 年 7 月 31 日 依據 Verdent 的即時模型目錄完成驗證。
除非另有說明,表格採用各供應商的付費、標準、短上下文費率。Claude 快取寫入價格採用五分鐘快取期限。破折號(-)表示供應商未針對該項目公布獨立價格。核心定價參考資料包括 Anthropic、OpenAI、Google、Kimi、MiniMax 與 DeepSeek。
核心概念
Token
Token 是大型語言模型處理文字的基本單位。一個 token 約等於 4 個英文字元或 1 至 2 個中文字元。模型定價依據消耗的輸入與輸出 token 數量計算,兩者分別計費。
計費模式
Verdent 上的所有模型目前皆採按 token 計費模式,也就是依據每次互動實際消耗的輸入與輸出 token 數量收費。
價格組成
每個模型的定價包含以下維度:
- 輸入價格: 傳送至模型的提示詞(使用者訊息與上下文)之每 token 成本。
- 輸出價格: 模型產生回應的每 token 成本。通常高於輸入價格。
- 快取寫入價格: 部分模型支援提示詞快取。這是在首次建立快取項目時的每 token 成本。
- 快取讀取價格: 命中既有快取項目時的每 token 成本。通常遠低於標準輸入價格,可有效降低重複上下文的成本。
模型定價詳情
以下依供應商整理目前 Verdent 上所有可用模型的供應商價格。所有價格均為每 1M token 的美元價格。
Anthropic(Claude 系列)
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | $12.50 | $1.00 |
| Claude Opus 5 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Sonnet 5 | $2.00 | $10.00 | $2.50 | $0.20 |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $3.75 | $0.30 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.25 | $0.10 |
Claude Sonnet 5 採用 Anthropic 截至 2026 年 8 月 31 日的首發優惠價。Anthropic 列出的 2026 年 9 月 1 日起標準價格為:每 1M token 輸入 $3.00、輸出 $15.00、快取寫入 $3.75,以及快取讀取 $0.30。
Claude Fable 5 (claude-fable-5) Anthropic 智慧程度最高的模型,適用於最困難的知識工作、程式設計與代理任務。
Claude Opus 5 (claude-opus-5) 最新的 Opus 模型,適用於困難的多檔案功能開發、重構、深度推理與端對端代理式程式設計。
Claude Opus 4.8 (claude-opus-4-8) 高能力 Opus 模型,適用於複雜程式設計、代理任務、企業工作流程與深度多步推理。
Claude Opus 4.7 (claude-opus-4-7) 適用於長時間執行的代理、多步程式設計任務與複雜知識工作的 Opus 模型。
Claude Opus 4.6 (claude-opus-4-6) 旗艦級 Opus 模型,適用於複雜程式碼架構、深度分析與困難問題解決任務。
Claude Sonnet 5 (claude-sonnet-5) 最新 Sonnet 模型,具備自適應思考能力,適用於程式設計、代理規劃、長上下文分析與知識工作。
Claude Sonnet 4.6 (claude-sonnet-4-6) 兼具強勁效能與競爭力價格的平衡型模型;建議用於日常開發。
Claude Haiku 4.5 (claude-haiku-4-5@20251001) 快速且輕量的低延遲模型。最適合簡單對話、快速查詢與成本敏感型任務。
OpenAI(GPT 系列)
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.6 Terra | $2.00 | $12.00 | $2.50 | $0.20 |
| GPT-5.6 Luna | $0.20 | $1.20 | $0.25 | $0.02 |
| GPT-5.5 | $5.00 | $30.00 | - | $0.50 |
| GPT-5.4 | $2.50 | $15.00 | - | $0.25 |
| GPT-5.4 mini | $0.75 | $4.50 | - | $0.075 |
| GPT-5.3 Codex | $1.75 | $14.00 | - | $0.175 |
GPT-5.6 Sol (gpt-5.6-sol) 前沿 GPT-5.6 模型,適用於要求最高的代理式程式設計與推理任務。
GPT-5.6 Terra (gpt-5.6-terra) 平衡型 GPT-5.6 模型,以較低成本提供強勁的日常程式設計、工具使用與推理能力。
GPT-5.6 Luna (gpt-5.6-luna) 快速且極具成本效益的 GPT-5.6 模型,適用於例行開發、子代理與高量工作流程。
GPT-5.5 (gpt-5.5) 前沿 GPT 模型,適合推理、程式碼生成與多步分析工作負載。
GPT-5.4 (gpt-5.4) 旗艦 GPT 模型,具備強大的推理與程式碼生成品質。
GPT-5.4 mini (gpt-5.4-mini) 高效率 GPT 模型,適用於高量工作負載、子代理與成本敏感型程式設計任務。
GPT-5.3 Codex (gpt-5.3-codex) 針對程式設計任務最佳化的程式碼專用模型,包括大規模程式碼生成與重構。
Google(Gemini 系列)
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 |
Gemini 3.6 Flash (gemini-3.6-flash) 快速的前沿 Gemini 模型,具備更佳的程式設計、知識、多模態理解與 token 效率。
Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) 具成本效益的 Gemini 模型,適用於高吞吐量代理式執行與輕量工作負載。
Gemini 3.1 Pro (gemini-3.1-pro-preview) 專業級模型,具備強大推理能力,適用於複雜分析與深度思考任務。
Gemini 3 Flash (gemini-3-flash-preview) 超快速模型,具備出色的成本效益。非常適合高量批次處理。
Moonshot(Kimi 系列)
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | - | $0.30 |
| Kimi K2.7 Code | $0.95 | $4.00 | - | $0.19 |
Kimi K3 (kimi-k3) Moonshot 能力最強的程式設計模型,為複雜代理工作流程提供更可靠的長上下文能力。
Kimi K2.7 Code (kimi-k2.7-code) 專注於程式設計的 Kimi 模型,專為長上下文程式設計任務與代理式程式碼工作流程打造。
MiniMax
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| MiniMax M3 | $0.60 | $2.40 | - | $0.12 |
MiniMax M3 (MiniMax-M3) 具成本效益的長上下文模型,適用於可靠的多技能代理工作流程、工程任務與辦公自動化。
DeepSeek
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| DeepSeek V4 Pro | $0.435 | $0.87 | - | $0.003625 |
DeepSeek V4 Pro (deepseek-v4-pro) 適用於數學與邏輯推理、程式設計及長上下文分析的進階模型。
Qwen
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| Qwen3.7-Plus | $0.1794 | $0.7157 | $0.00 | $0.0364 |
Qwen3.7-Plus (qwen3.7-plus) 具成本效益的多模態模型,支援文字、圖片與影片輸入,並具備強大的代理與視覺語言能力。
Z.AI(GLM 系列)
| 模型 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|
| GLM-5.2 | $1.40 | $4.40 | - | $0.26 |
GLM-5.2 (glm-5.2) 長上下文工程模型,適用於專案規模的程式碼理解、穩定的長任務執行,以及符合標準的實作工作。
定價總覽
下表彙整目前所有已啟用模型的核心定價,依輸出價格由高至低排序,方便比較:
| 模型 | 供應商 | 輸入($/1M) | 輸出($/1M) | 快取寫入($/1M) | 快取讀取($/1M) |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | $12.50 | $1.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | - | $0.50 |
| Claude Opus 5 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| GPT-5.4 | OpenAI | $2.50 | $15.00 | - | $0.25 |
| Claude Sonnet 4.6 | Anthropic | $3.00 | $15.00 | $3.75 | $0.30 |
| Kimi K3 | Moonshot | $3.00 | $15.00 | - | $0.30 |
| GPT-5.3 Codex | OpenAI | $1.75 | $14.00 | - | $0.175 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | $2.50 | $0.20 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 | |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $2.50 | $0.20 |
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 | |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $1.25 | $0.10 |
| GPT-5.4 mini | OpenAI | $0.75 | $4.50 | - | $0.075 |
| GLM-5.2 | Z.AI | $1.40 | $4.40 | - | $0.26 |
| Kimi K2.7 Code | Moonshot | $0.95 | $4.00 | - | $0.19 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 | |
| MiniMax M3 | MiniMax | $0.60 | $2.40 | - | $0.12 |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | $0.25 | $0.02 |
| DeepSeek V4 Pro | DeepSeek | $0.435 | $0.87 | - | $0.003625 |
| Qwen3.7-Plus | Qwen | $0.1794 | $0.7157 | $0.00 | $0.0364 |