# 模型定價 (/zh-Hant/docs/account-billing/model-pricing)

> 了解 Verdent 點數與供應商 token 定價的關係，以及在哪裡查看目前的模型費率



<Note>
  本頁面同時適用於 Verdent Desktop 與 Verdent for VS Code。
</Note>

## 概覽 [#概覽]

Verdent 整合了來自全球領先 AI 實驗室的最先進大型語言模型，包括 Anthropic（Claude）、OpenAI（GPT）、Google（Gemini）、Moonshot（Kimi）、MiniMax、DeepSeek、Qwen 與 Z.AI（GLM）。為協助使用者了解每次 AI 互動背後的成本，我們在本文件中公開 Verdent 目前內建模型陣容的供應商 token 定價。

列出的所有價格均為供應商公開的價格，以每一百萬 token（1M tokens）計的美元（$）價格。此模型陣容已於 **2026 年 7 月 31 日** 依據 [Verdent 的即時模型目錄](https://llm-proxy.verdent.ai/config/model_list)完成驗證。

除非另有說明，表格採用各供應商的付費、標準、短上下文費率。Claude 快取寫入價格採用五分鐘快取期限。破折號（`-`）表示供應商未針對該項目公布獨立價格。核心定價參考資料包括 [Anthropic](https://platform.claude.com/docs/en/about-claude/pricing)、[OpenAI](https://developers.openai.com/api/docs/pricing)、[Google](https://ai.google.dev/gemini-api/docs/pricing)、[Kimi](https://platform.kimi.ai/docs/pricing/chat-k3)、[MiniMax](https://platform.minimax.io/subscribe/token-plan?tab=api-enterprise) 與 [DeepSeek](https://api-docs.deepseek.com/quick_start/pricing)。

## 核心概念 [#核心概念]

### Token [#token]

Token 是大型語言模型處理文字的基本單位。一個 token 約等於 4 個英文字元或 1 至 2 個中文字元。模型定價依據消耗的輸入與輸出 token 數量計算，兩者分別計費。

### 計費模式 [#計費模式]

Verdent 上的所有模型目前皆採按 token 計費模式，也就是依據每次互動實際消耗的輸入與輸出 token 數量收費。

### 價格組成 [#價格組成]

每個模型的定價包含以下維度：

* **輸入價格：** 傳送至模型的提示詞（使用者訊息與上下文）之每 token 成本。
* **輸出價格：** 模型產生回應的每 token 成本。通常高於輸入價格。
* **快取寫入價格：** 部分模型支援提示詞快取。這是在首次建立快取項目時的每 token 成本。
* **快取讀取價格：** 命中既有快取項目時的每 token 成本。通常遠低於標準輸入價格，可有效降低重複上下文的成本。

## 模型定價詳情 [#模型定價詳情]

以下依供應商整理目前 Verdent 上所有可用模型的供應商價格。所有價格均為每 1M token 的美元價格。

### Anthropic（Claude 系列） [#anthropicclaude-系列]

| **模型**            | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| ----------------- | ------------ | ------------ | -------------- | -------------- |
| Claude Fable 5    | $10.00       | $50.00       | $12.50         | $1.00          |
| Claude Opus 5     | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.8   | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.7   | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.6   | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Sonnet 5   | $2.00        | $10.00       | $2.50          | $0.20          |
| Claude Sonnet 4.6 | $3.00        | $15.00       | $3.75          | $0.30          |
| Claude Haiku 4.5  | $1.00        | $5.00        | $1.25          | $0.10          |

<Note>
  Claude Sonnet 5 採用 Anthropic 截至 2026 年 8 月 31 日的首發優惠價。Anthropic 列出的 2026 年 9 月 1 日起標準價格為：每 1M token 輸入 $3.00、輸出 $15.00、快取寫入 $3.75，以及快取讀取 $0.30。
</Note>

**Claude Fable 5** (claude-fable-5)
Anthropic 智慧程度最高的模型，適用於最困難的知識工作、程式設計與代理任務。

**Claude Opus 5** (claude-opus-5)
最新的 Opus 模型，適用於困難的多檔案功能開發、重構、深度推理與端對端代理式程式設計。

**Claude Opus 4.8** (claude-opus-4-8)
高能力 Opus 模型，適用於複雜程式設計、代理任務、企業工作流程與深度多步推理。

**Claude Opus 4.7** (claude-opus-4-7)
適用於長時間執行的代理、多步程式設計任務與複雜知識工作的 Opus 模型。

**Claude Opus 4.6** (claude-opus-4-6)
旗艦級 Opus 模型，適用於複雜程式碼架構、深度分析與困難問題解決任務。

**Claude Sonnet 5** (claude-sonnet-5)
最新 Sonnet 模型，具備自適應思考能力，適用於程式設計、代理規劃、長上下文分析與知識工作。

**Claude Sonnet 4.6** (claude-sonnet-4-6)
兼具強勁效能與競爭力價格的平衡型模型；建議用於日常開發。

**Claude Haiku 4.5** (claude-haiku-4-5\@20251001)
快速且輕量的低延遲模型。最適合簡單對話、快速查詢與成本敏感型任務。

### OpenAI（GPT 系列） [#openaigpt-系列]

| **模型**        | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| ------------- | ------------ | ------------ | -------------- | -------------- |
| GPT-5.6 Sol   | $5.00        | $30.00       | $6.25          | $0.50          |
| GPT-5.6 Terra | $2.00        | $12.00       | $2.50          | $0.20          |
| GPT-5.6 Luna  | $0.20        | $1.20        | $0.25          | $0.02          |
| GPT-5.5       | $5.00        | $30.00       | -              | $0.50          |
| GPT-5.4       | $2.50        | $15.00       | -              | $0.25          |
| GPT-5.4 mini  | $0.75        | $4.50        | -              | $0.075         |
| GPT-5.3 Codex | $1.75        | $14.00       | -              | $0.175         |

**GPT-5.6 Sol** (gpt-5.6-sol)
前沿 GPT-5.6 模型，適用於要求最高的代理式程式設計與推理任務。

**GPT-5.6 Terra** (gpt-5.6-terra)
平衡型 GPT-5.6 模型，以較低成本提供強勁的日常程式設計、工具使用與推理能力。

**GPT-5.6 Luna** (gpt-5.6-luna)
快速且極具成本效益的 GPT-5.6 模型，適用於例行開發、子代理與高量工作流程。

**GPT-5.5** (gpt-5.5)
前沿 GPT 模型，適合推理、程式碼生成與多步分析工作負載。

**GPT-5.4** (gpt-5.4)
旗艦 GPT 模型，具備強大的推理與程式碼生成品質。

**GPT-5.4 mini** (gpt-5.4-mini)
高效率 GPT 模型，適用於高量工作負載、子代理與成本敏感型程式設計任務。

**GPT-5.3 Codex** (gpt-5.3-codex)
針對程式設計任務最佳化的程式碼專用模型，包括大規模程式碼生成與重構。

### Google（Gemini 系列） [#googlegemini-系列]

| **模型**                | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| --------------------- | ------------ | ------------ | -------------- | -------------- |
| Gemini 3.6 Flash      | $1.50        | $7.50        | -              | $0.15          |
| Gemini 3.5 Flash-Lite | $0.30        | $2.50        | -              | $0.03          |
| Gemini 3.1 Pro        | $2.00        | $12.00       | -              | $0.20          |
| Gemini 3 Flash        | $0.50        | $3.00        | -              | $0.05          |

**Gemini 3.6 Flash** (gemini-3.6-flash)
快速的前沿 Gemini 模型，具備更佳的程式設計、知識、多模態理解與 token 效率。

**Gemini 3.5 Flash-Lite** (gemini-3.5-flash-lite)
具成本效益的 Gemini 模型，適用於高吞吐量代理式執行與輕量工作負載。

**Gemini 3.1 Pro** (gemini-3.1-pro-preview)
專業級模型，具備強大推理能力，適用於複雜分析與深度思考任務。

**Gemini 3 Flash** (gemini-3-flash-preview)
超快速模型，具備出色的成本效益。非常適合高量批次處理。

### Moonshot（Kimi 系列） [#moonshotkimi-系列]

| **模型**         | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| -------------- | ------------ | ------------ | -------------- | -------------- |
| Kimi K3        | $3.00        | $15.00       | -              | $0.30          |
| Kimi K2.7 Code | $0.95        | $4.00        | -              | $0.19          |

**Kimi K3** (kimi-k3)
Moonshot 能力最強的程式設計模型，為複雜代理工作流程提供更可靠的長上下文能力。

**Kimi K2.7 Code** (kimi-k2.7-code)
專注於程式設計的 Kimi 模型，專為長上下文程式設計任務與代理式程式碼工作流程打造。

### MiniMax [#minimax]

| **模型**     | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| ---------- | ------------ | ------------ | -------------- | -------------- |
| MiniMax M3 | $0.60        | $2.40        | -              | $0.12          |

**MiniMax M3** (MiniMax-M3)
具成本效益的長上下文模型，適用於可靠的多技能代理工作流程、工程任務與辦公自動化。

### DeepSeek [#deepseek]

| **模型**          | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| --------------- | ------------ | ------------ | -------------- | -------------- |
| DeepSeek V4 Pro | $0.435       | $0.87        | -              | $0.003625      |

**DeepSeek V4 Pro** (deepseek-v4-pro)
適用於數學與邏輯推理、程式設計及長上下文分析的進階模型。

### Qwen [#qwen]

| **模型**       | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| ------------ | ------------ | ------------ | -------------- | -------------- |
| Qwen3.7-Plus | $0.1794      | $0.7157      | $0.00          | $0.0364        |

**Qwen3.7-Plus** (qwen3.7-plus)
具成本效益的多模態模型，支援文字、圖片與影片輸入，並具備強大的代理與視覺語言能力。

### Z.AI（GLM 系列） [#zaiglm-系列]

| **模型**  | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| ------- | ------------ | ------------ | -------------- | -------------- |
| GLM-5.2 | $1.40        | $4.40        | -              | $0.26          |

**GLM-5.2** (glm-5.2)
長上下文工程模型，適用於專案規模的程式碼理解、穩定的長任務執行，以及符合標準的實作工作。

## 定價總覽 [#定價總覽]

下表彙整目前所有已啟用模型的核心定價，依輸出價格由高至低排序，方便比較：

| **模型**                | **供應商**   | **輸入（$/1M）** | **輸出（$/1M）** | **快取寫入（$/1M）** | **快取讀取（$/1M）** |
| --------------------- | --------- | ------------ | ------------ | -------------- | -------------- |
| Claude Fable 5        | Anthropic | $10.00       | $50.00       | $12.50         | $1.00          |
| GPT-5.6 Sol           | OpenAI    | $5.00        | $30.00       | $6.25          | $0.50          |
| GPT-5.5               | OpenAI    | $5.00        | $30.00       | -              | $0.50          |
| Claude Opus 5         | Anthropic | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.8       | Anthropic | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.7       | Anthropic | $5.00        | $25.00       | $6.25          | $0.50          |
| Claude Opus 4.6       | Anthropic | $5.00        | $25.00       | $6.25          | $0.50          |
| GPT-5.4               | OpenAI    | $2.50        | $15.00       | -              | $0.25          |
| Claude Sonnet 4.6     | Anthropic | $3.00        | $15.00       | $3.75          | $0.30          |
| Kimi K3               | Moonshot  | $3.00        | $15.00       | -              | $0.30          |
| GPT-5.3 Codex         | OpenAI    | $1.75        | $14.00       | -              | $0.175         |
| GPT-5.6 Terra         | OpenAI    | $2.00        | $12.00       | $2.50          | $0.20          |
| Gemini 3.1 Pro        | Google    | $2.00        | $12.00       | -              | $0.20          |
| Claude Sonnet 5       | Anthropic | $2.00        | $10.00       | $2.50          | $0.20          |
| Gemini 3.6 Flash      | Google    | $1.50        | $7.50        | -              | $0.15          |
| Claude Haiku 4.5      | Anthropic | $1.00        | $5.00        | $1.25          | $0.10          |
| GPT-5.4 mini          | OpenAI    | $0.75        | $4.50        | -              | $0.075         |
| GLM-5.2               | Z.AI      | $1.40        | $4.40        | -              | $0.26          |
| Kimi K2.7 Code        | Moonshot  | $0.95        | $4.00        | -              | $0.19          |
| Gemini 3 Flash        | Google    | $0.50        | $3.00        | -              | $0.05          |
| Gemini 3.5 Flash-Lite | Google    | $0.30        | $2.50        | -              | $0.03          |
| MiniMax M3            | MiniMax   | $0.60        | $2.40        | -              | $0.12          |
| GPT-5.6 Luna          | OpenAI    | $0.20        | $1.20        | $0.25          | $0.02          |
| DeepSeek V4 Pro       | DeepSeek  | $0.435       | $0.87        | -              | $0.003625      |
| Qwen3.7-Plus          | Qwen      | $0.1794      | $0.7157      | $0.00          | $0.0364        |
