# Preços dos Modelos (/pt/docs/account-billing/model-pricing)

> Entenda como os créditos da Verdent se relacionam com os preços de tokens dos provedores e onde consultar as tarifas atuais dos modelos



<Note>
  Esta página se aplica tanto ao Verdent Desktop quanto ao Verdent for VS Code.
</Note>

## Visão Geral [#visão-geral]

A Verdent integra modelos de linguagem de grande escala de última geração dos principais laboratórios de IA do mundo, incluindo Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen e Z.AI (GLM). Para ajudar os usuários a entender o custo por trás de cada interação com IA, divulgamos neste documento os preços de tokens dos provedores para o conjunto atual de modelos integrados da Verdent.

Todos os preços listados são preços publicados pelos provedores, em dólares americanos ($) por um milhão de tokens (1M de tokens). O conjunto de modelos foi verificado com base no [catálogo de modelos ativo da Verdent](https://llm-proxy.verdent.ai/config/model_list) em **31 de julho de 2026**.

Salvo indicação em contrário, as tabelas utilizam a tarifa padrão, paga e de contexto curto de cada provedor. Os preços de escrita em cache do Claude usam a duração de cache de cinco minutos. Um traço (`-`) significa que o provedor não publica um preço separado para esse componente. As referências principais de preços incluem [Anthropic](https://platform.claude.com/docs/en/about-claude/pricing), [OpenAI](https://developers.openai.com/api/docs/pricing), [Google](https://ai.google.dev/gemini-api/docs/pricing), [Kimi](https://platform.kimi.ai/docs/pricing/chat-k3), [MiniMax](https://platform.minimax.io/subscribe/token-plan?tab=api-enterprise) e [DeepSeek](https://api-docs.deepseek.com/quick_start/pricing).

## Conceitos-Chave [#conceitos-chave]

### Tokens [#tokens]

Um token é a unidade fundamental de processamento de texto para modelos de linguagem de grande escala. Um token equivale aproximadamente a 4 caracteres em inglês ou 1-2 caracteres em chinês. O preço dos modelos é baseado no número de tokens de entrada e saída consumidos, cobrados separadamente.

### Modelo de Cobrança [#modelo-de-cobrança]

Todos os modelos na Verdent atualmente utilizam um modelo de cobrança por token, o que significa que você é cobrado com base no número real de tokens de entrada e saída consumidos em cada interação.

### Componentes de Preço [#componentes-de-preço]

O preço de cada modelo consiste nas seguintes dimensões:

* **Preço de Entrada:** O custo por token do prompt (mensagem do usuário e contexto) enviado ao modelo.
* **Preço de Saída:** O custo por token da resposta gerada pelo modelo. Normalmente mais alto que o preço de entrada.
* **Preço de Escrita em Cache:** Alguns modelos suportam cache de prompt. Este é o custo por token ao criar uma entrada de cache pela primeira vez.
* **Preço de Leitura em Cache:** O custo por token ao acessar uma entrada de cache existente. Normalmente muito mais baixo que o preço de entrada padrão, reduzindo efetivamente os custos para contextos repetidos.

## Detalhes de Preços dos Modelos [#detalhes-de-preços-dos-modelos]

Abaixo estão os preços dos provedores para todos os modelos atualmente disponíveis na Verdent, organizados por provedor. Todos os preços estão em USD por 1M de tokens.

### Anthropic (Série Claude) [#anthropic-série-claude]

| **Modelo**        | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| ----------------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| Claude Fable 5    | $10.00             | $50.00           | $12.50                      | $1.00                       |
| Claude Opus 5     | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.8   | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.7   | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.6   | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Sonnet 5   | $2.00              | $10.00           | $2.50                       | $0.20                       |
| Claude Sonnet 4.6 | $3.00              | $15.00           | $3.75                       | $0.30                       |
| Claude Haiku 4.5  | $1.00              | $5.00            | $1.25                       | $0.10                       |

<Note>
  O Claude Sonnet 5 utiliza o preço promocional de lançamento da Anthropic até 31 de agosto de 2026. A Anthropic lista o preço padrão a partir de 1º de setembro de 2026 como $3.00 de entrada, $15.00 de saída, $3.75 de escrita em cache e $0.30 de leitura em cache por 1M de tokens.
</Note>

**Claude Fable 5** (claude-fable-5)
O modelo mais inteligente da Anthropic para as tarefas mais difíceis de trabalho intelectual, codificação e tarefas agênticas.

**Claude Opus 5** (claude-opus-5)
Modelo Opus mais recente para recursos complexos com múltiplos arquivos, refatorações, raciocínio profundo e codificação agêntica de ponta a ponta.

**Claude Opus 4.8** (claude-opus-4-8)
Modelo Opus de alta capacidade para codificação complexa, tarefas agênticas, fluxos de trabalho empresariais e raciocínio profundo de múltiplas etapas.

**Claude Opus 4.7** (claude-opus-4-7)
Modelo Opus para agentes de longa duração, tarefas de codificação em múltiplas etapas e trabalho intelectual complexo.

**Claude Opus 4.6** (claude-opus-4-6)
Modelo Opus de nível principal para arquitetura de código complexa, análise profunda e tarefas difíceis de resolução de problemas.

**Claude Sonnet 5** (claude-sonnet-5)
Modelo Sonnet mais recente com raciocínio adaptativo para codificação, planejamento de agentes, análise de contexto longo e trabalho intelectual.

**Claude Sonnet 4.6** (claude-sonnet-4-6)
Modelo equilibrado com desempenho sólido e preço competitivo; recomendado para o desenvolvimento do dia a dia.

**Claude Haiku 4.5** (claude-haiku-4-5\@20251001)
Modelo rápido e leve com baixa latência. Ideal para conversas simples, consultas rápidas e tarefas sensíveis a custo.

### OpenAI (Série GPT) [#openai-série-gpt]

| **Modelo**    | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| ------------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| GPT-5.6 Sol   | $5.00              | $30.00           | $6.25                       | $0.50                       |
| GPT-5.6 Terra | $2.00              | $12.00           | $2.50                       | $0.20                       |
| GPT-5.6 Luna  | $0.20              | $1.20            | $0.25                       | $0.02                       |
| GPT-5.5       | $5.00              | $30.00           | -                           | $0.50                       |
| GPT-5.4       | $2.50              | $15.00           | -                           | $0.25                       |
| GPT-5.4 mini  | $0.75              | $4.50            | -                           | $0.075                      |
| GPT-5.3 Codex | $1.75              | $14.00           | -                           | $0.175                      |

**GPT-5.6 Sol** (gpt-5.6-sol)
Modelo GPT-5.6 de fronteira para as tarefas mais exigentes de codificação agêntica e raciocínio.

**GPT-5.6 Terra** (gpt-5.6-terra)
Modelo GPT-5.6 equilibrado para codificação sólida no dia a dia, uso de ferramentas e raciocínio a um custo menor.

**GPT-5.6 Luna** (gpt-5.6-luna)
Modelo GPT-5.6 rápido e altamente eficiente em custo para desenvolvimento rotineiro, subagentes e fluxos de trabalho de alto volume.

**GPT-5.5** (gpt-5.5)
Modelo GPT de fronteira adequado para raciocínio, geração de código e cargas de trabalho de análise em múltiplas etapas.

**GPT-5.4** (gpt-5.4)
Modelo GPT principal com forte qualidade de raciocínio e geração de código.

**GPT-5.4 mini** (gpt-5.4-mini)
Modelo GPT eficiente para cargas de trabalho de alto volume, subagentes e tarefas de codificação sensíveis a custo.

**GPT-5.3 Codex** (gpt-5.3-codex)
Modelo especializado em código, otimizado para tarefas de programação, incluindo geração de código e refatoração em larga escala.

### Google (Série Gemini) [#google-série-gemini]

| **Modelo**            | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| --------------------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| Gemini 3.6 Flash      | $1.50              | $7.50            | -                           | $0.15                       |
| Gemini 3.5 Flash-Lite | $0.30              | $2.50            | -                           | $0.03                       |
| Gemini 3.1 Pro        | $2.00              | $12.00           | -                           | $0.20                       |
| Gemini 3 Flash        | $0.50              | $3.00            | -                           | $0.05                       |

**Gemini 3.6 Flash** (gemini-3.6-flash)
Modelo Gemini de fronteira e rápido, com melhorias em codificação, conhecimento, compreensão multimodal e eficiência de tokens.

**Gemini 3.5 Flash-Lite** (gemini-3.5-flash-lite)
Modelo Gemini eficiente em custo para execução agêntica de alto rendimento e cargas de trabalho leves.

**Gemini 3.1 Pro** (gemini-3.1-pro-preview)
Modelo de nível profissional com forte raciocínio, adequado para análises complexas e tarefas de pensamento profundo.

**Gemini 3 Flash** (gemini-3-flash-preview)
Modelo ultrarrápido com excelente eficiência de custo. Ideal para processamento em lote de alto volume.

### Moonshot (Série Kimi) [#moonshot-série-kimi]

| **Modelo**     | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| -------------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| Kimi K3        | $3.00              | $15.00           | -                           | $0.30                       |
| Kimi K2.7 Code | $0.95              | $4.00            | -                           | $0.19                       |

**Kimi K3** (kimi-k3)
O modelo de codificação mais capaz da Moonshot, com maior confiabilidade em contexto longo para fluxos de trabalho agênticos complexos.

**Kimi K2.7 Code** (kimi-k2.7-code)
Modelo Kimi focado em codificação, construído para tarefas de programação com contexto longo e fluxos de trabalho de código agêntico.

### MiniMax [#minimax]

| **Modelo** | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| ---------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| MiniMax M3 | $0.60              | $2.40            | -                           | $0.12                       |

**MiniMax M3** (MiniMax-M3)
Modelo de contexto longo e eficiente em custo para fluxos de trabalho de agentes multifuncionais confiáveis, tarefas de engenharia e automação de escritório.

### DeepSeek [#deepseek]

| **Modelo**      | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| --------------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| DeepSeek V4 Pro | $0.435             | $0.87            | -                           | $0.003625                   |

**DeepSeek V4 Pro** (deepseek-v4-pro)
Modelo avançado para raciocínio matemático e lógico, codificação e análise de contexto longo.

### Qwen [#qwen]

| **Modelo**   | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| ------------ | ------------------ | ---------------- | --------------------------- | --------------------------- |
| Qwen3.7-Plus | $0.1794            | $0.7157          | $0.00                       | $0.0364                     |

**Qwen3.7-Plus** (qwen3.7-plus)
Modelo multimodal econômico para entradas de texto, imagem e vídeo, com fortes capacidades agênticas e de visão-linguagem.

### Z.AI (Série GLM) [#zai-série-glm]

| **Modelo** | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| ---------- | ------------------ | ---------------- | --------------------------- | --------------------------- |
| GLM-5.2    | $1.40              | $4.40            | -                           | $0.26                       |

**GLM-5.2** (glm-5.2)
Modelo de engenharia com contexto longo para compreensão de código em escala de projeto, execução estável de tarefas longas e trabalho de implementação com foco em padrões.

## Visão Geral de Preços [#visão-geral-de-preços]

A tabela abaixo resume os preços principais de todos os modelos atualmente habilitados, ordenados por preço de saída em ordem decrescente para facilitar a comparação:

| **Modelo**            | **Provedor** | **Entrada ($/1M)** | **Saída ($/1M)** | **Escrita em Cache ($/1M)** | **Leitura em Cache ($/1M)** |
| --------------------- | ------------ | ------------------ | ---------------- | --------------------------- | --------------------------- |
| Claude Fable 5        | Anthropic    | $10.00             | $50.00           | $12.50                      | $1.00                       |
| GPT-5.6 Sol           | OpenAI       | $5.00              | $30.00           | $6.25                       | $0.50                       |
| GPT-5.5               | OpenAI       | $5.00              | $30.00           | -                           | $0.50                       |
| Claude Opus 5         | Anthropic    | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.8       | Anthropic    | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.7       | Anthropic    | $5.00              | $25.00           | $6.25                       | $0.50                       |
| Claude Opus 4.6       | Anthropic    | $5.00              | $25.00           | $6.25                       | $0.50                       |
| GPT-5.4               | OpenAI       | $2.50              | $15.00           | -                           | $0.25                       |
| Claude Sonnet 4.6     | Anthropic    | $3.00              | $15.00           | $3.75                       | $0.30                       |
| Kimi K3               | Moonshot     | $3.00              | $15.00           | -                           | $0.30                       |
| GPT-5.3 Codex         | OpenAI       | $1.75              | $14.00           | -                           | $0.175                      |
| GPT-5.6 Terra         | OpenAI       | $2.00              | $12.00           | $2.50                       | $0.20                       |
| Gemini 3.1 Pro        | Google       | $2.00              | $12.00           | -                           | $0.20                       |
| Claude Sonnet 5       | Anthropic    | $2.00              | $10.00           | $2.50                       | $0.20                       |
| Gemini 3.6 Flash      | Google       | $1.50              | $7.50            | -                           | $0.15                       |
| Claude Haiku 4.5      | Anthropic    | $1.00              | $5.00            | $1.25                       | $0.10                       |
| GPT-5.4 mini          | OpenAI       | $0.75              | $4.50            | -                           | $0.075                      |
| GLM-5.2               | Z.AI         | $1.40              | $4.40            | -                           | $0.26                       |
| Kimi K2.7 Code        | Moonshot     | $0.95              | $4.00            | -                           | $0.19                       |
| Gemini 3 Flash        | Google       | $0.50              | $3.00            | -                           | $0.05                       |
| Gemini 3.5 Flash-Lite | Google       | $0.30              | $2.50            | -                           | $0.03                       |
| MiniMax M3            | MiniMax      | $0.60              | $2.40            | -                           | $0.12                       |
| GPT-5.6 Luna          | OpenAI       | $0.20              | $1.20            | $0.25                       | $0.02                       |
| DeepSeek V4 Pro       | DeepSeek     | $0.435             | $0.87            | -                           | $0.003625                   |
| Qwen3.7-Plus          | Qwen         | $0.1794            | $0.7157          | $0.00                       | $0.0364                     |
