Preços dos Modelos
Entenda como os créditos da Verdent se relacionam com os preços de tokens dos provedores e onde consultar as tarifas atuais dos modelos
Esta página se aplica tanto ao Verdent Desktop quanto ao Verdent for VS Code.
Visão Geral
A Verdent integra modelos de linguagem de grande escala de última geração dos principais laboratórios de IA do mundo, incluindo Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen e Z.AI (GLM). Para ajudar os usuários a entender o custo por trás de cada interação com IA, divulgamos neste documento os preços de tokens dos provedores para o conjunto atual de modelos integrados da Verdent.
Todos os preços listados são preços publicados pelos provedores, em dólares americanos ($) por um milhão de tokens (1M de tokens). O conjunto de modelos foi verificado com base no catálogo de modelos ativo da Verdent em 31 de julho de 2026.
Salvo indicação em contrário, as tabelas utilizam a tarifa padrão, paga e de contexto curto de cada provedor. Os preços de escrita em cache do Claude usam a duração de cache de cinco minutos. Um traço (-) significa que o provedor não publica um preço separado para esse componente. As referências principais de preços incluem Anthropic, OpenAI, Google, Kimi, MiniMax e DeepSeek.
Conceitos-Chave
Tokens
Um token é a unidade fundamental de processamento de texto para modelos de linguagem de grande escala. Um token equivale aproximadamente a 4 caracteres em inglês ou 1-2 caracteres em chinês. O preço dos modelos é baseado no número de tokens de entrada e saída consumidos, cobrados separadamente.
Modelo de Cobrança
Todos os modelos na Verdent atualmente utilizam um modelo de cobrança por token, o que significa que você é cobrado com base no número real de tokens de entrada e saída consumidos em cada interação.
Componentes de Preço
O preço de cada modelo consiste nas seguintes dimensões:
- Preço de Entrada: O custo por token do prompt (mensagem do usuário e contexto) enviado ao modelo.
- Preço de Saída: O custo por token da resposta gerada pelo modelo. Normalmente mais alto que o preço de entrada.
- Preço de Escrita em Cache: Alguns modelos suportam cache de prompt. Este é o custo por token ao criar uma entrada de cache pela primeira vez.
- Preço de Leitura em Cache: O custo por token ao acessar uma entrada de cache existente. Normalmente muito mais baixo que o preço de entrada padrão, reduzindo efetivamente os custos para contextos repetidos.
Detalhes de Preços dos Modelos
Abaixo estão os preços dos provedores para todos os modelos atualmente disponíveis na Verdent, organizados por provedor. Todos os preços estão em USD por 1M de tokens.
Anthropic (Série Claude)
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | $12.50 | $1.00 |
| Claude Opus 5 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Sonnet 5 | $2.00 | $10.00 | $2.50 | $0.20 |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $3.75 | $0.30 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.25 | $0.10 |
O Claude Sonnet 5 utiliza o preço promocional de lançamento da Anthropic até 31 de agosto de 2026. A Anthropic lista o preço padrão a partir de 1º de setembro de 2026 como $3.00 de entrada, $15.00 de saída, $3.75 de escrita em cache e $0.30 de leitura em cache por 1M de tokens.
Claude Fable 5 (claude-fable-5) O modelo mais inteligente da Anthropic para as tarefas mais difíceis de trabalho intelectual, codificação e tarefas agênticas.
Claude Opus 5 (claude-opus-5) Modelo Opus mais recente para recursos complexos com múltiplos arquivos, refatorações, raciocínio profundo e codificação agêntica de ponta a ponta.
Claude Opus 4.8 (claude-opus-4-8) Modelo Opus de alta capacidade para codificação complexa, tarefas agênticas, fluxos de trabalho empresariais e raciocínio profundo de múltiplas etapas.
Claude Opus 4.7 (claude-opus-4-7) Modelo Opus para agentes de longa duração, tarefas de codificação em múltiplas etapas e trabalho intelectual complexo.
Claude Opus 4.6 (claude-opus-4-6) Modelo Opus de nível principal para arquitetura de código complexa, análise profunda e tarefas difíceis de resolução de problemas.
Claude Sonnet 5 (claude-sonnet-5) Modelo Sonnet mais recente com raciocínio adaptativo para codificação, planejamento de agentes, análise de contexto longo e trabalho intelectual.
Claude Sonnet 4.6 (claude-sonnet-4-6) Modelo equilibrado com desempenho sólido e preço competitivo; recomendado para o desenvolvimento do dia a dia.
Claude Haiku 4.5 (claude-haiku-4-5@20251001) Modelo rápido e leve com baixa latência. Ideal para conversas simples, consultas rápidas e tarefas sensíveis a custo.
OpenAI (Série GPT)
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.6 Terra | $2.00 | $12.00 | $2.50 | $0.20 |
| GPT-5.6 Luna | $0.20 | $1.20 | $0.25 | $0.02 |
| GPT-5.5 | $5.00 | $30.00 | - | $0.50 |
| GPT-5.4 | $2.50 | $15.00 | - | $0.25 |
| GPT-5.4 mini | $0.75 | $4.50 | - | $0.075 |
| GPT-5.3 Codex | $1.75 | $14.00 | - | $0.175 |
GPT-5.6 Sol (gpt-5.6-sol) Modelo GPT-5.6 de fronteira para as tarefas mais exigentes de codificação agêntica e raciocínio.
GPT-5.6 Terra (gpt-5.6-terra) Modelo GPT-5.6 equilibrado para codificação sólida no dia a dia, uso de ferramentas e raciocínio a um custo menor.
GPT-5.6 Luna (gpt-5.6-luna) Modelo GPT-5.6 rápido e altamente eficiente em custo para desenvolvimento rotineiro, subagentes e fluxos de trabalho de alto volume.
GPT-5.5 (gpt-5.5) Modelo GPT de fronteira adequado para raciocínio, geração de código e cargas de trabalho de análise em múltiplas etapas.
GPT-5.4 (gpt-5.4) Modelo GPT principal com forte qualidade de raciocínio e geração de código.
GPT-5.4 mini (gpt-5.4-mini) Modelo GPT eficiente para cargas de trabalho de alto volume, subagentes e tarefas de codificação sensíveis a custo.
GPT-5.3 Codex (gpt-5.3-codex) Modelo especializado em código, otimizado para tarefas de programação, incluindo geração de código e refatoração em larga escala.
Google (Série Gemini)
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 |
Gemini 3.6 Flash (gemini-3.6-flash) Modelo Gemini de fronteira e rápido, com melhorias em codificação, conhecimento, compreensão multimodal e eficiência de tokens.
Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) Modelo Gemini eficiente em custo para execução agêntica de alto rendimento e cargas de trabalho leves.
Gemini 3.1 Pro (gemini-3.1-pro-preview) Modelo de nível profissional com forte raciocínio, adequado para análises complexas e tarefas de pensamento profundo.
Gemini 3 Flash (gemini-3-flash-preview) Modelo ultrarrápido com excelente eficiência de custo. Ideal para processamento em lote de alto volume.
Moonshot (Série Kimi)
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | - | $0.30 |
| Kimi K2.7 Code | $0.95 | $4.00 | - | $0.19 |
Kimi K3 (kimi-k3) O modelo de codificação mais capaz da Moonshot, com maior confiabilidade em contexto longo para fluxos de trabalho agênticos complexos.
Kimi K2.7 Code (kimi-k2.7-code) Modelo Kimi focado em codificação, construído para tarefas de programação com contexto longo e fluxos de trabalho de código agêntico.
MiniMax
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| MiniMax M3 | $0.60 | $2.40 | - | $0.12 |
MiniMax M3 (MiniMax-M3) Modelo de contexto longo e eficiente em custo para fluxos de trabalho de agentes multifuncionais confiáveis, tarefas de engenharia e automação de escritório.
DeepSeek
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| DeepSeek V4 Pro | $0.435 | $0.87 | - | $0.003625 |
DeepSeek V4 Pro (deepseek-v4-pro) Modelo avançado para raciocínio matemático e lógico, codificação e análise de contexto longo.
Qwen
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| Qwen3.7-Plus | $0.1794 | $0.7157 | $0.00 | $0.0364 |
Qwen3.7-Plus (qwen3.7-plus) Modelo multimodal econômico para entradas de texto, imagem e vídeo, com fortes capacidades agênticas e de visão-linguagem.
Z.AI (Série GLM)
| Modelo | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|
| GLM-5.2 | $1.40 | $4.40 | - | $0.26 |
GLM-5.2 (glm-5.2) Modelo de engenharia com contexto longo para compreensão de código em escala de projeto, execução estável de tarefas longas e trabalho de implementação com foco em padrões.
Visão Geral de Preços
A tabela abaixo resume os preços principais de todos os modelos atualmente habilitados, ordenados por preço de saída em ordem decrescente para facilitar a comparação:
| Modelo | Provedor | Entrada ($/1M) | Saída ($/1M) | Escrita em Cache ($/1M) | Leitura em Cache ($/1M) |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | $12.50 | $1.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | - | $0.50 |
| Claude Opus 5 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| GPT-5.4 | OpenAI | $2.50 | $15.00 | - | $0.25 |
| Claude Sonnet 4.6 | Anthropic | $3.00 | $15.00 | $3.75 | $0.30 |
| Kimi K3 | Moonshot | $3.00 | $15.00 | - | $0.30 |
| GPT-5.3 Codex | OpenAI | $1.75 | $14.00 | - | $0.175 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | $2.50 | $0.20 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 | |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $2.50 | $0.20 |
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 | |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $1.25 | $0.10 |
| GPT-5.4 mini | OpenAI | $0.75 | $4.50 | - | $0.075 |
| GLM-5.2 | Z.AI | $1.40 | $4.40 | - | $0.26 |
| Kimi K2.7 Code | Moonshot | $0.95 | $4.00 | - | $0.19 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 | |
| MiniMax M3 | MiniMax | $0.60 | $2.40 | - | $0.12 |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | $0.25 | $0.02 |
| DeepSeek V4 Pro | DeepSeek | $0.435 | $0.87 | - | $0.003625 |
| Qwen3.7-Plus | Qwen | $0.1794 | $0.7157 | $0.00 | $0.0364 |