Verdent Docs

Tarification des modèles

Comprendre la relation entre les crédits Verdent et la tarification des tokens des fournisseurs, et savoir où consulter les tarifs actuels des modèles

Cette page s'applique à la fois à Verdent Desktop et à Verdent for VS Code.

Vue d'ensemble

Verdent intègre les modèles de langage de pointe des principaux laboratoires d'IA au monde, notamment Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen et Z.AI (GLM). Pour aider les utilisateurs à comprendre le coût de chaque interaction avec l'IA, nous communiquons dans ce document la tarification des tokens des fournisseurs pour la gamme actuelle de modèles intégrés à Verdent.

Tous les prix indiqués sont les prix publics publiés par les fournisseurs, en dollars américains ($) pour un million de tokens (1M tokens). Cette gamme a été vérifiée par rapport au catalogue de modèles en direct de Verdent le 31 juillet 2026.

Sauf indication contraire, les tableaux utilisent le tarif standard payant à contexte court de chaque fournisseur. Les prix d'écriture en cache de Claude correspondent à une durée de cache de cinq minutes. Un tiret (-) signifie que le fournisseur ne publie pas de prix distinct pour cette composante. Les principales références de tarification incluent Anthropic, OpenAI, Google, Kimi, MiniMax et DeepSeek.

Concepts clés

Tokens

Un token est l'unité fondamentale de traitement du texte pour les grands modèles de langage. Un token équivaut à environ 4 caractères en anglais ou 1 à 2 caractères en chinois. La tarification des modèles est basée sur le nombre de tokens d'entrée et de sortie consommés, facturés séparément.

Modèle de facturation

Tous les modèles disponibles sur Verdent utilisent actuellement un modèle de facturation par token, ce qui signifie que vous êtes facturé en fonction du nombre réel de tokens d'entrée et de sortie consommés lors de chaque interaction.

Composantes du prix

La tarification de chaque modèle se compose des dimensions suivantes :

  • Prix d'entrée : le coût par token pour le prompt (message de l'utilisateur et contexte) envoyé au modèle.
  • Prix de sortie : le coût par token pour la réponse générée par le modèle. Généralement plus élevé que le prix d'entrée.
  • Prix d'écriture en cache : certains modèles prennent en charge la mise en cache des prompts. Il s'agit du coût par token lors de la création d'une première entrée de cache.
  • Prix de lecture en cache : le coût par token lors de l'accès à une entrée de cache existante. Généralement bien inférieur au prix d'entrée standard, ce qui réduit efficacement les coûts pour les contextes répétés.

Détails de la tarification des modèles

Vous trouverez ci-dessous les prix des fournisseurs pour tous les modèles actuellement disponibles sur Verdent, organisés par fournisseur. Tous les prix sont exprimés en USD pour 1M de tokens.

Anthropic (série Claude)

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
Claude Fable 5$10.00$50.00$12.50$1.00
Claude Opus 5$5.00$25.00$6.25$0.50
Claude Opus 4.8$5.00$25.00$6.25$0.50
Claude Opus 4.7$5.00$25.00$6.25$0.50
Claude Opus 4.6$5.00$25.00$6.25$0.50
Claude Sonnet 5$2.00$10.00$2.50$0.20
Claude Sonnet 4.6$3.00$15.00$3.75$0.30
Claude Haiku 4.5$1.00$5.00$1.25$0.10

Claude Sonnet 5 bénéficie du tarif de lancement d'Anthropic jusqu'au 31 août 2026. Anthropic indique que le tarif standard à partir du 1er septembre 2026 sera de 3,00 $ en entrée, 15,00 $ en sortie, 3,75 $ pour l'écriture en cache et 0,30 $ pour la lecture en cache par million de tokens.

Claude Fable 5 (claude-fable-5) Le modèle le plus performant d'Anthropic pour les tâches de travail intellectuel, de code et agentiques les plus exigeantes.

Claude Opus 5 (claude-opus-5) Dernier modèle Opus pour les fonctionnalités multi-fichiers complexes, les refactorisations, le raisonnement approfondi et le codage agentique de bout en bout.

Claude Opus 4.8 (claude-opus-4-8) Modèle Opus haute performance pour le codage complexe, les tâches agentiques, les flux de travail d'entreprise et le raisonnement approfondi en plusieurs étapes.

Claude Opus 4.7 (claude-opus-4-7) Modèle Opus pour les agents de longue durée, les tâches de codage en plusieurs étapes et le travail intellectuel complexe.

Claude Opus 4.6 (claude-opus-4-6) Modèle Opus haut de gamme pour l'architecture de code complexe, l'analyse approfondie et les tâches de résolution de problèmes difficiles.

Claude Sonnet 5 (claude-sonnet-5) Dernier modèle Sonnet doté d'un raisonnement adaptatif pour le codage, la planification d'agents, l'analyse à contexte long et le travail intellectuel.

Claude Sonnet 4.6 (claude-sonnet-4-6) Modèle équilibré offrant de solides performances à un tarif compétitif ; recommandé pour le développement quotidien.

Claude Haiku 4.5 (claude-haiku-4-5@20251001) Modèle rapide et léger à faible latence. Idéal pour les conversations simples, les recherches rapides et les tâches sensibles au coût.

OpenAI (série GPT)

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
GPT-5.6 Sol$5.00$30.00$6.25$0.50
GPT-5.6 Terra$2.00$12.00$2.50$0.20
GPT-5.6 Luna$0.20$1.20$0.25$0.02
GPT-5.5$5.00$30.00-$0.50
GPT-5.4$2.50$15.00-$0.25
GPT-5.4 mini$0.75$4.50-$0.075
GPT-5.3 Codex$1.75$14.00-$0.175

GPT-5.6 Sol (gpt-5.6-sol) Modèle GPT-5.6 de pointe pour les tâches de codage agentique et de raisonnement les plus exigeantes.

GPT-5.6 Terra (gpt-5.6-terra) Modèle GPT-5.6 équilibré pour un codage quotidien performant, l'utilisation d'outils et le raisonnement à moindre coût.

GPT-5.6 Luna (gpt-5.6-luna) Modèle GPT-5.6 rapide et très économique pour le développement courant, les sous-agents et les flux de travail à fort volume.

GPT-5.5 (gpt-5.5) Modèle GPT de pointe adapté au raisonnement, à la génération de code et aux charges de travail d'analyse en plusieurs étapes.

GPT-5.4 (gpt-5.4) Modèle GPT phare offrant une excellente qualité de raisonnement et de génération de code.

GPT-5.4 mini (gpt-5.4-mini) Modèle GPT efficace pour les charges de travail à fort volume, les sous-agents et les tâches de codage sensibles au coût.

GPT-5.3 Codex (gpt-5.3-codex) Modèle spécialisé dans le code, optimisé pour les tâches de programmation, y compris la génération et la refactorisation de code à grande échelle.

Google (série Gemini)

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
Gemini 3.6 Flash$1.50$7.50-$0.15
Gemini 3.5 Flash-Lite$0.30$2.50-$0.03
Gemini 3.1 Pro$2.00$12.00-$0.20
Gemini 3 Flash$0.50$3.00-$0.05

Gemini 3.6 Flash (gemini-3.6-flash) Modèle Gemini de pointe rapide, avec des capacités améliorées en codage, en connaissances, en compréhension multimodale et en efficacité des tokens.

Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) Modèle Gemini économique pour l'exécution agentique à haut débit et les charges de travail légères.

Gemini 3.1 Pro (gemini-3.1-pro-preview) Modèle de niveau professionnel offrant un raisonnement solide, adapté aux analyses complexes et aux tâches de réflexion approfondie.

Gemini 3 Flash (gemini-3-flash-preview) Modèle ultra-rapide avec une excellente efficacité en termes de coût. Idéal pour le traitement par lots à fort volume.

Moonshot (série Kimi)

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
Kimi K3$3.00$15.00-$0.30
Kimi K2.7 Code$0.95$4.00-$0.19

Kimi K3 (kimi-k3) Le modèle de codage le plus performant de Moonshot, avec une fiabilité renforcée à contexte long pour les flux de travail agentiques complexes.

Kimi K2.7 Code (kimi-k2.7-code) Modèle Kimi axé sur le codage, conçu pour les tâches de programmation à contexte long et les flux de travail de code agentique.

MiniMax

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
MiniMax M3$0.60$2.40-$0.12

MiniMax M3 (MiniMax-M3) Modèle économique à contexte long pour des flux de travail d'agents multi-compétences fiables, des tâches d'ingénierie et l'automatisation bureautique.

DeepSeek

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
DeepSeek V4 Pro$0.435$0.87-$0.003625

DeepSeek V4 Pro (deepseek-v4-pro) Modèle avancé pour le raisonnement mathématique et logique, le codage et l'analyse à contexte long.

Qwen

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
Qwen3.7-Plus$0.1794$0.7157$0.00$0.0364

Qwen3.7-Plus (qwen3.7-plus) Modèle multimodal économique pour les entrées de texte, d'image et de vidéo, offrant de solides capacités agentiques et de vision-langage.

Z.AI (série GLM)

ModèleEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
GLM-5.2$1.40$4.40-$0.26

GLM-5.2 (glm-5.2) Modèle d'ingénierie à contexte long pour la compréhension de code à l'échelle d'un projet, l'exécution stable de tâches longues et un travail d'implémentation respectueux des normes.

Vue d'ensemble des tarifs

Le tableau ci-dessous résume la tarification de base de tous les modèles actuellement activés, triés par prix de sortie décroissant pour faciliter la comparaison :

ModèleFournisseurEntrée ($/1M)Sortie ($/1M)Écriture en cache ($/1M)Lecture en cache ($/1M)
Claude Fable 5Anthropic$10.00$50.00$12.50$1.00
GPT-5.6 SolOpenAI$5.00$30.00$6.25$0.50
GPT-5.5OpenAI$5.00$30.00-$0.50
Claude Opus 5Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.8Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.7Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.6Anthropic$5.00$25.00$6.25$0.50
GPT-5.4OpenAI$2.50$15.00-$0.25
Claude Sonnet 4.6Anthropic$3.00$15.00$3.75$0.30
Kimi K3Moonshot$3.00$15.00-$0.30
GPT-5.3 CodexOpenAI$1.75$14.00-$0.175
GPT-5.6 TerraOpenAI$2.00$12.00$2.50$0.20
Gemini 3.1 ProGoogle$2.00$12.00-$0.20
Claude Sonnet 5Anthropic$2.00$10.00$2.50$0.20
Gemini 3.6 FlashGoogle$1.50$7.50-$0.15
Claude Haiku 4.5Anthropic$1.00$5.00$1.25$0.10
GPT-5.4 miniOpenAI$0.75$4.50-$0.075
GLM-5.2Z.AI$1.40$4.40-$0.26
Kimi K2.7 CodeMoonshot$0.95$4.00-$0.19
Gemini 3 FlashGoogle$0.50$3.00-$0.05
Gemini 3.5 Flash-LiteGoogle$0.30$2.50-$0.03
MiniMax M3MiniMax$0.60$2.40-$0.12
GPT-5.6 LunaOpenAI$0.20$1.20$0.25$0.02
DeepSeek V4 ProDeepSeek$0.435$0.87-$0.003625
Qwen3.7-PlusQwen$0.1794$0.7157$0.00$0.0364