Prezzi dei modelli
Scopri come i crediti Verdent si collegano ai prezzi per token dei provider e dove controllare le tariffe attuali dei modelli
Questa pagina si applica sia a Verdent Desktop sia a Verdent for VS Code.
Panoramica
Verdent integra modelli linguistici di grandi dimensioni all'avanguardia dei principali laboratori AI al mondo, tra cui Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen e Z.AI (GLM). Per aiutare gli utenti a capire il costo dietro ogni interazione AI, in questo documento pubblichiamo i prezzi per token dei provider per l'attuale selezione di modelli integrati di Verdent.
Tutti i prezzi indicati sono prezzi pubblicati lato provider in dollari statunitensi ($) per un milione di token (1M token). La selezione è stata verificata rispetto al catalogo modelli live di Verdent il 31 luglio 2026.
Salvo diversa indicazione, le tabelle usano la tariffa standard a pagamento e a contesto breve di ciascun provider. I prezzi di scrittura cache di Claude usano la durata cache di cinque minuti. Un trattino (-) indica che il provider non pubblica un prezzo separato per quel componente. I riferimenti principali per i prezzi includono Anthropic, OpenAI, Google, Kimi, MiniMax e DeepSeek.
Concetti chiave
Token
Un token è l'unità fondamentale di elaborazione del testo per i modelli linguistici di grandi dimensioni. Un token corrisponde approssimativamente a 4 caratteri inglesi o a 1-2 caratteri cinesi. Il prezzo dei modelli si basa sul numero di token di input e output consumati, fatturati separatamente.
Modello di fatturazione
Tutti i modelli su Verdent usano attualmente un modello di fatturazione per token, quindi l'addebito si basa sul numero effettivo di token di input e output consumati durante ogni interazione.
Componenti del prezzo
Il prezzo di ciascun modello è composto dalle seguenti dimensioni:
- Prezzo input: il costo per token del prompt (messaggio dell'utente e contesto) inviato al modello.
- Prezzo output: il costo per token della risposta generata dal modello. Di solito è superiore al prezzo input.
- Prezzo scrittura cache: alcuni modelli supportano la cache dei prompt. Questo è il costo per token quando viene creata una voce di cache per la prima volta.
- Prezzo lettura cache: il costo per token quando viene trovata una voce di cache esistente. Di solito è molto più basso del prezzo input standard, riducendo di fatto i costi per contesti ripetuti.
Dettagli sui prezzi dei modelli
Di seguito trovi i prezzi dei provider per tutti i modelli attualmente disponibili su Verdent, organizzati per provider. Tutti i prezzi sono in USD per 1M token.
Anthropic (serie Claude)
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | $12.50 | $1.00 |
| Claude Opus 5 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Sonnet 5 | $2.00 | $10.00 | $2.50 | $0.20 |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $3.75 | $0.30 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.25 | $0.10 |
Claude Sonnet 5 usa il prezzo introduttivo di Anthropic fino al 31 agosto 2026. Anthropic indica il prezzo standard dal 1 settembre 2026 come $3.00 per input, $15.00 per output, $3.75 per scrittura cache e $0.30 per lettura cache ogni 1M token.
Claude Fable 5 (claude-fable-5) Il modello Anthropic con il livello di intelligenza più alto per le attività più difficili di knowledge work, programmazione e agentiche.
Claude Opus 5 (claude-opus-5) Il modello Opus più recente per funzionalità multi-file complesse, refactoring, ragionamento profondo e programmazione agentica end-to-end.
Claude Opus 4.8 (claude-opus-4-8) Modello Opus ad alta capacità per programmazione complessa, attività agentiche, flussi di lavoro enterprise e ragionamento profondo in più passaggi.
Claude Opus 4.7 (claude-opus-4-7) Modello Opus per agenti di lunga durata, attività di programmazione in più passaggi e knowledge work complesso.
Claude Opus 4.6 (claude-opus-4-6) Modello Opus di fascia flagship per architetture di codice complesse, analisi approfondite e attività difficili di risoluzione dei problemi.
Claude Sonnet 5 (claude-sonnet-5) Il modello Sonnet più recente con pensiero adattivo per programmazione, pianificazione degli agenti, analisi a contesto lungo e knowledge work.
Claude Sonnet 4.6 (claude-sonnet-4-6) Modello bilanciato con prestazioni solide e prezzi competitivi; consigliato per lo sviluppo quotidiano.
Claude Haiku 4.5 (claude-haiku-4-5@20251001) Modello veloce e leggero con bassa latenza. Ideale per conversazioni semplici, ricerche rapide e attività sensibili ai costi.
OpenAI (serie GPT)
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.6 Terra | $2.00 | $12.00 | $2.50 | $0.20 |
| GPT-5.6 Luna | $0.20 | $1.20 | $0.25 | $0.02 |
| GPT-5.5 | $5.00 | $30.00 | - | $0.50 |
| GPT-5.4 | $2.50 | $15.00 | - | $0.25 |
| GPT-5.4 mini | $0.75 | $4.50 | - | $0.075 |
| GPT-5.3 Codex | $1.75 | $14.00 | - | $0.175 |
GPT-5.6 Sol (gpt-5.6-sol) Modello GPT-5.6 frontier per le attività più impegnative di programmazione agentica e ragionamento.
GPT-5.6 Terra (gpt-5.6-terra) Modello GPT-5.6 bilanciato per programmazione quotidiana solida, uso di strumenti e ragionamento a un costo inferiore.
GPT-5.6 Luna (gpt-5.6-luna) Modello GPT-5.6 veloce e molto efficiente nei costi per sviluppo ordinario, sottoagenti e flussi di lavoro ad alto volume.
GPT-5.5 (gpt-5.5) Modello GPT frontier adatto a ragionamento, generazione di codice e carichi di lavoro di analisi in più passaggi.
GPT-5.4 (gpt-5.4) Modello GPT flagship con forte qualità di ragionamento e generazione di codice.
GPT-5.4 mini (gpt-5.4-mini) Modello GPT efficiente per carichi di lavoro ad alto volume, sottoagenti e attività di programmazione sensibili ai costi.
GPT-5.3 Codex (gpt-5.3-codex) Modello specializzato per il codice e ottimizzato per attività di programmazione, incluse generazione di codice su larga scala e refactoring.
Google (serie Gemini)
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 |
Gemini 3.6 Flash (gemini-3.6-flash) Modello Gemini frontier veloce con miglioramenti in programmazione, conoscenza, comprensione multimodale ed efficienza dei token.
Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) Modello Gemini conveniente per esecuzione agentica ad alta produttività e carichi di lavoro leggeri.
Gemini 3.1 Pro (gemini-3.1-pro-preview) Modello di livello professionale con forte capacità di ragionamento, adatto ad analisi complesse e attività di pensiero profondo.
Gemini 3 Flash (gemini-3-flash-preview) Modello ultrarapido con eccellente efficienza dei costi. Ideale per elaborazioni batch ad alto volume.
Moonshot (serie Kimi)
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | - | $0.30 |
| Kimi K2.7 Code | $0.95 | $4.00 | - | $0.19 |
Kimi K3 (kimi-k3) Il modello di programmazione più capace di Moonshot, con affidabilità a contesto lungo più solida per flussi di lavoro agentici complessi.
Kimi K2.7 Code (kimi-k2.7-code) Modello Kimi orientato alla programmazione, progettato per attività di programmazione a contesto lungo e flussi di lavoro di codice agentici.
MiniMax
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| MiniMax M3 | $0.60 | $2.40 | - | $0.12 |
MiniMax M3 (MiniMax-M3) Modello a contesto lungo conveniente per flussi di lavoro agentici affidabili con più skill, attività di ingegneria e automazione d'ufficio.
DeepSeek
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| DeepSeek V4 Pro | $0.435 | $0.87 | - | $0.003625 |
DeepSeek V4 Pro (deepseek-v4-pro) Modello avanzato per ragionamento matematico e logico, programmazione e analisi a contesto lungo.
Qwen
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| Qwen3.7-Plus | $0.1794 | $0.7157 | $0.00 | $0.0364 |
Qwen3.7-Plus (qwen3.7-plus) Modello multimodale conveniente per input di testo, immagini e video, con solide capacità agentiche e visione-linguaggio.
Z.AI (serie GLM)
| Modello | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|
| GLM-5.2 | $1.40 | $4.40 | - | $0.26 |
GLM-5.2 (glm-5.2) Modello di ingegneria a contesto lungo per comprendere codice su scala di progetto, eseguire in modo stabile attività lunghe e implementare rispettando gli standard.
Panoramica dei prezzi
La tabella seguente riepiloga i prezzi principali per tutti i modelli attualmente abilitati, ordinati per prezzo output decrescente per facilitare il confronto:
| Modello | Provider | Input ($/1M) | Output ($/1M) | Scrittura cache ($/1M) | Lettura cache ($/1M) |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | $12.50 | $1.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $6.25 | $0.50 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | - | $0.50 |
| Claude Opus 5 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.7 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| Claude Opus 4.6 | Anthropic | $5.00 | $25.00 | $6.25 | $0.50 |
| GPT-5.4 | OpenAI | $2.50 | $15.00 | - | $0.25 |
| Claude Sonnet 4.6 | Anthropic | $3.00 | $15.00 | $3.75 | $0.30 |
| Kimi K3 | Moonshot | $3.00 | $15.00 | - | $0.30 |
| GPT-5.3 Codex | OpenAI | $1.75 | $14.00 | - | $0.175 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | $2.50 | $0.20 |
| Gemini 3.1 Pro | $2.00 | $12.00 | - | $0.20 | |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $2.50 | $0.20 |
| Gemini 3.6 Flash | $1.50 | $7.50 | - | $0.15 | |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $1.25 | $0.10 |
| GPT-5.4 mini | OpenAI | $0.75 | $4.50 | - | $0.075 |
| GLM-5.2 | Z.AI | $1.40 | $4.40 | - | $0.26 |
| Kimi K2.7 Code | Moonshot | $0.95 | $4.00 | - | $0.19 |
| Gemini 3 Flash | $0.50 | $3.00 | - | $0.05 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | - | $0.03 | |
| MiniMax M3 | MiniMax | $0.60 | $2.40 | - | $0.12 |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | $0.25 | $0.02 |
| DeepSeek V4 Pro | DeepSeek | $0.435 | $0.87 | - | $0.003625 |
| Qwen3.7-Plus | Qwen | $0.1794 | $0.7157 | $0.00 | $0.0364 |