Verdent Docs

Modellpreise

Verstehen Sie, wie Verdent-Credits mit der Token-Preisgestaltung der Anbieter zusammenhängen und wo Sie aktuelle Modellpreise einsehen können

Diese Seite gilt sowohl für Verdent Desktop als auch für Verdent for VS Code.

Überblick

Verdent integriert modernste große Sprachmodelle der weltweit führenden KI-Labore, darunter Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen und Z.AI (GLM). Damit Nutzer die Kosten hinter jeder KI-Interaktion nachvollziehen können, legen wir in diesem Dokument die Token-Preise der Anbieter für die aktuelle integrierte Modellpalette von Verdent offen.

Alle aufgeführten Preise sind die von den Anbietern veröffentlichten Preise in US-Dollar ($) pro einer Million Token (1M Token). Die Modellpalette wurde am 31. Juli 2026 gegen den live Modellkatalog von Verdent abgeglichen.

Sofern nicht anders angegeben, verwenden die Tabellen jeweils den bezahlten Standardtarif der Anbieter mit kurzem Kontext. Bei den Cache-Schreibpreisen von Claude wird die fünfminütige Cache-Dauer zugrunde gelegt. Ein Bindestrich (-) bedeutet, dass der Anbieter für diese Komponente keinen gesonderten Preis veröffentlicht. Zentrale Preisquellen sind Anthropic, OpenAI, Google, Kimi, MiniMax und DeepSeek.

Kernkonzepte

Token

Ein Token ist die grundlegende Verarbeitungseinheit für Text bei großen Sprachmodellen. Ein Token entspricht ungefähr 4 englischen Zeichen oder 1-2 chinesischen Zeichen. Die Modellpreise basieren auf der Anzahl der verbrauchten Input- und Output-Token, die getrennt abgerechnet werden.

Abrechnungsmodell

Alle Modelle auf Verdent verwenden derzeit ein Abrechnungsmodell pro Token. Das bedeutet, Ihnen wird die tatsächliche Anzahl der bei jeder Interaktion verbrauchten Input- und Output-Token berechnet.

Preiskomponenten

Die Preisgestaltung jedes Modells umfasst folgende Dimensionen:

  • Input-Preis: Die Kosten pro Token für den an das Modell gesendeten Prompt (Nutzernachricht und Kontext).
  • Output-Preis: Die Kosten pro Token für die vom Modell generierte Antwort. In der Regel höher als der Input-Preis.
  • Cache-Schreibpreis: Manche Modelle unterstützen Prompt-Caching. Dies sind die Kosten pro Token beim erstmaligen Anlegen eines Cache-Eintrags.
  • Cache-Lesepreis: Die Kosten pro Token bei einem Treffer auf einen bestehenden Cache-Eintrag. In der Regel deutlich niedriger als der Standard-Input-Preis, wodurch Kosten für wiederkehrende Kontexte effektiv gesenkt werden.

Details zur Modellpreisgestaltung

Nachfolgend finden Sie die Anbieterpreise für alle derzeit auf Verdent verfügbaren Modelle, gegliedert nach Anbieter. Alle Preise sind in USD pro 1M Token angegeben.

Anthropic (Claude-Serie)

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
Claude Fable 5$10.00$50.00$12.50$1.00
Claude Opus 5$5.00$25.00$6.25$0.50
Claude Opus 4.8$5.00$25.00$6.25$0.50
Claude Opus 4.7$5.00$25.00$6.25$0.50
Claude Opus 4.6$5.00$25.00$6.25$0.50
Claude Sonnet 5$2.00$10.00$2.50$0.20
Claude Sonnet 4.6$3.00$15.00$3.75$0.30
Claude Haiku 4.5$1.00$5.00$1.25$0.10

Claude Sonnet 5 nutzt bis zum 31. August 2026 den Einführungspreis von Anthropic. Anthropic gibt den Standardpreis ab dem 1. September 2026 mit $3.00 Input, $15.00 Output, $3.75 Cache-Schreiben und $0.30 Cache-Lesen pro 1M Token an.

Claude Fable 5 (claude-fable-5) Das leistungsstärkste Modell von Anthropic für die anspruchsvollsten Wissensarbeits-, Coding- und agentenbasierten Aufgaben.

Claude Opus 5 (claude-opus-5) Neuestes Opus-Modell für anspruchsvolle Multi-Datei-Features, Refactorings, tiefgehendes Reasoning und durchgängiges agentenbasiertes Coding.

Claude Opus 4.8 (claude-opus-4-8) Leistungsstarkes Opus-Modell für komplexes Coding, agentenbasierte Aufgaben, Enterprise-Workflows und tiefgehendes mehrstufiges Reasoning.

Claude Opus 4.7 (claude-opus-4-7) Opus-Modell für langlaufende Agenten, mehrstufige Coding-Aufgaben und komplexe Wissensarbeit.

Claude Opus 4.6 (claude-opus-4-6) Opus-Modell der Flaggschiff-Klasse für komplexe Code-Architektur, tiefgehende Analysen und schwierige Problemlösungsaufgaben.

Claude Sonnet 5 (claude-sonnet-5) Neuestes Sonnet-Modell mit adaptivem Thinking für Coding, Agentenplanung, Long-Context-Analysen und Wissensarbeit.

Claude Sonnet 4.6 (claude-sonnet-4-6) Ausgewogenes Modell mit starker Leistung und wettbewerbsfähiger Preisgestaltung; empfohlen für die tägliche Entwicklung.

Claude Haiku 4.5 (claude-haiku-4-5@20251001) Schnelles und schlankes Modell mit geringer Latenz. Ideal für einfache Konversationen, schnelle Abfragen und kostensensitive Aufgaben.

OpenAI (GPT-Serie)

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
GPT-5.6 Sol$5.00$30.00$6.25$0.50
GPT-5.6 Terra$2.00$12.00$2.50$0.20
GPT-5.6 Luna$0.20$1.20$0.25$0.02
GPT-5.5$5.00$30.00-$0.50
GPT-5.4$2.50$15.00-$0.25
GPT-5.4 mini$0.75$4.50-$0.075
GPT-5.3 Codex$1.75$14.00-$0.175

GPT-5.6 Sol (gpt-5.6-sol) Führendes GPT-5.6-Modell für die anspruchsvollsten agentenbasierten Coding- und Reasoning-Aufgaben.

GPT-5.6 Terra (gpt-5.6-terra) Ausgewogenes GPT-5.6-Modell für starkes alltägliches Coding, Tool-Nutzung und Reasoning zu geringeren Kosten.

GPT-5.6 Luna (gpt-5.6-luna) Schnelles, sehr kosteneffizientes GPT-5.6-Modell für Routineentwicklung, Subagenten und Workflows mit hohem Durchsatz.

GPT-5.5 (gpt-5.5) Führendes GPT-Modell, geeignet für Reasoning, Codegenerierung und mehrstufige Analyse-Workloads.

GPT-5.4 (gpt-5.4) Flaggschiff-GPT-Modell mit starkem Reasoning und hoher Qualität bei der Codegenerierung.

GPT-5.4 mini (gpt-5.4-mini) Effizientes GPT-Modell für Workloads mit hohem Durchsatz, Subagenten und kostensensitive Coding-Aufgaben.

GPT-5.3 Codex (gpt-5.3-codex) Auf Code spezialisiertes Modell, optimiert für Programmieraufgaben, einschließlich groß angelegter Codegenerierung und Refactoring.

Google (Gemini-Serie)

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
Gemini 3.6 Flash$1.50$7.50-$0.15
Gemini 3.5 Flash-Lite$0.30$2.50-$0.03
Gemini 3.1 Pro$2.00$12.00-$0.20
Gemini 3 Flash$0.50$3.00-$0.05

Gemini 3.6 Flash (gemini-3.6-flash) Schnelles, führendes Gemini-Modell mit verbessertem Coding, Wissen, multimodalem Verständnis und Token-Effizienz.

Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) Kosteneffizientes Gemini-Modell für agentenbasierte Ausführung mit hohem Durchsatz und leichte Workloads.

Gemini 3.1 Pro (gemini-3.1-pro-preview) Professionelles Modell mit starkem Reasoning, geeignet für komplexe Analysen und tiefgehende Denkaufgaben.

Gemini 3 Flash (gemini-3-flash-preview) Ultraschnelles Modell mit exzellenter Kosteneffizienz. Ideal für die Stapelverarbeitung mit hohem Volumen.

Moonshot (Kimi-Serie)

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
Kimi K3$3.00$15.00-$0.30
Kimi K2.7 Code$0.95$4.00-$0.19

Kimi K3 (kimi-k3) Das leistungsstärkste Coding-Modell von Moonshot mit verbesserter Long-Context-Zuverlässigkeit für komplexe agentenbasierte Workflows.

Kimi K2.7 Code (kimi-k2.7-code) Auf Coding fokussiertes Kimi-Modell für Long-Context-Programmieraufgaben und agentenbasierte Code-Workflows.

MiniMax

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
MiniMax M3$0.60$2.40-$0.12

MiniMax M3 (MiniMax-M3) Kosteneffizientes Long-Context-Modell für zuverlässige Multi-Skill-Agenten-Workflows, Engineering-Aufgaben und Büroautomatisierung.

DeepSeek

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
DeepSeek V4 Pro$0.435$0.87-$0.003625

DeepSeek V4 Pro (deepseek-v4-pro) Fortschrittliches Modell für mathematisches und logisches Reasoning, Coding und Long-Context-Analysen.

Qwen

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
Qwen3.7-Plus$0.1794$0.7157$0.00$0.0364

Qwen3.7-Plus (qwen3.7-plus) Kosteneffizientes multimodales Modell für Text-, Bild- und Video-Eingaben mit starken agentenbasierten und vision-language-basierten Fähigkeiten.

Z.AI (GLM-Serie)

ModellInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
GLM-5.2$1.40$4.40-$0.26

GLM-5.2 (glm-5.2) Long-Context-Engineering-Modell für Codeverständnis auf Projektebene, stabile Ausführung von Langzeitaufgaben und standardkonforme Umsetzungsarbeit.

Preisübersicht

Die folgende Tabelle fasst die Kernpreise für alle derzeit aktivierten Modelle zusammen, absteigend nach Output-Preis sortiert, zum einfachen Vergleich:

ModellAnbieterInput ($/1M)Output ($/1M)Cache-Schreiben ($/1M)Cache-Lesen ($/1M)
Claude Fable 5Anthropic$10.00$50.00$12.50$1.00
GPT-5.6 SolOpenAI$5.00$30.00$6.25$0.50
GPT-5.5OpenAI$5.00$30.00-$0.50
Claude Opus 5Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.8Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.7Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.6Anthropic$5.00$25.00$6.25$0.50
GPT-5.4OpenAI$2.50$15.00-$0.25
Claude Sonnet 4.6Anthropic$3.00$15.00$3.75$0.30
Kimi K3Moonshot$3.00$15.00-$0.30
GPT-5.3 CodexOpenAI$1.75$14.00-$0.175
GPT-5.6 TerraOpenAI$2.00$12.00$2.50$0.20
Gemini 3.1 ProGoogle$2.00$12.00-$0.20
Claude Sonnet 5Anthropic$2.00$10.00$2.50$0.20
Gemini 3.6 FlashGoogle$1.50$7.50-$0.15
Claude Haiku 4.5Anthropic$1.00$5.00$1.25$0.10
GPT-5.4 miniOpenAI$0.75$4.50-$0.075
GLM-5.2Z.AI$1.40$4.40-$0.26
Kimi K2.7 CodeMoonshot$0.95$4.00-$0.19
Gemini 3 FlashGoogle$0.50$3.00-$0.05
Gemini 3.5 Flash-LiteGoogle$0.30$2.50-$0.03
MiniMax M3MiniMax$0.60$2.40-$0.12
GPT-5.6 LunaOpenAI$0.20$1.20$0.25$0.02
DeepSeek V4 ProDeepSeek$0.435$0.87-$0.003625
Qwen3.7-PlusQwen$0.1794$0.7157$0.00$0.0364