# Modellpreise (/de/docs/account-billing/model-pricing)

> Verstehen Sie, wie Verdent-Credits mit der Token-Preisgestaltung der Anbieter zusammenhängen und wo Sie aktuelle Modellpreise einsehen können



<Note>
  Diese Seite gilt sowohl für Verdent Desktop als auch für Verdent for VS Code.
</Note>

## Überblick [#überblick]

Verdent integriert modernste große Sprachmodelle der weltweit führenden KI-Labore, darunter Anthropic (Claude), OpenAI (GPT), Google (Gemini), Moonshot (Kimi), MiniMax, DeepSeek, Qwen und Z.AI (GLM). Damit Nutzer die Kosten hinter jeder KI-Interaktion nachvollziehen können, legen wir in diesem Dokument die Token-Preise der Anbieter für die aktuelle integrierte Modellpalette von Verdent offen.

Alle aufgeführten Preise sind die von den Anbietern veröffentlichten Preise in US-Dollar ($) pro einer Million Token (1M Token). Die Modellpalette wurde am **31. Juli 2026** gegen den [live Modellkatalog von Verdent](https://llm-proxy.verdent.ai/config/model_list) abgeglichen.

Sofern nicht anders angegeben, verwenden die Tabellen jeweils den bezahlten Standardtarif der Anbieter mit kurzem Kontext. Bei den Cache-Schreibpreisen von Claude wird die fünfminütige Cache-Dauer zugrunde gelegt. Ein Bindestrich (`-`) bedeutet, dass der Anbieter für diese Komponente keinen gesonderten Preis veröffentlicht. Zentrale Preisquellen sind [Anthropic](https://platform.claude.com/docs/en/about-claude/pricing), [OpenAI](https://developers.openai.com/api/docs/pricing), [Google](https://ai.google.dev/gemini-api/docs/pricing), [Kimi](https://platform.kimi.ai/docs/pricing/chat-k3), [MiniMax](https://platform.minimax.io/subscribe/token-plan?tab=api-enterprise) und [DeepSeek](https://api-docs.deepseek.com/quick_start/pricing).

## Kernkonzepte [#kernkonzepte]

### Token [#token]

Ein Token ist die grundlegende Verarbeitungseinheit für Text bei großen Sprachmodellen. Ein Token entspricht ungefähr 4 englischen Zeichen oder 1-2 chinesischen Zeichen. Die Modellpreise basieren auf der Anzahl der verbrauchten Input- und Output-Token, die getrennt abgerechnet werden.

### Abrechnungsmodell [#abrechnungsmodell]

Alle Modelle auf Verdent verwenden derzeit ein Abrechnungsmodell pro Token. Das bedeutet, Ihnen wird die tatsächliche Anzahl der bei jeder Interaktion verbrauchten Input- und Output-Token berechnet.

### Preiskomponenten [#preiskomponenten]

Die Preisgestaltung jedes Modells umfasst folgende Dimensionen:

* **Input-Preis:** Die Kosten pro Token für den an das Modell gesendeten Prompt (Nutzernachricht und Kontext).
* **Output-Preis:** Die Kosten pro Token für die vom Modell generierte Antwort. In der Regel höher als der Input-Preis.
* **Cache-Schreibpreis:** Manche Modelle unterstützen Prompt-Caching. Dies sind die Kosten pro Token beim erstmaligen Anlegen eines Cache-Eintrags.
* **Cache-Lesepreis:** Die Kosten pro Token bei einem Treffer auf einen bestehenden Cache-Eintrag. In der Regel deutlich niedriger als der Standard-Input-Preis, wodurch Kosten für wiederkehrende Kontexte effektiv gesenkt werden.

## Details zur Modellpreisgestaltung [#details-zur-modellpreisgestaltung]

Nachfolgend finden Sie die Anbieterpreise für alle derzeit auf Verdent verfügbaren Modelle, gegliedert nach Anbieter. Alle Preise sind in USD pro 1M Token angegeben.

### Anthropic (Claude-Serie) [#anthropic-claude-serie]

| **Modell**        | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| ----------------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| Claude Fable 5    | $10.00           | $50.00            | $12.50                     | $1.00                  |
| Claude Opus 5     | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.8   | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.7   | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.6   | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Sonnet 5   | $2.00            | $10.00            | $2.50                      | $0.20                  |
| Claude Sonnet 4.6 | $3.00            | $15.00            | $3.75                      | $0.30                  |
| Claude Haiku 4.5  | $1.00            | $5.00             | $1.25                      | $0.10                  |

<Note>
  Claude Sonnet 5 nutzt bis zum 31. August 2026 den Einführungspreis von Anthropic. Anthropic gibt den Standardpreis ab dem 1. September 2026 mit $3.00 Input, $15.00 Output, $3.75 Cache-Schreiben und $0.30 Cache-Lesen pro 1M Token an.
</Note>

**Claude Fable 5** (claude-fable-5)
Das leistungsstärkste Modell von Anthropic für die anspruchsvollsten Wissensarbeits-, Coding- und agentenbasierten Aufgaben.

**Claude Opus 5** (claude-opus-5)
Neuestes Opus-Modell für anspruchsvolle Multi-Datei-Features, Refactorings, tiefgehendes Reasoning und durchgängiges agentenbasiertes Coding.

**Claude Opus 4.8** (claude-opus-4-8)
Leistungsstarkes Opus-Modell für komplexes Coding, agentenbasierte Aufgaben, Enterprise-Workflows und tiefgehendes mehrstufiges Reasoning.

**Claude Opus 4.7** (claude-opus-4-7)
Opus-Modell für langlaufende Agenten, mehrstufige Coding-Aufgaben und komplexe Wissensarbeit.

**Claude Opus 4.6** (claude-opus-4-6)
Opus-Modell der Flaggschiff-Klasse für komplexe Code-Architektur, tiefgehende Analysen und schwierige Problemlösungsaufgaben.

**Claude Sonnet 5** (claude-sonnet-5)
Neuestes Sonnet-Modell mit adaptivem Thinking für Coding, Agentenplanung, Long-Context-Analysen und Wissensarbeit.

**Claude Sonnet 4.6** (claude-sonnet-4-6)
Ausgewogenes Modell mit starker Leistung und wettbewerbsfähiger Preisgestaltung; empfohlen für die tägliche Entwicklung.

**Claude Haiku 4.5** (claude-haiku-4-5\@20251001)
Schnelles und schlankes Modell mit geringer Latenz. Ideal für einfache Konversationen, schnelle Abfragen und kostensensitive Aufgaben.

### OpenAI (GPT-Serie) [#openai-gpt-serie]

| **Modell**    | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| ------------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| GPT-5.6 Sol   | $5.00            | $30.00            | $6.25                      | $0.50                  |
| GPT-5.6 Terra | $2.00            | $12.00            | $2.50                      | $0.20                  |
| GPT-5.6 Luna  | $0.20            | $1.20             | $0.25                      | $0.02                  |
| GPT-5.5       | $5.00            | $30.00            | -                          | $0.50                  |
| GPT-5.4       | $2.50            | $15.00            | -                          | $0.25                  |
| GPT-5.4 mini  | $0.75            | $4.50             | -                          | $0.075                 |
| GPT-5.3 Codex | $1.75            | $14.00            | -                          | $0.175                 |

**GPT-5.6 Sol** (gpt-5.6-sol)
Führendes GPT-5.6-Modell für die anspruchsvollsten agentenbasierten Coding- und Reasoning-Aufgaben.

**GPT-5.6 Terra** (gpt-5.6-terra)
Ausgewogenes GPT-5.6-Modell für starkes alltägliches Coding, Tool-Nutzung und Reasoning zu geringeren Kosten.

**GPT-5.6 Luna** (gpt-5.6-luna)
Schnelles, sehr kosteneffizientes GPT-5.6-Modell für Routineentwicklung, Subagenten und Workflows mit hohem Durchsatz.

**GPT-5.5** (gpt-5.5)
Führendes GPT-Modell, geeignet für Reasoning, Codegenerierung und mehrstufige Analyse-Workloads.

**GPT-5.4** (gpt-5.4)
Flaggschiff-GPT-Modell mit starkem Reasoning und hoher Qualität bei der Codegenerierung.

**GPT-5.4 mini** (gpt-5.4-mini)
Effizientes GPT-Modell für Workloads mit hohem Durchsatz, Subagenten und kostensensitive Coding-Aufgaben.

**GPT-5.3 Codex** (gpt-5.3-codex)
Auf Code spezialisiertes Modell, optimiert für Programmieraufgaben, einschließlich groß angelegter Codegenerierung und Refactoring.

### Google (Gemini-Serie) [#google-gemini-serie]

| **Modell**            | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| --------------------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| Gemini 3.6 Flash      | $1.50            | $7.50             | -                          | $0.15                  |
| Gemini 3.5 Flash-Lite | $0.30            | $2.50             | -                          | $0.03                  |
| Gemini 3.1 Pro        | $2.00            | $12.00            | -                          | $0.20                  |
| Gemini 3 Flash        | $0.50            | $3.00             | -                          | $0.05                  |

**Gemini 3.6 Flash** (gemini-3.6-flash)
Schnelles, führendes Gemini-Modell mit verbessertem Coding, Wissen, multimodalem Verständnis und Token-Effizienz.

**Gemini 3.5 Flash-Lite** (gemini-3.5-flash-lite)
Kosteneffizientes Gemini-Modell für agentenbasierte Ausführung mit hohem Durchsatz und leichte Workloads.

**Gemini 3.1 Pro** (gemini-3.1-pro-preview)
Professionelles Modell mit starkem Reasoning, geeignet für komplexe Analysen und tiefgehende Denkaufgaben.

**Gemini 3 Flash** (gemini-3-flash-preview)
Ultraschnelles Modell mit exzellenter Kosteneffizienz. Ideal für die Stapelverarbeitung mit hohem Volumen.

### Moonshot (Kimi-Serie) [#moonshot-kimi-serie]

| **Modell**     | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| -------------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| Kimi K3        | $3.00            | $15.00            | -                          | $0.30                  |
| Kimi K2.7 Code | $0.95            | $4.00             | -                          | $0.19                  |

**Kimi K3** (kimi-k3)
Das leistungsstärkste Coding-Modell von Moonshot mit verbesserter Long-Context-Zuverlässigkeit für komplexe agentenbasierte Workflows.

**Kimi K2.7 Code** (kimi-k2.7-code)
Auf Coding fokussiertes Kimi-Modell für Long-Context-Programmieraufgaben und agentenbasierte Code-Workflows.

### MiniMax [#minimax]

| **Modell** | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| ---------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| MiniMax M3 | $0.60            | $2.40             | -                          | $0.12                  |

**MiniMax M3** (MiniMax-M3)
Kosteneffizientes Long-Context-Modell für zuverlässige Multi-Skill-Agenten-Workflows, Engineering-Aufgaben und Büroautomatisierung.

### DeepSeek [#deepseek]

| **Modell**      | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| --------------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| DeepSeek V4 Pro | $0.435           | $0.87             | -                          | $0.003625              |

**DeepSeek V4 Pro** (deepseek-v4-pro)
Fortschrittliches Modell für mathematisches und logisches Reasoning, Coding und Long-Context-Analysen.

### Qwen [#qwen]

| **Modell**   | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| ------------ | ---------------- | ----------------- | -------------------------- | ---------------------- |
| Qwen3.7-Plus | $0.1794          | $0.7157           | $0.00                      | $0.0364                |

**Qwen3.7-Plus** (qwen3.7-plus)
Kosteneffizientes multimodales Modell für Text-, Bild- und Video-Eingaben mit starken agentenbasierten und vision-language-basierten Fähigkeiten.

### Z.AI (GLM-Serie) [#zai-glm-serie]

| **Modell** | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| ---------- | ---------------- | ----------------- | -------------------------- | ---------------------- |
| GLM-5.2    | $1.40            | $4.40             | -                          | $0.26                  |

**GLM-5.2** (glm-5.2)
Long-Context-Engineering-Modell für Codeverständnis auf Projektebene, stabile Ausführung von Langzeitaufgaben und standardkonforme Umsetzungsarbeit.

## Preisübersicht [#preisübersicht]

Die folgende Tabelle fasst die Kernpreise für alle derzeit aktivierten Modelle zusammen, absteigend nach Output-Preis sortiert, zum einfachen Vergleich:

| **Modell**            | **Anbieter** | **Input ($/1M)** | **Output ($/1M)** | **Cache-Schreiben ($/1M)** | **Cache-Lesen ($/1M)** |
| --------------------- | ------------ | ---------------- | ----------------- | -------------------------- | ---------------------- |
| Claude Fable 5        | Anthropic    | $10.00           | $50.00            | $12.50                     | $1.00                  |
| GPT-5.6 Sol           | OpenAI       | $5.00            | $30.00            | $6.25                      | $0.50                  |
| GPT-5.5               | OpenAI       | $5.00            | $30.00            | -                          | $0.50                  |
| Claude Opus 5         | Anthropic    | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.8       | Anthropic    | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.7       | Anthropic    | $5.00            | $25.00            | $6.25                      | $0.50                  |
| Claude Opus 4.6       | Anthropic    | $5.00            | $25.00            | $6.25                      | $0.50                  |
| GPT-5.4               | OpenAI       | $2.50            | $15.00            | -                          | $0.25                  |
| Claude Sonnet 4.6     | Anthropic    | $3.00            | $15.00            | $3.75                      | $0.30                  |
| Kimi K3               | Moonshot     | $3.00            | $15.00            | -                          | $0.30                  |
| GPT-5.3 Codex         | OpenAI       | $1.75            | $14.00            | -                          | $0.175                 |
| GPT-5.6 Terra         | OpenAI       | $2.00            | $12.00            | $2.50                      | $0.20                  |
| Gemini 3.1 Pro        | Google       | $2.00            | $12.00            | -                          | $0.20                  |
| Claude Sonnet 5       | Anthropic    | $2.00            | $10.00            | $2.50                      | $0.20                  |
| Gemini 3.6 Flash      | Google       | $1.50            | $7.50             | -                          | $0.15                  |
| Claude Haiku 4.5      | Anthropic    | $1.00            | $5.00             | $1.25                      | $0.10                  |
| GPT-5.4 mini          | OpenAI       | $0.75            | $4.50             | -                          | $0.075                 |
| GLM-5.2               | Z.AI         | $1.40            | $4.40             | -                          | $0.26                  |
| Kimi K2.7 Code        | Moonshot     | $0.95            | $4.00             | -                          | $0.19                  |
| Gemini 3 Flash        | Google       | $0.50            | $3.00             | -                          | $0.05                  |
| Gemini 3.5 Flash-Lite | Google       | $0.30            | $2.50             | -                          | $0.03                  |
| MiniMax M3            | MiniMax      | $0.60            | $2.40             | -                          | $0.12                  |
| GPT-5.6 Luna          | OpenAI       | $0.20            | $1.20             | $0.25                      | $0.02                  |
| DeepSeek V4 Pro       | DeepSeek     | $0.435           | $0.87             | -                          | $0.003625              |
| Qwen3.7-Plus          | Qwen         | $0.1794          | $0.7157           | $0.00                      | $0.0364                |
