Kostenloses Werkzeug
LLM-Kostenrechner
Geben Sie Ihr monatliches Anfragevolumen und die durchschnittlichen Token-Längen ein, um den realen Kostenunterschied zwischen Modellen zu sehen — inklusive Cache-Trefferquote.
Ihr Nutzungsprofil
Anteil des wiederholten System-Prompts und Kontexts, der aus dem Cache bedient wird.
Preise in USD pro Million Token, entnommen den Preisseiten der jeweiligen Anbieter. Nur indikativ — kein Angebot. Anbieterspezifische Cache-Rabatte sind berücksichtigt; Kosten für Cache-Schreibvorgänge sowie Aktions- oder Kontextstufen-Unterschiede nicht.
Preisstand: 2026-08-18
Geschätzte Monatskosten
Mistral Small 4am günstigsten
Mistral · $0.15/$0.6 · $0.015
$127
Monatlich · $0.0006 pro anfrage
GPT-5.6 Luna
OpenAI · $0.2/$1.2 · $0.02
$218
Monatlich · $0.0011 pro anfrage · 1.7× vs. günstigstes
DeepSeek V4 Flash
DeepSeek · $0.44/$1.32 · $0.014
$306
Monatlich · $0.0015 pro anfrage · 2.4× vs. günstigstes
Preis zu Spitzenzeiten; bei einem Cache-Treffer sinken die Eingabekosten nahezu auf null.
Mistral Large 3
Mistral · $0.5/$1.5 · $0.05
$364
Monatlich · $0.0018 pro anfrage · 2.9× vs. günstigstes
Gemini 3.5 Flash-Lite
Google · $0.3/$2.5 · $0.03
$410
Monatlich · $0.0021 pro anfrage · 3.2× vs. günstigstes
Gemini 3.7 Flash
Google · $0.75/$3.75 · $0.075
$726
Monatlich · $0.0036 pro anfrage · 5.7× vs. günstigstes
Einführungspreis bis 31. Dezember 2026; danach verdoppelt er sich.
Grok 4.3
xAI · $1.25/$2.5 · $0.2
$796
Monatlich · $0.004 pro anfrage · 6.3× vs. günstigstes
GPT-5.4 mini
OpenAI · $0.75/$4.5 · $0.075
$816
Monatlich · $0.0041 pro anfrage · 6.4× vs. günstigstes
DeepSeek V4 Pro
DeepSeek · $1.32/$3.96 · $0.044
$919
Monatlich · $0.0046 pro anfrage · 7.2× vs. günstigstes
Preis zu Spitzenzeiten; außerhalb der Spitzenzeiten wird die Hälfte berechnet.
Claude Haiku 4.5
Anthropic · $1/$5 · $0.1
$968
Monatlich · $0.0048 pro anfrage · 7.6× vs. günstigstes
Mistral Medium 3.5
Mistral · $1.5/$7.5 · $0.15
$1,452
Monatlich · $0.0073 pro anfrage · 11.4× vs. günstigstes
Grok 4.6
xAI · $2/$6 · $0.5
$1,600
Monatlich · $0.008 pro anfrage · 12.6× vs. günstigstes
Ab einem Prompt von 200k Token verdoppelt sich der Preis.
Gemini 3.5 Flash
Google · $1.5/$9 · $0.15
$1,632
Monatlich · $0.0082 pro anfrage · 12.8× vs. günstigstes
GPT-5.6 Terra
OpenAI · $2/$12 · $0.2
$2,176
Monatlich · $0.0109 pro anfrage · 17.1× vs. günstigstes
Gemini 3.1 Pro
Google · $2/$12 · $0.2
$2,176
Monatlich · $0.0109 pro anfrage · 17.1× vs. günstigstes
Ab einem Prompt von 200k Token steigen die Eingabe- und Ausgabepreise.
Claude Sonnet 5
Anthropic · $3/$15 · $0.3
$2,904
Monatlich · $0.0145 pro anfrage · 22.8× vs. günstigstes
Die beste Balance aus Geschwindigkeit und Intelligenz; bei Coding und Agenten-Aufgaben nah an Opus.
Claude Opus 5
Anthropic · $5/$25 · $0.5
$4,840
Monatlich · $0.0242 pro anfrage · 38.1× vs. günstigstes
Der Standard für komplexes agentisches Coding und Unternehmensaufgaben.
GPT-5.6 Sol
OpenAI · $5/$30 · $0.5
$5,440
Monatlich · $0.0272 pro anfrage · 42.8× vs. günstigstes
Claude Fable 5
Anthropic · $10/$50 · $1
$9,680
Monatlich · $0.0484 pro anfrage · 76.1× vs. günstigstes
Für die anspruchsvollsten Reasoning- und langlaufenden Agenten-Aufgaben.
GPT-5.5 Pro
OpenAI · $30/$180 · kein Cache-Rabatt
$45,600
Monatlich · $0.228 pro anfrage · 358.5× vs. günstigstes
Kein Cache-Rabatt — die Kosten steigen bei Long-Context-Workloads schnell an.
Senken wir die Kosten über die Architektur
Die Modellwahl ist nur ein Teil der Kosten. Cache-Strategie, Kontextlänge und Routing-Architektur machen meist den größeren Unterschied.