Zum Inhalt springen

Kostenloses Werkzeug

LLM-Kostenrechner

Geben Sie Ihr monatliches Anfragevolumen und die durchschnittlichen Token-Längen ein, um den realen Kostenunterschied zwischen Modellen zu sehen — inklusive Cache-Trefferquote.

Ihr Nutzungsprofil

200,000
4,000
600
%60

Anteil des wiederholten System-Prompts und Kontexts, der aus dem Cache bedient wird.

Preise in USD pro Million Token, entnommen den Preisseiten der jeweiligen Anbieter. Nur indikativ — kein Angebot. Anbieterspezifische Cache-Rabatte sind berücksichtigt; Kosten für Cache-Schreibvorgänge sowie Aktions- oder Kontextstufen-Unterschiede nicht.
Preisstand: 2026-08-18

Geschätzte Monatskosten

  • Mistral Small 4am günstigsten

    Mistral · $0.15/$0.6 · $0.015

    $127

    Monatlich · $0.0006 pro anfrage

  • GPT-5.6 Luna

    OpenAI · $0.2/$1.2 · $0.02

    $218

    Monatlich · $0.0011 pro anfrage · 1.7× vs. günstigstes

  • DeepSeek V4 Flash

    DeepSeek · $0.44/$1.32 · $0.014

    $306

    Monatlich · $0.0015 pro anfrage · 2.4× vs. günstigstes

    Preis zu Spitzenzeiten; bei einem Cache-Treffer sinken die Eingabekosten nahezu auf null.

  • Mistral Large 3

    Mistral · $0.5/$1.5 · $0.05

    $364

    Monatlich · $0.0018 pro anfrage · 2.9× vs. günstigstes

  • Gemini 3.5 Flash-Lite

    Google · $0.3/$2.5 · $0.03

    $410

    Monatlich · $0.0021 pro anfrage · 3.2× vs. günstigstes

  • Gemini 3.7 Flash

    Google · $0.75/$3.75 · $0.075

    $726

    Monatlich · $0.0036 pro anfrage · 5.7× vs. günstigstes

    Einführungspreis bis 31. Dezember 2026; danach verdoppelt er sich.

  • Grok 4.3

    xAI · $1.25/$2.5 · $0.2

    $796

    Monatlich · $0.004 pro anfrage · 6.3× vs. günstigstes

  • GPT-5.4 mini

    OpenAI · $0.75/$4.5 · $0.075

    $816

    Monatlich · $0.0041 pro anfrage · 6.4× vs. günstigstes

  • DeepSeek V4 Pro

    DeepSeek · $1.32/$3.96 · $0.044

    $919

    Monatlich · $0.0046 pro anfrage · 7.2× vs. günstigstes

    Preis zu Spitzenzeiten; außerhalb der Spitzenzeiten wird die Hälfte berechnet.

  • Claude Haiku 4.5

    Anthropic · $1/$5 · $0.1

    $968

    Monatlich · $0.0048 pro anfrage · 7.6× vs. günstigstes

  • Mistral Medium 3.5

    Mistral · $1.5/$7.5 · $0.15

    $1,452

    Monatlich · $0.0073 pro anfrage · 11.4× vs. günstigstes

  • Grok 4.6

    xAI · $2/$6 · $0.5

    $1,600

    Monatlich · $0.008 pro anfrage · 12.6× vs. günstigstes

    Ab einem Prompt von 200k Token verdoppelt sich der Preis.

  • Gemini 3.5 Flash

    Google · $1.5/$9 · $0.15

    $1,632

    Monatlich · $0.0082 pro anfrage · 12.8× vs. günstigstes

  • GPT-5.6 Terra

    OpenAI · $2/$12 · $0.2

    $2,176

    Monatlich · $0.0109 pro anfrage · 17.1× vs. günstigstes

  • Gemini 3.1 Pro

    Google · $2/$12 · $0.2

    $2,176

    Monatlich · $0.0109 pro anfrage · 17.1× vs. günstigstes

    Ab einem Prompt von 200k Token steigen die Eingabe- und Ausgabepreise.

  • Claude Sonnet 5

    Anthropic · $3/$15 · $0.3

    $2,904

    Monatlich · $0.0145 pro anfrage · 22.8× vs. günstigstes

    Die beste Balance aus Geschwindigkeit und Intelligenz; bei Coding und Agenten-Aufgaben nah an Opus.

  • Claude Opus 5

    Anthropic · $5/$25 · $0.5

    $4,840

    Monatlich · $0.0242 pro anfrage · 38.1× vs. günstigstes

    Der Standard für komplexes agentisches Coding und Unternehmensaufgaben.

  • GPT-5.6 Sol

    OpenAI · $5/$30 · $0.5

    $5,440

    Monatlich · $0.0272 pro anfrage · 42.8× vs. günstigstes

  • Claude Fable 5

    Anthropic · $10/$50 · $1

    $9,680

    Monatlich · $0.0484 pro anfrage · 76.1× vs. günstigstes

    Für die anspruchsvollsten Reasoning- und langlaufenden Agenten-Aufgaben.

  • GPT-5.5 Pro

    OpenAI · $30/$180 · kein Cache-Rabatt

    $45,600

    Monatlich · $0.228 pro anfrage · 358.5× vs. günstigstes

    Kein Cache-Rabatt — die Kosten steigen bei Long-Context-Workloads schnell an.

Senken wir die Kosten über die Architektur

Die Modellwahl ist nur ein Teil der Kosten. Cache-Strategie, Kontextlänge und Routing-Architektur machen meist den größeren Unterschied.