Auf einen Blick

Gemini 2.0 Flash von Google DeepMind ist ein Budget-Modell mit 0,10 $ pro 1 Mio. Input-Tokens und 0,40 $ pro 1 Mio. Output-Tokens. Bei einem typischen Solo-Entwicklertag (8 Stunden, 22 Tage pro Monat — 1 mittleres Feature, 5 kleine Bugfixes, 4 PR-Reviews, 2 Stacktrace-Debugs, 1500 Zeilen TypeScript, 1 Lesedurchgang großer Dokumente, mit Prompt-Caching im Standard-Mix) kostet Gemini 2.0 Flash rund 2 $ pro Monat. Das Kontextfenster reicht für 1.000K Tokens.

Was kauft dein Monatsbudget?

Regler bewegen oder Mix umschalten — Werte aktualisieren sich live.

Monatsbudget

100 $ / Monat

≈ $23/Woche · ≈ $4.55/Tag

auf Gemini 2.0 Flash

Aufgaben-Mix

Input-Tokens

1360,0M

Output-Tokens

37,5M

Tokens gesamt

1397,5M

Pro Monat liefert das Budget

  • Mittleres Feature (10–15 Dateien)3.118
  • PR-Review37.383
  • Zeilen TypeScript9.049.773
  • Kleiner Bugfix42.462
  • Geschäftliche E-Mail800.000
  • Unit-Test-Datei30.165
Im vollen Rechner öffnen

Wie teuer ist dieses Modell im Vergleich?

Input vs. Output pro 1M Tokens

Über eine Zeile fahren, um Input/Output direkt zu vergleichen.
  • Gemini 2.0 Flash
    0,10 $
    0,40 $
  • Budget-Median (andere Budget-Modelle)
    0,30 $
    1,50 $
Input pro 1MOutput pro 1M

Kosten pro Aufgabe

Beim Standard-Coding-Agent-Mix mit 50 % Cache-Hits.

USD pro einzelner Aufgabe

Mit der Maus über einen Balken fahren, um Detail-Kosten zu sehen.
  • Zeilen TypeScript
    0,0000 $
  • Kleiner Bugfix
    0,0024 $
  • PR-Review
    0,0027 $
  • Großes Dokument lesen
    0,0037 $
  • Debugging mit Stacktrace
    0,0048 $
  • Modul-Refactor (8–12 Dateien)
    0,0228 $
  • Mittleres Feature (10–15 Dateien)
    0,0321 $
  • Neues Repo einarbeiten
    0,0399 $

Typischer Entwicklertag

Die 22-Tage-Annahme pro Monat basiert auf der medianen Werktagezahl in DE/US.

AktivitätAnzahlPro AufgabePro TagPro Monat
Mittleres Feature (10–15 Dateien)10,03 $0,03 $0,71 $
Kleiner Bugfix50,00 $0,01 $0,26 $
PR-Review40,00 $0,01 $0,24 $
Debugging mit Stacktrace20,00 $0,01 $0,21 $
Großes Dokument lesen10,00 $0,00 $0,08 $
Mikro-Interaktion (Erklären / Lint-Fix)300,00 $0,00 $0,09 $
Zeilen TypeScript1.5000,00 $0,02 $0,36 $
Gesamt0,09 $1,95 $

Die Zeile „1500 Zeilen TS” deckt etwa 1000 Zeilen Lesezugriff (mit Cache-Treffer) und 500 Zeilen Schreibzugriff ab. Headline-Werte sind auf rund 5 % genau — siehe FAQ.

Monatsbudget-Matrix

Was jedes monatliche Budget auf diesem Modell kauft (typischer Solo-Entwicklertag, 22 Arbeitstage).

MonatsbudgetMittlere FeaturesPR-ReviewsDebug-SitzungenZeilen TS
Typisch (ca. 2 $)60730403176.791
50 $/Monat1.55918.69110.3254.524.886
200 $/Monat6.23774.76641.30018.099.547
500 $/Monat15.594186.915103.25245.248.868
2000 $/Monat62.378747.663413.009180.995.475

Typischer Mix: coding-agent (85 % Input, 50 % Cache-Hits). Werte zeigen die maximale Anzahl der jeweiligen Aufgabe bei diesem Budget.

Was das Modell kann

  • Coding

    Speziell für Code-Generierung trainiert oder nachtrainiert.

  • Reasoning

    Nicht verfügbar

  • Multimodal

    Akzeptiert Bilder zusätzlich zu Text.

  • Prompt-Cache

    Cache-Reads ~10 % des Input-Preises — senkt Agent-Kosten stark.

  • Batch-API

    50 % günstiger, wenn bis zu 24 h Wartezeit ok ist.

  • Tool-Use

    Native Function-Calling-/Tool-Use-API.

  • Langer Kontext

    Kontextfenster ≥ 200K Tokens.

  • Extended Thinking

    Nicht verfügbar

Wann passt dieses Modell?

Optimal für

  • Vorfilter / Klassifikator in Agent-Pipelines
  • Batch-Vorverarbeitung von Code (Lizenz-Scan, AST-Extraktion)
  • Kostenuntergrenze-Szenarien

Worauf achten

  • Coding-Qualität ist die niedrigste im Katalog — vor echten Änderungen eskalieren
  • Output-Kosten wachsen schnell bei langen Generierungen

Google DeepMind im Katalog

Modelle insgesamt

4

Median Input/1M

0,78 $

Median Output/1M

6,25 $

Input-Spannweite

0,10 $–2,00 $

Verwandte Modelle

Quellen

Häufige Fragen zu Gemini 2.0 Flash

Was kostet ein typischer Monat auf Gemini 2.0 Flash?

Bei dem realistischen Solo-Entwicklertag (1 mittleres Feature + 5 kleine Bugfixes + 4 PR-Reviews + 2 Debug-Sitzungen + 1500 Zeilen TypeScript + 1 großes Dokument lesen, 22 Werktage) kostet Gemini 2.0 Flash rund 2 $ pro Monat. Wer mehr macht, zahlt proportional mehr; wer weniger macht, weniger.

Wie groß ist das Kontextfenster von Gemini 2.0 Flash?

1.000K Tokens insgesamt, davon bis zu 8K Output. Das reicht für ganze Repository-Snapshots inklusive Tests in einem einzigen Aufruf.

Warum ist Output bei Gemini 2.0 Flash so viel teurer als Input?

Provider verlangen 0,40 $ pro 1 Mio. Output-Tokens gegenüber 0,10 $ pro 1 Mio. Input — Output erfordert tatsächliche Compute-Schritte, Input wird aus dem Cache gezogen. Coding-Agenten lesen viele Dateien (Input-lastig) und produzieren kompakte Diffs (wenig Output), deshalb sind die Gesamtkosten meist input-getrieben.

Wie viel spart Prompt-Caching bei Gemini 2.0 Flash?

Cache-Reads kosten typischerweise nur 10 % des regulären Input-Preises. Bei einem Coding-Agent-Mix mit 50 % Cache-Hits sparst du grob 45 % der Input-Kosten — was bei input-lastigen Workloads etwa 38 % der Gesamtrechnung ausmacht. Anthropic-Modelle berechnen einen einmaligen Cache-Write-Aufschlag (25 % über Input), der sich nach 2–3 Hits amortisiert.

Lohnt die Batch-API von Gemini 2.0 Flash?

Ja, wenn du bis zu 24 Stunden Wartezeit verkraftest: Batch-Input/Output sind 50 % günstiger als die Realtime-Preise. Ideal für nächtliche Code-Reviews, Bulk-Refactors oder Pre-Merge-Analysen — schlecht für inneren Edit-Loop, der Antworten in Sekunden braucht.

Gemini 2.0 Flash live ausprobieren

Öffne den vollständigen Rechner mit deinem eigenen Budget, Mix und Region (US oder DE mit 19 % MwSt.).

Rechner öffnen