Auf einen Blick

o3 von OpenAI ist ein Frontier-Modell mit 2,00 $ pro 1 Mio. Input-Tokens und 8,00 $ pro 1 Mio. Output-Tokens. Bei einem typischen Solo-Entwicklertag (8 Stunden, 22 Tage pro Monat — 1 mittleres Feature, 5 kleine Bugfixes, 4 PR-Reviews, 2 Stacktrace-Debugs, 1500 Zeilen TypeScript, 1 Lesedurchgang großer Dokumente, mit Prompt-Caching im Standard-Mix) kostet o3 rund 45 $ pro Monat. Das Kontextfenster reicht für 200K Tokens.

Was kauft dein Monatsbudget?

Regler bewegen oder Mix umschalten — Werte aktualisieren sich live.

Monatsbudget

100 $ / Monat

≈ $23/Woche · ≈ $4.55/Tag

auf o3

Aufgaben-Mix

Input-Tokens

68,0M

Output-Tokens

1,9M

Tokens gesamt

69,9M

Pro Monat liefert das Budget

  • Mittleres Feature (10–15 Dateien)135
  • PR-Review1.626
  • Zeilen TypeScript452.488
  • Kleiner Bugfix1.763
  • Geschäftliche E-Mail40.000
  • Unit-Test-Datei1.317
Im vollen Rechner öffnen

Wie teuer ist dieses Modell im Vergleich?

Input vs. Output pro 1M Tokens

Über eine Zeile fahren, um Input/Output direkt zu vergleichen.
  • o3
    2,00 $
    8,00 $
  • Frontier-Median (andere Frontier-Modelle)
    3,00 $
    15,00 $
  • Günstigstes im Katalog (Gemini 2.0 Flash)
    0,10 $
    0,40 $
Input pro 1MOutput pro 1M

Kosten pro Aufgabe

Beim Standard-Coding-Agent-Mix mit 50 % Cache-Hits.

USD pro einzelner Aufgabe

Mit der Maus über einen Balken fahren, um Detail-Kosten zu sehen.
  • Zeilen TypeScript
    0,0002 $
  • Kleiner Bugfix
    0,0567 $
  • PR-Review
    0,0615 $
  • Großes Dokument lesen
    0,0825 $
  • Debugging mit Stacktrace
    0,14 $
  • Modul-Refactor (8–12 Dateien)
    0,52 $
  • Mittleres Feature (10–15 Dateien)
    0,74 $
  • Neues Repo einarbeiten
    0,85 $

Typischer Entwicklertag

Die 22-Tage-Annahme pro Monat basiert auf der medianen Werktagezahl in DE/US.

AktivitätAnzahlPro AufgabePro TagPro Monat
Mittleres Feature (10–15 Dateien)10,74 $0,74 $16,22 $
Kleiner Bugfix50,06 $0,28 $6,24 $
PR-Review40,06 $0,25 $5,41 $
Debugging mit Stacktrace20,14 $0,28 $6,09 $
Großes Dokument lesen10,08 $0,08 $1,82 $
Mikro-Interaktion (Erklären / Lint-Fix)300,00 $0,09 $1,88 $
Zeilen TypeScript1.5000,00 $0,33 $7,29 $
Gesamt2,04 $44,95 $

Die Zeile „1500 Zeilen TS” deckt etwa 1000 Zeilen Lesezugriff (mit Cache-Treffer) und 500 Zeilen Schreibzugriff ab. Headline-Werte sind auf rund 5 % genau — siehe FAQ.

Monatsbudget-Matrix

Was jedes monatliche Budget auf diesem Modell kauft (typischer Solo-Entwicklertag, 22 Arbeitstage).

MonatsbudgetMittlere FeaturesPR-ReviewsDebug-SitzungenZeilen TS
Typisch (ca. 45 $)60730324203.390
50 $/Monat67813361226.244
200 $/Monat2713.2521.444904.977
500 $/Monat6788.1303.6112.262.443
2000 $/Monat2.71232.52014.4459.049.773

Typischer Mix: coding-agent (85 % Input, 50 % Cache-Hits). Werte zeigen die maximale Anzahl der jeweiligen Aufgabe bei diesem Budget.

Was das Modell kann

  • Coding

    Speziell für Code-Generierung trainiert oder nachtrainiert.

  • Reasoning

    Starkes mehrstufiges Reasoning bei komplexen Prompts.

  • Multimodal

    Akzeptiert Bilder zusätzlich zu Text.

  • Prompt-Cache

    Cache-Reads ~10 % des Input-Preises — senkt Agent-Kosten stark.

  • Batch-API

    50 % günstiger, wenn bis zu 24 h Wartezeit ok ist.

  • Tool-Use

    Native Function-Calling-/Tool-Use-API.

  • Langer Kontext

    Kontextfenster ≥ 200K Tokens.

  • Extended Thinking

    Versteckte Reasoning-Tokens (Anthropic „Thinking" / OpenAI Reasoning).

Wann passt dieses Modell?

Optimal für

  • Schwierige neue Probleme mit suchähnlichem Reasoning
  • Mathematik/algorithmisches Coding (Beweise, Optimierung, Parser)
  • One-Shot-'Find das raus'-Aufgaben, bei denen Iteration teuer ist

Worauf achten

  • Versteckte Thinking-Tokens zählen zum Output — Gesamt 2–10× höher als bei Nicht-Reasoning-Modellen
  • Langsamer (10–60 s pro Call) — schlecht für enge innere Schleifen

OpenAI im Katalog

Modelle insgesamt

6

Median Input/1M

1,63 $

Median Output/1M

8,00 $

Input-Spannweite

0,25 $–2,50 $

Verwandte Modelle

Quellen

Häufige Fragen zu o3

Was kostet ein typischer Monat auf o3?

Bei dem realistischen Solo-Entwicklertag (1 mittleres Feature + 5 kleine Bugfixes + 4 PR-Reviews + 2 Debug-Sitzungen + 1500 Zeilen TypeScript + 1 großes Dokument lesen, 22 Werktage) kostet o3 rund 45 $ pro Monat. Wer mehr macht, zahlt proportional mehr; wer weniger macht, weniger.

Wie groß ist das Kontextfenster von o3?

200K Tokens insgesamt, davon bis zu 100K Output. Das reicht für ganze Repository-Snapshots inklusive Tests in einem einzigen Aufruf.

Warum ist Output bei o3 so viel teurer als Input?

Provider verlangen 8,00 $ pro 1 Mio. Output-Tokens gegenüber 2,00 $ pro 1 Mio. Input — Output erfordert tatsächliche Compute-Schritte, Input wird aus dem Cache gezogen. Coding-Agenten lesen viele Dateien (Input-lastig) und produzieren kompakte Diffs (wenig Output), deshalb sind die Gesamtkosten meist input-getrieben.

Wie viel spart Prompt-Caching bei o3?

Cache-Reads kosten typischerweise nur 10 % des regulären Input-Preises. Bei einem Coding-Agent-Mix mit 50 % Cache-Hits sparst du grob 45 % der Input-Kosten — was bei input-lastigen Workloads etwa 38 % der Gesamtrechnung ausmacht. Anthropic-Modelle berechnen einen einmaligen Cache-Write-Aufschlag (25 % über Input), der sich nach 2–3 Hits amortisiert.

Wie wirken sich „Thinking"-Tokens bei o3 auf die Monatsrechnung aus?

Extended-Thinking-/Reasoning-Tokens werden zum vollen Output-Preis abgerechnet, sind aber für die Antwort im Klartext nicht sichtbar. Bei harten agentischen Aufgaben können sie die Output-Rechnung verdoppeln und damit den Monatswert um 20–30 % heben. Schalte Thinking nur ein, wenn die Standard-Antwort sichtbar versagt.

Lohnt die Batch-API von o3?

Ja, wenn du bis zu 24 Stunden Wartezeit verkraftest: Batch-Input/Output sind 50 % günstiger als die Realtime-Preise. Ideal für nächtliche Code-Reviews, Bulk-Refactors oder Pre-Merge-Analysen — schlecht für inneren Edit-Loop, der Antworten in Sekunden braucht.

o3 live ausprobieren

Öffne den vollständigen Rechner mit deinem eigenen Budget, Mix und Region (US oder DE mit 19 % MwSt.).

Rechner öffnen