Auf einen Blick

Llama 3.3 70B Instruct von Meta (über Aggregator) ist ein Budget-Modell mit 0,88 $ pro 1 Mio. Input-Tokens und 0,88 $ pro 1 Mio. Output-Tokens. Bei einem typischen Solo-Entwicklertag (8 Stunden, 22 Tage pro Monat — 1 mittleres Feature, 5 kleine Bugfixes, 4 PR-Reviews, 2 Stacktrace-Debugs, 1500 Zeilen TypeScript, 1 Lesedurchgang großer Dokumente, mit Prompt-Caching im Standard-Mix) kostet Llama 3.3 70B Instruct rund 18 $ pro Monat. Das Kontextfenster reicht für 128K Tokens.

Was kauft dein Monatsbudget?

Regler bewegen oder Mix umschalten — Werte aktualisieren sich live.

Monatsbudget

100 $ / Monat

≈ $23/Woche · ≈ $4.55/Tag

auf Llama 3.3 70B Instruct

Aufgaben-Mix

Input-Tokens

96,6M

Output-Tokens

17,0M

Tokens gesamt

113,6M

Pro Monat liefert das Budget

  • Mittleres Feature (10–15 Dateien)420
  • PR-Review3.551
  • Zeilen TypeScript1.014.610
  • Kleiner Bugfix3.642
  • Geschäftliche E-Mail174.825
  • Unit-Test-Datei3.382
Im vollen Rechner öffnen

Wie teuer ist dieses Modell im Vergleich?

Input vs. Output pro 1M Tokens

Über eine Zeile fahren, um Input/Output direkt zu vergleichen.
  • Llama 3.3 70B Instruct
    0,88 $
    0,88 $
  • Budget-Median (andere Budget-Modelle)
    0,30 $
    1,50 $
  • Günstigstes im Katalog (Gemini 2.0 Flash)
    0,10 $
    0,40 $
Input pro 1MOutput pro 1M

Kosten pro Aufgabe

Beim Standard-Coding-Agent-Mix.

USD pro einzelner Aufgabe

Mit der Maus über einen Balken fahren, um Detail-Kosten zu sehen.
  • Zeilen TypeScript
    0,0001 $
  • Kleiner Bugfix
    0,0275 $
  • PR-Review
    0,0282 $
  • Großes Dokument lesen
    0,0453 $
  • Debugging mit Stacktrace
    0,0589 $
  • Modul-Refactor (8–12 Dateien)
    0,17 $
  • Mittleres Feature (10–15 Dateien)
    0,24 $
  • Neues Repo einarbeiten
    0,53 $

Typischer Entwicklertag

Die 22-Tage-Annahme pro Monat basiert auf der medianen Werktagezahl in DE/US.

AktivitätAnzahlPro AufgabePro TagPro Monat
Mittleres Feature (10–15 Dateien)10,24 $0,24 $5,23 $
Kleiner Bugfix50,03 $0,14 $3,02 $
PR-Review40,03 $0,11 $2,48 $
Debugging mit Stacktrace20,06 $0,12 $2,59 $
Großes Dokument lesen10,05 $0,05 $1,00 $
Mikro-Interaktion (Erklären / Lint-Fix)300,00 $0,03 $0,70 $
Zeilen TypeScript1.5000,00 $0,15 $3,25 $
Gesamt0,83 $18,26 $

Die Zeile „1500 Zeilen TS” deckt etwa 1000 Zeilen Lesezugriff (mit Cache-Treffer) und 500 Zeilen Schreibzugriff ab. Headline-Werte sind auf rund 5 % genau — siehe FAQ.

Monatsbudget-Matrix

Was jedes monatliche Budget auf diesem Modell kauft (typischer Solo-Entwicklertag, 22 Arbeitstage).

MonatsbudgetMittlere FeaturesPR-ReviewsDebug-SitzungenZeilen TS
Typisch (ca. 18 $)76648310185.310
50 $/Monat2101.775848507.305
200 $/Monat8417.1023.3942.029.220
500 $/Monat2.10417.7558.4865.073.051
2000 $/Monat8.41771.02233.94620.292.207

Typischer Mix: coding-agent (85 % Input, 50 % Cache-Hits). Werte zeigen die maximale Anzahl der jeweiligen Aufgabe bei diesem Budget.

Was das Modell kann

  • Coding

    Speziell für Code-Generierung trainiert oder nachtrainiert.

  • Reasoning

    Nicht verfügbar

  • Multimodal

    Nicht verfügbar

  • Prompt-Cache

    Nicht verfügbar

  • Batch-API

    Nicht verfügbar

  • Tool-Use

    Native Function-Calling-/Tool-Use-API.

  • Langer Kontext

    Nicht verfügbar

  • Extended Thinking

    Nicht verfügbar

Wann passt dieses Modell?

Optimal für

  • Open-Weights-Deployments, bei denen Daten das Netzwerk nicht verlassen dürfen
  • Symmetrische Workloads (gleicher Input und Output)
  • Fallback-Modell, wenn Frontier rate-limitiert ist

Worauf achten

  • Coding-Qualität klar unter Frontier
  • Kein Prompt-Caching bei den meisten Aggregatoren

Meta (über Aggregator) im Katalog

Modelle insgesamt

1

Median Input/1M

0,88 $

Median Output/1M

0,88 $

Input-Spannweite

0,88 $–0,88 $

Verwandte Modelle

Quellen

Häufige Fragen zu Llama 3.3 70B Instruct

Was kostet ein typischer Monat auf Llama 3.3 70B Instruct?

Bei dem realistischen Solo-Entwicklertag (1 mittleres Feature + 5 kleine Bugfixes + 4 PR-Reviews + 2 Debug-Sitzungen + 1500 Zeilen TypeScript + 1 großes Dokument lesen, 22 Werktage) kostet Llama 3.3 70B Instruct rund 18 $ pro Monat. Wer mehr macht, zahlt proportional mehr; wer weniger macht, weniger.

Wie groß ist das Kontextfenster von Llama 3.3 70B Instruct?

128K Tokens insgesamt, davon bis zu 8K Output. Das reicht für ein paar Dutzend Quelldateien in einem einzigen Aufruf.

Warum ist Output bei Llama 3.3 70B Instruct so viel teurer als Input?

Provider verlangen 0,88 $ pro 1 Mio. Output-Tokens gegenüber 0,88 $ pro 1 Mio. Input — Output erfordert tatsächliche Compute-Schritte, Input wird aus dem Cache gezogen. Coding-Agenten lesen viele Dateien (Input-lastig) und produzieren kompakte Diffs (wenig Output), deshalb sind die Gesamtkosten meist input-getrieben.

Bietet Llama 3.3 70B Instruct Prompt-Caching?

Nein. Jeder Token-Read wird zum vollen Input-Preis von 0,88 $/1M abgerechnet. Wenn dein Workload denselben Systemprompt oft wiederverwendet, vergleiche es mit einem Caching-fähigen Modell (Claude Sonnet 4.6, GPT-5) — die effektive Input-Rate sinkt dort drastisch.

Llama 3.3 70B Instruct live ausprobieren

Öffne den vollständigen Rechner mit deinem eigenen Budget, Mix und Region (US oder DE mit 19 % MwSt.).

Rechner öffnen