Auf einen Blick

Qwen2.5 Coder 32B von Qwen (Alibaba) ist ein Budget-Modell mit 0,20 $ pro 1 Mio. Input-Tokens und 0,40 $ pro 1 Mio. Output-Tokens. Bei einem typischen Solo-Entwicklertag (8 Stunden, 22 Tage pro Monat — 1 mittleres Feature, 5 kleine Bugfixes, 4 PR-Reviews, 2 Stacktrace-Debugs, 1500 Zeilen TypeScript, 1 Lesedurchgang großer Dokumente, mit Prompt-Caching im Standard-Mix) kostet Qwen2.5 Coder 32B rund 5 $ pro Monat. Das Kontextfenster reicht für 128K Tokens.

Was kauft dein Monatsbudget?

Regler bewegen oder Mix umschalten — Werte aktualisieren sich live.

Monatsbudget

100 $ / Monat

≈ $23/Woche · ≈ $4.55/Tag

auf Qwen2.5 Coder 32B

Aufgaben-Mix

Input-Tokens

425,0M

Output-Tokens

37,5M

Tokens gesamt

462,5M

Pro Monat liefert das Budget

  • Mittleres Feature (10–15 Dateien)1.587
  • PR-Review14.705
  • Zeilen TypeScript4.032.258
  • Kleiner Bugfix15.432
  • Geschäftliche E-Mail555.555
  • Unit-Test-Datei13.440
Im vollen Rechner öffnen

Wie teuer ist dieses Modell im Vergleich?

Input vs. Output pro 1M Tokens

Über eine Zeile fahren, um Input/Output direkt zu vergleichen.
  • Qwen2.5 Coder 32B
    0,20 $
    0,40 $
  • Budget-Median (andere Budget-Modelle)
    0,30 $
    1,50 $
  • Günstigstes im Katalog (Gemini 2.0 Flash)
    0,10 $
    0,40 $
Input pro 1MOutput pro 1M

Kosten pro Aufgabe

Beim Standard-Coding-Agent-Mix.

USD pro einzelner Aufgabe

Mit der Maus über einen Balken fahren, um Detail-Kosten zu sehen.
  • Zeilen TypeScript
    0,0000 $
  • Kleiner Bugfix
    0,0065 $
  • PR-Review
    0,0068 $
  • Großes Dokument lesen
    0,0106 $
  • Debugging mit Stacktrace
    0,0138 $
  • Modul-Refactor (8–12 Dateien)
    0,0442 $
  • Mittleres Feature (10–15 Dateien)
    0,0630 $
  • Neues Repo einarbeiten
    0,12 $

Typischer Entwicklertag

Die 22-Tage-Annahme pro Monat basiert auf der medianen Werktagezahl in DE/US.

AktivitätAnzahlPro AufgabePro TagPro Monat
Mittleres Feature (10–15 Dateien)10,06 $0,06 $1,39 $
Kleiner Bugfix50,01 $0,03 $0,71 $
PR-Review40,01 $0,03 $0,60 $
Debugging mit Stacktrace20,01 $0,03 $0,61 $
Großes Dokument lesen10,01 $0,01 $0,23 $
Mikro-Interaktion (Erklären / Lint-Fix)300,00 $0,01 $0,18 $
Zeilen TypeScript1.5000,00 $0,04 $0,82 $
Gesamt0,21 $4,54 $

Die Zeile „1500 Zeilen TS” deckt etwa 1000 Zeilen Lesezugriff (mit Cache-Treffer) und 500 Zeilen Schreibzugriff ab. Headline-Werte sind auf rund 5 % genau — siehe FAQ.

Monatsbudget-Matrix

Was jedes monatliche Budget auf diesem Modell kauft (typischer Solo-Entwicklertag, 22 Arbeitstage).

MonatsbudgetMittlere FeaturesPR-ReviewsDebug-SitzungenZeilen TS
Typisch (ca. 5 $)72667329183.061
50 $/Monat7937.3523.6282.016.129
200 $/Monat3.17429.41114.5138.064.516
500 $/Monat7.93673.52936.28420.161.290
2000 $/Monat31.746294.117145.13780.645.161

Typischer Mix: coding-agent (85 % Input, 50 % Cache-Hits). Werte zeigen die maximale Anzahl der jeweiligen Aufgabe bei diesem Budget.

Was das Modell kann

  • Coding

    Speziell für Code-Generierung trainiert oder nachtrainiert.

  • Reasoning

    Nicht verfügbar

  • Multimodal

    Nicht verfügbar

  • Prompt-Cache

    Nicht verfügbar

  • Batch-API

    50 % günstiger, wenn bis zu 24 h Wartezeit ok ist.

  • Tool-Use

    Native Function-Calling-/Tool-Use-API.

  • Langer Kontext

    Nicht verfügbar

  • Extended Thinking

    Nicht verfügbar

Wann passt dieses Modell?

Optimal für

  • Self-Hosted IDE-Vervollständigung
  • Batch-Refactorings über Tausende Dateien
  • Kostenuntergrenze-Szenarien, in denen auch DeepSeek V3 zu teuer ist

Worauf achten

  • Kein Prompt-Caching
  • 32B-Parameter — Qualität unter Frontier bei schwierigen Aufgaben

Qwen (Alibaba) im Katalog

Modelle insgesamt

2

Median Input/1M

0,60 $

Median Output/1M

2,70 $

Input-Spannweite

0,20 $–1,00 $

Verwandte Modelle

Quellen

Häufige Fragen zu Qwen2.5 Coder 32B

Was kostet ein typischer Monat auf Qwen2.5 Coder 32B?

Bei dem realistischen Solo-Entwicklertag (1 mittleres Feature + 5 kleine Bugfixes + 4 PR-Reviews + 2 Debug-Sitzungen + 1500 Zeilen TypeScript + 1 großes Dokument lesen, 22 Werktage) kostet Qwen2.5 Coder 32B rund 5 $ pro Monat. Wer mehr macht, zahlt proportional mehr; wer weniger macht, weniger.

Wie groß ist das Kontextfenster von Qwen2.5 Coder 32B?

128K Tokens insgesamt, davon bis zu 8K Output. Das reicht für ein paar Dutzend Quelldateien in einem einzigen Aufruf.

Warum ist Output bei Qwen2.5 Coder 32B so viel teurer als Input?

Provider verlangen 0,40 $ pro 1 Mio. Output-Tokens gegenüber 0,20 $ pro 1 Mio. Input — Output erfordert tatsächliche Compute-Schritte, Input wird aus dem Cache gezogen. Coding-Agenten lesen viele Dateien (Input-lastig) und produzieren kompakte Diffs (wenig Output), deshalb sind die Gesamtkosten meist input-getrieben.

Bietet Qwen2.5 Coder 32B Prompt-Caching?

Nein. Jeder Token-Read wird zum vollen Input-Preis von 0,20 $/1M abgerechnet. Wenn dein Workload denselben Systemprompt oft wiederverwendet, vergleiche es mit einem Caching-fähigen Modell (Claude Sonnet 4.6, GPT-5) — die effektive Input-Rate sinkt dort drastisch.

Lohnt die Batch-API von Qwen2.5 Coder 32B?

Ja, wenn du bis zu 24 Stunden Wartezeit verkraftest: Batch-Input/Output sind 50 % günstiger als die Realtime-Preise. Ideal für nächtliche Code-Reviews, Bulk-Refactors oder Pre-Merge-Analysen — schlecht für inneren Edit-Loop, der Antworten in Sekunden braucht.

Qwen2.5 Coder 32B live ausprobieren

Öffne den vollständigen Rechner mit deinem eigenen Budget, Mix und Region (US oder DE mit 19 % MwSt.).

Rechner öffnen