Auf einen Blick
Qwen2.5 Coder 32B von Qwen (Alibaba) ist ein Budget-Modell mit 0,20 $ pro 1 Mio. Input-Tokens und 0,40 $ pro 1 Mio. Output-Tokens. Bei einem typischen Solo-Entwicklertag (8 Stunden, 22 Tage pro Monat — 1 mittleres Feature, 5 kleine Bugfixes, 4 PR-Reviews, 2 Stacktrace-Debugs, 1500 Zeilen TypeScript, 1 Lesedurchgang großer Dokumente, mit Prompt-Caching im Standard-Mix) kostet Qwen2.5 Coder 32B rund 5 $ pro Monat. Das Kontextfenster reicht für 128K Tokens.
Was kauft dein Monatsbudget?
Regler bewegen oder Mix umschalten — Werte aktualisieren sich live.
Monatsbudget
100 $ / Monat
≈ $23/Woche · ≈ $4.55/Tag
auf Qwen2.5 Coder 32B
Input-Tokens
425,0M
Output-Tokens
37,5M
Tokens gesamt
462,5M
Pro Monat liefert das Budget
- Mittleres Feature (10–15 Dateien)1.587
- PR-Review14.705
- Zeilen TypeScript4.032.258
- Kleiner Bugfix15.432
- Geschäftliche E-Mail555.555
- Unit-Test-Datei13.440
Wie teuer ist dieses Modell im Vergleich?
Input vs. Output pro 1M Tokens
- Qwen2.5 Coder 32B0,20 $0,40 $
- Budget-Median (andere Budget-Modelle)0,30 $1,50 $
- Günstigstes im Katalog (Gemini 2.0 Flash)0,10 $0,40 $
Kosten pro Aufgabe
Beim Standard-Coding-Agent-Mix.
USD pro einzelner Aufgabe
- Zeilen TypeScript0,0000 $
- Kleiner Bugfix0,0065 $
- PR-Review0,0068 $
- Großes Dokument lesen0,0106 $
- Debugging mit Stacktrace0,0138 $
- Modul-Refactor (8–12 Dateien)0,0442 $
- Mittleres Feature (10–15 Dateien)0,0630 $
- Neues Repo einarbeiten0,12 $
Typischer Entwicklertag
Die 22-Tage-Annahme pro Monat basiert auf der medianen Werktagezahl in DE/US.
| Aktivität | Anzahl | Pro Aufgabe | Pro Tag | Pro Monat |
|---|---|---|---|---|
| Mittleres Feature (10–15 Dateien) | 1 | 0,06 $ | 0,06 $ | 1,39 $ |
| Kleiner Bugfix | 5 | 0,01 $ | 0,03 $ | 0,71 $ |
| PR-Review | 4 | 0,01 $ | 0,03 $ | 0,60 $ |
| Debugging mit Stacktrace | 2 | 0,01 $ | 0,03 $ | 0,61 $ |
| Großes Dokument lesen | 1 | 0,01 $ | 0,01 $ | 0,23 $ |
| Mikro-Interaktion (Erklären / Lint-Fix) | 30 | 0,00 $ | 0,01 $ | 0,18 $ |
| Zeilen TypeScript | 1.500 | 0,00 $ | 0,04 $ | 0,82 $ |
| Gesamt | 0,21 $ | 4,54 $ | ||
Die Zeile „1500 Zeilen TS” deckt etwa 1000 Zeilen Lesezugriff (mit Cache-Treffer) und 500 Zeilen Schreibzugriff ab. Headline-Werte sind auf rund 5 % genau — siehe FAQ.
Monatsbudget-Matrix
Was jedes monatliche Budget auf diesem Modell kauft (typischer Solo-Entwicklertag, 22 Arbeitstage).
| Monatsbudget | Mittlere Features | PR-Reviews | Debug-Sitzungen | Zeilen TS |
|---|---|---|---|---|
| Typisch (ca. 5 $) | 72 | 667 | 329 | 183.061 |
| 50 $/Monat | 793 | 7.352 | 3.628 | 2.016.129 |
| 200 $/Monat | 3.174 | 29.411 | 14.513 | 8.064.516 |
| 500 $/Monat | 7.936 | 73.529 | 36.284 | 20.161.290 |
| 2000 $/Monat | 31.746 | 294.117 | 145.137 | 80.645.161 |
Typischer Mix: coding-agent (85 % Input, 50 % Cache-Hits). Werte zeigen die maximale Anzahl der jeweiligen Aufgabe bei diesem Budget.
Was das Modell kann
Coding
Speziell für Code-Generierung trainiert oder nachtrainiert.
Reasoning
Nicht verfügbar
Multimodal
Nicht verfügbar
Prompt-Cache
Nicht verfügbar
Batch-API
50 % günstiger, wenn bis zu 24 h Wartezeit ok ist.
Tool-Use
Native Function-Calling-/Tool-Use-API.
Langer Kontext
Nicht verfügbar
Extended Thinking
Nicht verfügbar
Wann passt dieses Modell?
Optimal für
- Self-Hosted IDE-Vervollständigung
- Batch-Refactorings über Tausende Dateien
- Kostenuntergrenze-Szenarien, in denen auch DeepSeek V3 zu teuer ist
Worauf achten
- Kein Prompt-Caching
- 32B-Parameter — Qualität unter Frontier bei schwierigen Aufgaben
Qwen (Alibaba) im Katalog
Modelle insgesamt
2
Median Input/1M
0,60 $
Median Output/1M
2,70 $
Input-Spannweite
0,20 $–1,00 $
Verwandte Modelle
Quellen
- Together AI Pricing ↗
Geprüft am: 2026-05-07
Häufige Fragen zu Qwen2.5 Coder 32B
Was kostet ein typischer Monat auf Qwen2.5 Coder 32B?
Bei dem realistischen Solo-Entwicklertag (1 mittleres Feature + 5 kleine Bugfixes + 4 PR-Reviews + 2 Debug-Sitzungen + 1500 Zeilen TypeScript + 1 großes Dokument lesen, 22 Werktage) kostet Qwen2.5 Coder 32B rund 5 $ pro Monat. Wer mehr macht, zahlt proportional mehr; wer weniger macht, weniger.
Wie groß ist das Kontextfenster von Qwen2.5 Coder 32B?
128K Tokens insgesamt, davon bis zu 8K Output. Das reicht für ein paar Dutzend Quelldateien in einem einzigen Aufruf.
Warum ist Output bei Qwen2.5 Coder 32B so viel teurer als Input?
Provider verlangen 0,40 $ pro 1 Mio. Output-Tokens gegenüber 0,20 $ pro 1 Mio. Input — Output erfordert tatsächliche Compute-Schritte, Input wird aus dem Cache gezogen. Coding-Agenten lesen viele Dateien (Input-lastig) und produzieren kompakte Diffs (wenig Output), deshalb sind die Gesamtkosten meist input-getrieben.
Bietet Qwen2.5 Coder 32B Prompt-Caching?
Nein. Jeder Token-Read wird zum vollen Input-Preis von 0,20 $/1M abgerechnet. Wenn dein Workload denselben Systemprompt oft wiederverwendet, vergleiche es mit einem Caching-fähigen Modell (Claude Sonnet 4.6, GPT-5) — die effektive Input-Rate sinkt dort drastisch.
Lohnt die Batch-API von Qwen2.5 Coder 32B?
Ja, wenn du bis zu 24 Stunden Wartezeit verkraftest: Batch-Input/Output sind 50 % günstiger als die Realtime-Preise. Ideal für nächtliche Code-Reviews, Bulk-Refactors oder Pre-Merge-Analysen — schlecht für inneren Edit-Loop, der Antworten in Sekunden braucht.
Qwen2.5 Coder 32B live ausprobieren
Öffne den vollständigen Rechner mit deinem eigenen Budget, Mix und Region (US oder DE mit 19 % MwSt.).
Rechner öffnen