# KI-Kosten-Benchmark 2026: Was eine erledigte Aufgabe kostet

> Was kostet eine KI-Aufgabe? Maschinenkosten je erledigter Aufgabe für 38 Modelle und 12 Geschäftsvorfälle, aus Listenpreisen, Stand 18. August 2026.

- Kanonische URL: https://www.convios.com/de/insights/ki-kosten-benchmark-2026
- Sprache: Deutsch
- Stand: 18. August 2026
- Herausgeber: Convios GmbH
- Lizenz: CC BY 4.0
- Umfang: 38 aktuelle Modelle, 12 Geschäftsvorfälle, 2 Vorfälle mit belegter Lösequote

38 aktuelle Modelle, 12 Geschäftsvorfälle, Listenpreise der Anbieter. Die Tabellen zeigen, was der Maschinenanteil einer erledigten Aufgabe in Euro kostet, und wo der Rechner eine Lösequote kennt, auch die Kosten je gelöster Aufgabe.

## Die Spannweite je Vorfall

Zwischen dem günstigsten und dem teuersten aktuellen Modell liegt bei jedem der zwölf Vorfälle mehr als der Faktor hundert. Der Median zeigt, wo das Feld steht; der Faktor zeigt, wie viel die Modellwahl ausmacht.

| Vorfall | Modelle | günstigstes Modell | Median | teuerstes Modell | Faktor |
| --- | --- | --- | --- | --- | --- |
| Support-Ticket beantworten | 38 | Ministral 3 3B (0,001 €) | 0,008 € | gpt-5.4-pro (0,23 €) | 462× |
| E-Mail auswerten und Antwort entwerfen | 38 | Ministral 3 3B (0,000 €) | 0,005 € | gpt-5.4-pro (0,14 €) | 479× |
| Text erstellen oder überarbeiten | 38 | Ministral 3 3B (0,001 €) | 0,015 € | gpt-5.4-pro (0,51 €) | 636× |
| Vertriebs-E-Mail und Angebotsentwurf | 38 | Ministral 3 3B (0,001 €) | 0,023 € | gpt-5.4-pro (0,75 €) | 576× |
| Klassifikation und Routing | 38 | Ministral 3 3B (0,000 €) | 0,003 € | gpt-5.4-pro (0,06 €) | 318× |
| Datenextraktion aus Dokumenten | 38 | Ministral 3 3B (0,002 €) | 0,034 € | gpt-5.4-pro (0,84 €) | 352× |
| Wissensdatenbank-Frage | 38 | Ministral 3 3B (0,001 €) | 0,017 € | gpt-5.4-pro (0,47 €) | 394× |
| Recherche-Agent über Dokumente | 38 | Ministral 3 3B (0,016 €) | 0,282 € | gpt-5.4-pro (13,10 €) | 814× |
| Code schreiben oder ändern | 38 | Ministral 3 3B (0,005 €) | 0,087 € | gpt-5.4-pro (3,27 €) | 605× |
| Langes Dokument auswerten | 25 | gpt-5.4-nano (0,097 €) | 0,858 € | gpt-5.4-pro (28,47 €) | 295× |
| Meeting- oder Gesprächsnotizen | 38 | Ministral 3 3B (0,002 €) | 0,029 € | gpt-5.4-pro (0,75 €) | 375× |
| Übersetzung | 38 | Ministral 3 3B (0,001 €) | 0,013 € | gpt-5.4-pro (0,53 €) | 1.059× |

## Die günstigsten Modelle je Vorfall

Je Vorfall die fünf günstigsten Modelle nach Maschinenkosten und dazu das günstigste Modell je Klasse. Die Eingabegrößen je Vorfall stehen darunter; sie sind Beispielgrößen aus der Rechner-Vorbelegung, keine Messung.

### Support-Ticket beantworten

Eingabe 3.700 Token, Ausgabe 400 Token, ein Aufruf je Aufgabe, 2 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0005 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0008 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0009 € |
| Mistral Small 4 | Kompaktklasse | 0,0010 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0011 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0032 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0022 €); Qwen3.5 9B (Together) (Kompaktklasse, 0,0009 €)

### E-Mail auswerten und Antwort entwerfen

Eingabe 2.000 Token, Ausgabe 300 Token, ein Aufruf je Aufgabe, eine Minute Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0003 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0004 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0005 € |
| Mistral Small 4 | Kompaktklasse | 0,0006 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0006 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0019 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0013 €); Qwen3.5 9B (Together) (Kompaktklasse, 0,0005 €)

### Text erstellen oder überarbeiten

Eingabe 4.000 Token, Ausgabe 1.200 Token, ein Aufruf je Aufgabe, 5 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0008 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0012 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0015 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0016 € |
| Mistral Small 4 | Kompaktklasse | 0,0020 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0058 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0044 €); Qwen3.5 9B (Together) (Kompaktklasse, 0,0015 €)

### Vertriebs-E-Mail und Angebotsentwurf

Eingabe 6.000 Token, Ausgabe 1.200 Token, ein Aufruf je Aufgabe, 20 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0013 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0019 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0026 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0026 € |
| Mistral Small 4 | Kompaktklasse | 0,0030 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0088 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0067 €); Qwen3.5 9B (Together) (Kompaktklasse, 0,0026 €)

### Klassifikation und Routing

Eingabe 1.500 Token, Ausgabe 30 Token, ein Aufruf je Aufgabe, eine Minute Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0002 € |
| Mistral Small 4 | Kompaktklasse | 0,0003 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0003 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0003 € |
| gpt-5.4-nano | Kompaktklasse | 0,0004 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0010 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0007 €); Mistral Small 4 (Kompaktklasse, 0,0003 €)

### Datenextraktion aus Dokumenten

Eingabe 15.000 Token, Ausgabe 600 Token, ein Aufruf je Aufgabe, 5 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0024 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0036 € |
| Mistral Small 4 | Kompaktklasse | 0,0041 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0042 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0049 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0131 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0087 €); Mistral Small 4 (Kompaktklasse, 0,0041 €)

### Wissensdatenbank-Frage

Eingabe 8.000 Token, Ausgabe 400 Token, ein Aufruf je Aufgabe, 3 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0012 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0018 € |
| Mistral Small 4 | Kompaktklasse | 0,0020 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0023 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0024 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0065 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0048 €); Mistral Small 4 (Kompaktklasse, 0,0020 €)

### Recherche-Agent über Dokumente

Warnfall, siehe Kosten je gelöster Aufgabe unten.

Eingabe 25.000 Token, Ausgabe 1.200 Token, 8 Aufrufe je Aufgabe, 5 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0161 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0242 € |
| Mistral Small 4 | Kompaktklasse | 0,0315 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0322 € |
| gpt-5.4-nano | Kompaktklasse | 0,0479 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0968 €); DeepSeek V4 Flash (Arbeitsklasse, 0,0968 €); Mistral Small 4 (Kompaktklasse, 0,0315 €)

### Code schreiben oder ändern

Eingabe 15.000 Token, Ausgabe 1.500 Token, 3 Aufrufe je Aufgabe, 10 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0054 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0081 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0108 € |
| Mistral Small 4 | Kompaktklasse | 0,0113 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0136 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0341 €); DeepSeek V4 Flash (Arbeitsklasse, 0,0293 €); Mistral Small 4 (Kompaktklasse, 0,0113 €)

### Langes Dokument auswerten

Eingabe 300.000 Token, Ausgabe 3.000 Token, ein Aufruf je Aufgabe, 15 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| gpt-5.4-nano | Kompaktklasse | 0,0965 € |
| Gemini 3.1 Flash-Lite | Kompaktklasse | 0,1236 € |
| Gemini 3.5 Flash-Lite | Kompaktklasse | 0,1516 € |
| gpt-5.6-luna | Kompaktklasse | 0,1898 € |
| DeepSeek V4 Flash | Arbeitsklasse | 0,2114 € |

Günstigstes Modell je Klasse: DeepSeek V4 Pro (Spitzenklasse, 0,6342 €); DeepSeek V4 Flash (Arbeitsklasse, 0,2114 €); gpt-5.4-nano (Kompaktklasse, 0,0965 €)

### Meeting- oder Gesprächsnotizen

Eingabe 15.000 Token, Ausgabe 800 Token, ein Aufruf je Aufgabe, 3 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0020 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0031 € |
| Mistral Small 4 | Kompaktklasse | 0,0035 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0036 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0041 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0113 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0075 €); Mistral Small 4 (Kompaktklasse, 0,0035 €)

### Übersetzung

Eingabe 2.000 Token, Ausgabe 2.000 Token, ein Aufruf je Aufgabe, 2 Minuten Nacharbeit

| Modell | Klasse | Maschine je Aufgabe |
| --- | --- | --- |
| Ministral 3 3B | Geräteklasse (Edge) | 0,0005 € |
| Ministral 3 8B | Geräteklasse (Edge) | 0,0008 € |
| Ministral 3 14B | Geräteklasse (Edge) | 0,0010 € |
| Qwen3.5 9B (Together) | Kompaktklasse | 0,0011 € |
| Mistral Small 4 | Kompaktklasse | 0,0019 € |

Günstigstes Modell je Klasse: Mistral Large 3 (Spitzenklasse, 0,0052 €); Qwen3.7-Plus (Together) (Arbeitsklasse, 0,0041 €); Qwen3.5 9B (Together) (Kompaktklasse, 0,0011 €)

## Kosten je gelöster Aufgabe, wo eine Lösequote belegt ist

Wo eine laufend gepflegte Messreihe eine Lösequote je Modell liefert, rechnet der Rechner die Anläufe, die Fehlerkosten und die Prüfzeit ein. Für die übrigen Vorfälle fehlt eine solche Messreihe, dort steht keine Zahl.

### Support-Ticket beantworten

Messreihe: tau2 · 2 Modelle mit Wert

| Modell | Lösequote | Anläufe | Maschine je Aufgabe | je gelöster Aufgabe |
| --- | --- | --- | --- | --- |
| gpt-5.2 | 73 % | 1,6 | 0,025 € | 1,07 € |
| gpt-5.1 | 59 % | 2,0 | 0,022 € | 1,34 € |

### Recherche-Agent über Dokumente

Messreihe: browsecomp · 15 Modelle mit Wert

| Modell | Lösequote | Anläufe | Maschine je Aufgabe | je gelöster Aufgabe |
| --- | --- | --- | --- | --- |
| gpt-5.6-sol | 92 % | 1,3 | 1,207 € | 11,01 € |
| Claude Opus 5 | 91 % | 1,3 | 2,749 € | 13,95 € |
| gpt-5.6-terra | 88 % | 1,4 | 0,506 € | 15,01 € |
| Claude Sonnet 5 | 85 % | 1,4 | 0,867 € | 18,17 € |
| Claude Mythos 5 | 88 % | 1,4 | 4,189 € | 18,19 € |
| gpt-5.6-luna | 83 % | 1,4 | 0,053 € | 18,75 € |
| DeepSeek V4 Pro | 83 % | 1,4 | 0,259 € | 18,86 € |
| gpt-5.5 | 84 % | 1,4 | 1,279 € | 18,88 € |

## Methodik

1. Preise sind Listenpreise der Anbieter in USD je 1 Million Token, ohne Rabatte, geprüft am 18. August 2026 an den Preisseiten. Umrechnung mit dem EZB-Referenzkurs 1,1576 USD je Euro.
2. Maschinenkosten je Aufgabe: Eingabe, Ausgabe und Cache-Anteile nach der Rechenlogik des KI-Kostenrechners, ein Anlauf, ohne Stapelverarbeitung, ohne Router, ohne US-Residenz. Modelle, deren Kontextfenster für die Eingabe nicht reicht, fehlen in der jeweiligen Tabelle.
3. Kosten je gelöster Aufgabe: Maschinenkosten geteilt durch die Lösequote aus der genannten Messreihe, mit Korrektur für abhängige Wiederholungen (Faktor 1,2), zuzüglich Fehler- und Prüfkosten nach dem Anforderungsprofil des Vorfalls. Wo keine Messreihe existiert, wird nichts interpoliert.
4. Aufgenommen sind nur Modelle mit aktivem, buchbarem Endpunkt und veröffentlichtem Listenpreis.
5. Eigene Größen, Cache-Anteile, Stapelverarbeitung und Fehlerkosten lassen sich im Rechner einstellen.

### Änderungen

- 18. August 2026: Erste Fassung mit 38 aktuellen Modellen. Aktualisierung quartalsweise mit dem Preisstand des Rechners.

### Zitierhinweis

Convios GmbH (2026): KI-Kosten-Benchmark 2026, Stand 18. August 2026, https://www.convios.com/de/insights/ki-kosten-benchmark-2026. Nutzung mit Quellenangabe frei (CC BY 4.0).

- [Zum KI-Kostenrechner mit eigenen Größen](https://olivergausmann.com/insights/ki-kostenrechner)
- [Der Artikel zur Methode: KI-Kosten senken, ohne Qualität zu verlieren](https://olivergausmann.com/insights/ki-kosten-senken-modellwahl)
- HTML: https://www.convios.com/de/insights/ki-kosten-benchmark-2026
