Benchmark · Stand 18. August 2026

KI-Kosten-Benchmark 2026: Was eine erledigte Aufgabe kostet

38 aktuelle Modelle, 12 Geschäftsvorfälle, Listenpreise der Anbieter. Die Tabellen zeigen, was der Maschinenanteil einer erledigten Aufgabe in Euro kostet, und wo der Rechner eine Lösequote kennt, auch die Kosten je gelöster Aufgabe.

  • 38

    aktuelle Modelle

  • 12

    Geschäftsvorfälle

  • 2

    Vorfälle mit belegter Lösequote

Die Spannweite je Vorfall

Zwischen dem günstigsten und dem teuersten aktuellen Modell liegt bei jedem der zwölf Vorfälle mehr als der Faktor hundert. Der Median zeigt, wo das Feld steht; der Faktor zeigt, wie viel die Modellwahl ausmacht.

Die Spannweite je Vorfall
VorfallModellegünstigstes ModellMedianteuerstes ModellFaktor
Support-Ticket beantworten38Ministral 3 3B 0,001 €0,008 €gpt-5.4-pro 0,23 €462×
E-Mail auswerten und Antwort entwerfen38Ministral 3 3B 0,000 €0,005 €gpt-5.4-pro 0,14 €479×
Text erstellen oder überarbeiten38Ministral 3 3B 0,001 €0,015 €gpt-5.4-pro 0,51 €636×
Vertriebs-E-Mail und Angebotsentwurf38Ministral 3 3B 0,001 €0,023 €gpt-5.4-pro 0,75 €576×
Klassifikation und Routing38Ministral 3 3B 0,000 €0,003 €gpt-5.4-pro 0,06 €318×
Datenextraktion aus Dokumenten38Ministral 3 3B 0,002 €0,034 €gpt-5.4-pro 0,84 €352×
Wissensdatenbank-Frage38Ministral 3 3B 0,001 €0,017 €gpt-5.4-pro 0,47 €394×
Recherche-Agent über Dokumente38Ministral 3 3B 0,016 €0,282 €gpt-5.4-pro 13,10 €814×
Code schreiben oder ändern38Ministral 3 3B 0,005 €0,087 €gpt-5.4-pro 3,27 €605×
Langes Dokument auswerten25gpt-5.4-nano 0,097 €0,858 €gpt-5.4-pro 28,47 €295×
Meeting- oder Gesprächsnotizen38Ministral 3 3B 0,002 €0,029 €gpt-5.4-pro 0,75 €375×
Übersetzung38Ministral 3 3B 0,001 €0,013 €gpt-5.4-pro 0,53 €1.059×

Die günstigsten Modelle je Vorfall

Je Vorfall die fünf günstigsten Modelle nach Maschinenkosten und dazu das günstigste Modell je Klasse. Die Eingabegrößen je Vorfall stehen darunter; sie sind Beispielgrößen aus der Rechner-Vorbelegung, keine Messung.

Support-Ticket beantworten

Eingabe 3.700 Token, Ausgabe 400 Token, ein Aufruf je Aufgabe, 2 Minuten Nacharbeit

Support-Ticket beantworten
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0005 €
Ministral 3 8BGeräteklasse (Edge)0,0008 €
Qwen3.5 9B (Together)Kompaktklasse0,0009 €
Mistral Small 4Kompaktklasse0,0010 €
Ministral 3 14BGeräteklasse (Edge)0,0011 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0032 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0022 €
Qwen3.5 9B (Together)Kompaktklasse0,0009 €

E-Mail auswerten und Antwort entwerfen

Eingabe 2.000 Token, Ausgabe 300 Token, ein Aufruf je Aufgabe, eine Minute Nacharbeit

E-Mail auswerten und Antwort entwerfen
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0003 €
Ministral 3 8BGeräteklasse (Edge)0,0004 €
Qwen3.5 9B (Together)Kompaktklasse0,0005 €
Mistral Small 4Kompaktklasse0,0006 €
Ministral 3 14BGeräteklasse (Edge)0,0006 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0019 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0013 €
Qwen3.5 9B (Together)Kompaktklasse0,0005 €

Text erstellen oder überarbeiten

Eingabe 4.000 Token, Ausgabe 1.200 Token, ein Aufruf je Aufgabe, 5 Minuten Nacharbeit

Text erstellen oder überarbeiten
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0008 €
Ministral 3 8BGeräteklasse (Edge)0,0012 €
Qwen3.5 9B (Together)Kompaktklasse0,0015 €
Ministral 3 14BGeräteklasse (Edge)0,0016 €
Mistral Small 4Kompaktklasse0,0020 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0058 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0044 €
Qwen3.5 9B (Together)Kompaktklasse0,0015 €

Vertriebs-E-Mail und Angebotsentwurf

Eingabe 6.000 Token, Ausgabe 1.200 Token, ein Aufruf je Aufgabe, 20 Minuten Nacharbeit

Vertriebs-E-Mail und Angebotsentwurf
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0013 €
Ministral 3 8BGeräteklasse (Edge)0,0019 €
Ministral 3 14BGeräteklasse (Edge)0,0026 €
Qwen3.5 9B (Together)Kompaktklasse0,0026 €
Mistral Small 4Kompaktklasse0,0030 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0088 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0067 €
Qwen3.5 9B (Together)Kompaktklasse0,0026 €

Klassifikation und Routing

Eingabe 1.500 Token, Ausgabe 30 Token, ein Aufruf je Aufgabe, eine Minute Nacharbeit

Klassifikation und Routing
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0002 €
Mistral Small 4Kompaktklasse0,0003 €
Ministral 3 8BGeräteklasse (Edge)0,0003 €
Qwen3.5 9B (Together)Kompaktklasse0,0003 €
gpt-5.4-nanoKompaktklasse0,0004 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0010 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0007 €
Mistral Small 4Kompaktklasse0,0003 €

Datenextraktion aus Dokumenten

Eingabe 15.000 Token, Ausgabe 600 Token, ein Aufruf je Aufgabe, 5 Minuten Nacharbeit

Datenextraktion aus Dokumenten
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0024 €
Ministral 3 8BGeräteklasse (Edge)0,0036 €
Mistral Small 4Kompaktklasse0,0041 €
Qwen3.5 9B (Together)Kompaktklasse0,0042 €
Ministral 3 14BGeräteklasse (Edge)0,0049 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0131 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0087 €
Mistral Small 4Kompaktklasse0,0041 €

Wissensdatenbank-Frage

Eingabe 8.000 Token, Ausgabe 400 Token, ein Aufruf je Aufgabe, 3 Minuten Nacharbeit

Wissensdatenbank-Frage
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0012 €
Ministral 3 8BGeräteklasse (Edge)0,0018 €
Mistral Small 4Kompaktklasse0,0020 €
Qwen3.5 9B (Together)Kompaktklasse0,0023 €
Ministral 3 14BGeräteklasse (Edge)0,0024 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0065 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0048 €
Mistral Small 4Kompaktklasse0,0020 €

Recherche-Agent über Dokumente

Warnfall, siehe Kosten je gelöster Aufgabe unten

Eingabe 25.000 Token, Ausgabe 1.200 Token, 8 Aufrufe je Aufgabe, 5 Minuten Nacharbeit

Recherche-Agent über Dokumente
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0161 €
Ministral 3 8BGeräteklasse (Edge)0,0242 €
Mistral Small 4Kompaktklasse0,0315 €
Ministral 3 14BGeräteklasse (Edge)0,0322 €
gpt-5.4-nanoKompaktklasse0,0479 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0968 €
DeepSeek V4 FlashArbeitsklasse0,0968 €
Mistral Small 4Kompaktklasse0,0315 €

Code schreiben oder ändern

Eingabe 15.000 Token, Ausgabe 1.500 Token, 3 Aufrufe je Aufgabe, 10 Minuten Nacharbeit

Code schreiben oder ändern
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0054 €
Ministral 3 8BGeräteklasse (Edge)0,0081 €
Ministral 3 14BGeräteklasse (Edge)0,0108 €
Mistral Small 4Kompaktklasse0,0113 €
Qwen3.5 9B (Together)Kompaktklasse0,0136 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0341 €
DeepSeek V4 FlashArbeitsklasse0,0293 €
Mistral Small 4Kompaktklasse0,0113 €

Langes Dokument auswerten

Eingabe 300.000 Token, Ausgabe 3.000 Token, ein Aufruf je Aufgabe, 15 Minuten Nacharbeit

Langes Dokument auswerten
ModellKlasseMaschine je Aufgabe
gpt-5.4-nanoKompaktklasse0,0965 €
Gemini 3.1 Flash-LiteKompaktklasse0,1236 €
Gemini 3.5 Flash-LiteKompaktklasse0,1516 €
gpt-5.6-lunaKompaktklasse0,1898 €
DeepSeek V4 FlashArbeitsklasse0,2114 €
Günstigstes Modell je Klasse
DeepSeek V4 ProSpitzenklasse0,6342 €
DeepSeek V4 FlashArbeitsklasse0,2114 €
gpt-5.4-nanoKompaktklasse0,0965 €

Meeting- oder Gesprächsnotizen

Eingabe 15.000 Token, Ausgabe 800 Token, ein Aufruf je Aufgabe, 3 Minuten Nacharbeit

Meeting- oder Gesprächsnotizen
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0020 €
Ministral 3 8BGeräteklasse (Edge)0,0031 €
Mistral Small 4Kompaktklasse0,0035 €
Qwen3.5 9B (Together)Kompaktklasse0,0036 €
Ministral 3 14BGeräteklasse (Edge)0,0041 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0113 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0075 €
Mistral Small 4Kompaktklasse0,0035 €

Übersetzung

Eingabe 2.000 Token, Ausgabe 2.000 Token, ein Aufruf je Aufgabe, 2 Minuten Nacharbeit

Übersetzung
ModellKlasseMaschine je Aufgabe
Ministral 3 3BGeräteklasse (Edge)0,0005 €
Ministral 3 8BGeräteklasse (Edge)0,0008 €
Ministral 3 14BGeräteklasse (Edge)0,0010 €
Qwen3.5 9B (Together)Kompaktklasse0,0011 €
Mistral Small 4Kompaktklasse0,0019 €
Günstigstes Modell je Klasse
Mistral Large 3Spitzenklasse0,0052 €
Qwen3.7-Plus (Together)Arbeitsklasse0,0041 €
Qwen3.5 9B (Together)Kompaktklasse0,0011 €

Kosten je gelöster Aufgabe, wo eine Lösequote belegt ist

Wo eine laufend gepflegte Messreihe eine Lösequote je Modell liefert, rechnet der Rechner die Anläufe, die Fehlerkosten und die Prüfzeit ein. Für die übrigen Vorfälle fehlt eine solche Messreihe, dort steht keine Zahl.

Support-Ticket beantworten

Messreihe: tau2 · 2 Modelle mit Wert

Support-Ticket beantworten
ModellLösequoteAnläufeMaschine je Aufgabeje gelöster Aufgabe
gpt-5.273 %1,60,025 €1,07 €
gpt-5.159 %2,00,022 €1,34 €

Recherche-Agent über Dokumente

Messreihe: browsecomp · 15 Modelle mit Wert

Recherche-Agent über Dokumente
ModellLösequoteAnläufeMaschine je Aufgabeje gelöster Aufgabe
gpt-5.6-sol92 %1,31,207 €11,01 €
Claude Opus 591 %1,32,749 €13,95 €
gpt-5.6-terra88 %1,40,506 €15,01 €
Claude Sonnet 585 %1,40,867 €18,17 €
Claude Mythos 588 %1,44,189 €18,19 €
gpt-5.6-luna83 %1,40,053 €18,75 €
DeepSeek V4 Pro83 %1,40,259 €18,86 €
gpt-5.584 %1,41,279 €18,88 €

Methodik

  1. Preise sind Listenpreise der Anbieter in USD je 1 Million Token, ohne Rabatte, geprüft am 18. August 2026 an den Preisseiten. Umrechnung mit dem EZB-Referenzkurs 1,1576 USD je Euro.
  2. Maschinenkosten je Aufgabe: Eingabe, Ausgabe und Cache-Anteile nach der Rechenlogik des KI-Kostenrechners, ein Anlauf, ohne Stapelverarbeitung, ohne Router, ohne US-Residenz. Modelle, deren Kontextfenster für die Eingabe nicht reicht, fehlen in der jeweiligen Tabelle.
  3. Kosten je gelöster Aufgabe: Maschinenkosten geteilt durch die Lösequote aus der genannten Messreihe, mit Korrektur für abhängige Wiederholungen (Faktor 1,2), zuzüglich Fehler- und Prüfkosten nach dem Anforderungsprofil des Vorfalls. Wo keine Messreihe existiert, wird nichts interpoliert.
  4. Aufgenommen sind nur Modelle mit aktivem, buchbarem Endpunkt und veröffentlichtem Listenpreis.
  5. Eigene Größen, Cache-Anteile, Stapelverarbeitung und Fehlerkosten lassen sich im Rechner einstellen.

Änderungen

  • 18. August 2026: Erste Fassung mit 38 aktuellen Modellen. Aktualisierung quartalsweise mit dem Preisstand des Rechners.

Zitierhinweis

Convios GmbH (2026): KI-Kosten-Benchmark 2026, Stand 18. August 2026, https://www.convios.com/de/insights/ki-kosten-benchmark-2026. Nutzung mit Quellenangabe frei (CC BY 4.0).