Research / Beitrag / Stand 22.9.2026
Tokenrechner: Was kostet ein Vorgang bei Ihnen?
Wie viel zahlt eine Verwaltung im Monat, wenn sie einen Vorgang mit einem Sprachmodell bearbeitet?
Die häufigste Frage in Verwaltungsgesprächen ist nicht, ob KI funktioniert, sondern was sie kostet und wo die Decke ist. Hier ist die Rechnung, offen und zum Selbstnachrechnen.
Je Vorgang
–
Je Monat
–
Je Jahr
–
Token je Vorgang
–
–
Rechnet ausschließlich in Ihrem Browser. Keine Eingabe wird übertragen. Grundlage: Listenpreise je Million Token, Stand 22.09.2026, und gemessener Tokenverbrauch aus dem eigenen Benchmark. Nur Modellverbrauch, ohne Instanz, Betrieb und Pflege.
Was hinter den Zahlen steckt
| Vorgangstyp | Eingabe-Token | Ausgabe-Token | Woher die Annahme stammt |
|---|---|---|---|
| XML aus dem Onlineformular | 18.000 | 1.200 | Antragsdaten plus passende Rechtsstellen aus der Wissensbasis |
| Papierantrag, 30 Seiten | 63.000 | 2.000 | gemessen: rund 3.500 Eingabe-Token je Seitenbild, dazu der Entwurf |
| Nur Vollständigkeitsprüfung | 30.000 | 800 | Seitenbilder plus Pflichtfeldliste, ohne Rechtsprüfung |
| Fachfrage an die Wissensbasis | 12.000 | 600 | Frage plus die fünf bis zehn abgerufenen Textstellen |
| Chat mit vollem Dokumentenbestand | 500.000 | 800 | gemessen an einer Plattform ohne gezielten Abruf |
Die letzte Zeile ist der Grund, warum Verwaltungen über explodierende Rechnungen klagen, obwohl der einzelne Vorgang Cent kostet. Der Unterschied liegt nicht im Modell, sondern in der Architektur: Wer alles mitschickt, zahlt alles, bei jeder Nachricht.
Was der Rechner nicht zeigt
| Posten | Größenordnung | Warum er hier fehlt |
|---|---|---|
| Dedizierte Modellinstanz | vierstellig je Monat | hängt an Auslastung und Anbieter |
| Betrieb, Support, Bereitschaft | vierstellig je Monat | hängt am Servicelevel |
| Pflege der Wissensbasis | einmalig plus laufend | hängt an der Zahl der Rechtsschichten |
| Schnittstellen ins Fachverfahren | einmalig, oft der größte Posten | hängt am Fachverfahren |
| Schulung nach Art. 4 KI-Verordnung | einmalig je Kopf | Pflicht seit Februar 2025, siehe KI-Verordnung |
Deshalb ist der Modellverbrauch das falsche Feld für Verhandlungen. Das richtige ist der Kostendeckel mit Frühwarnung.
Wie Sie die Zahlen prüfen
Eine Million Token entspricht grob 1.000 bis 1.400 Seiten deutschem Fließtext. Ein Seitenbild kostet als Eingabe mehr als seine Textmenge, weil es in Bildkacheln zerlegt wird; gemessen wurden rund 3.500 Eingabe-Token je gescannter Formularseite. Wer eigene Zahlen hat, kann sie gegen die Tabelle oben halten; der Rechenweg steht unter Was ein KI-Vorgang wirklich kostet, die Messung unter Handschrift-Benchmark.
Kurz gefragt
Sind das die Gesamtkosten einer KI-Lösung?
Nein. Der Rechner zeigt nur den Modellverbrauch. Dedizierte Instanz, Betrieb, Support, Pflege der Wissensbasis und Schnittstellen sind nicht enthalten und machen in der Praxis den größeren Teil aus.
Woher stammen die Preise?
Aus veröffentlichten Listenpreisen europäischer Anbieter, Stand September 2026, umgerechnet mit einem einstellbaren Wechselkurs. Preise ändern sich; das Abrufdatum steht unter dem Rechner.
Warum ist der Chat mit vollem Dokumentenbestand so teuer?
Weil bei jeder einzelnen Nachricht der gesamte Bestand erneut als Eingabe bezahlt wird. Bei 500.000 Token Grundlast kostet eine Frage, die mit gezieltem Abruf unter einem Cent liegt, mehrere Dutzend Cent.
Gilt das auch für Betrieb im eigenen Rechenzentrum?
Dort fallen keine Token-Preise an, dafür Hardware, Strom und Betrieb. Der Vergleich lohnt sich erst ab hoher Auslastung; unterhalb davon ist der Bezug je Token günstiger.