fiege.ai

Research / Beitrag / Stand 22.9.2026

Tokenrechner: Was kostet ein Vorgang bei Ihnen?

Wie viel zahlt eine Verwaltung im Monat, wenn sie einen Vorgang mit einem Sprachmodell bearbeitet?

Die häufigste Frage in Verwaltungsgesprächen ist nicht, ob KI funktioniert, sondern was sie kostet und wo die Decke ist. Hier ist die Rechnung, offen und zum Selbstnachrechnen.

Je Vorgang

Je Monat

Je Jahr

Token je Vorgang

Rechnet ausschließlich in Ihrem Browser. Keine Eingabe wird übertragen. Grundlage: Listenpreise je Million Token, Stand 22.09.2026, und gemessener Tokenverbrauch aus dem eigenen Benchmark. Nur Modellverbrauch, ohne Instanz, Betrieb und Pflege.

Was hinter den Zahlen steckt

Vorgangstyp Eingabe-Token Ausgabe-Token Woher die Annahme stammt
XML aus dem Onlineformular 18.000 1.200 Antragsdaten plus passende Rechtsstellen aus der Wissensbasis
Papierantrag, 30 Seiten 63.000 2.000 gemessen: rund 3.500 Eingabe-Token je Seitenbild, dazu der Entwurf
Nur Vollständigkeitsprüfung 30.000 800 Seitenbilder plus Pflichtfeldliste, ohne Rechtsprüfung
Fachfrage an die Wissensbasis 12.000 600 Frage plus die fünf bis zehn abgerufenen Textstellen
Chat mit vollem Dokumentenbestand 500.000 800 gemessen an einer Plattform ohne gezielten Abruf

Die letzte Zeile ist der Grund, warum Verwaltungen über explodierende Rechnungen klagen, obwohl der einzelne Vorgang Cent kostet. Der Unterschied liegt nicht im Modell, sondern in der Architektur: Wer alles mitschickt, zahlt alles, bei jeder Nachricht.

Was der Rechner nicht zeigt

Posten Größenordnung Warum er hier fehlt
Dedizierte Modellinstanz vierstellig je Monat hängt an Auslastung und Anbieter
Betrieb, Support, Bereitschaft vierstellig je Monat hängt am Servicelevel
Pflege der Wissensbasis einmalig plus laufend hängt an der Zahl der Rechtsschichten
Schnittstellen ins Fachverfahren einmalig, oft der größte Posten hängt am Fachverfahren
Schulung nach Art. 4 KI-Verordnung einmalig je Kopf Pflicht seit Februar 2025, siehe KI-Verordnung

Deshalb ist der Modellverbrauch das falsche Feld für Verhandlungen. Das richtige ist der Kostendeckel mit Frühwarnung.

Wie Sie die Zahlen prüfen

Eine Million Token entspricht grob 1.000 bis 1.400 Seiten deutschem Fließtext. Ein Seitenbild kostet als Eingabe mehr als seine Textmenge, weil es in Bildkacheln zerlegt wird; gemessen wurden rund 3.500 Eingabe-Token je gescannter Formularseite. Wer eigene Zahlen hat, kann sie gegen die Tabelle oben halten; der Rechenweg steht unter Was ein KI-Vorgang wirklich kostet, die Messung unter Handschrift-Benchmark.

Kurz gefragt

Sind das die Gesamtkosten einer KI-Lösung?

Nein. Der Rechner zeigt nur den Modellverbrauch. Dedizierte Instanz, Betrieb, Support, Pflege der Wissensbasis und Schnittstellen sind nicht enthalten und machen in der Praxis den größeren Teil aus.

Woher stammen die Preise?

Aus veröffentlichten Listenpreisen europäischer Anbieter, Stand September 2026, umgerechnet mit einem einstellbaren Wechselkurs. Preise ändern sich; das Abrufdatum steht unter dem Rechner.

Warum ist der Chat mit vollem Dokumentenbestand so teuer?

Weil bei jeder einzelnen Nachricht der gesamte Bestand erneut als Eingabe bezahlt wird. Bei 500.000 Token Grundlast kostet eine Frage, die mit gezieltem Abruf unter einem Cent liegt, mehrere Dutzend Cent.

Gilt das auch für Betrieb im eigenen Rechenzentrum?

Dort fallen keine Token-Preise an, dafür Hardware, Strom und Betrieb. Der Vergleich lohnt sich erst ab hoher Auslastung; unterhalb davon ist der Bezug je Token günstiger.

Quellen

Stand 22.9.2026 · fiege.ai