Das Wichtigste

Token sind der kleinste laufende Posten. Der Beispiel-Agent kostet über zwölf Monate 3.302,54 Euro: 378,85 Euro Token, 1.217,81 Euro Fehlerfälle, 1.127,60 Euro Aufbau. Er trägt sich ab 965 Vorgängen im Jahr.

Drei Posten fehlen in fast jedem Angebot

Ein Angebot für einen KI-Agenten nennt Aufbau und Abo. Es nennt selten den Token-Verbrauch im Dauerbetrieb, fast nie die Stunden für den nächsten Modellwechsel und so gut wie nie die Zeit für die Vorgänge, die der Agent falsch macht.

Diese drei Posten sind in der Rechnung unten 58,6 Prozent der Kosten von zwölf Monaten. Der Agent kostet im Beispiel 3.302,54 Euro im ersten Jahr, also 22,9 Cent je Vorgang. Dass die Unsicherheit über Kosten bleibt, zeigt die Bitkom-Umfrage vom 14. September 2026: 54 Prozent der KI-Nutzer nennen sie als Hürde.

Alle Zeilen sind mit python3 aus Listenpreisen vom 28. September 2026 gerechnet. Die Mengen stehen im nächsten Abschnitt und lassen sich austauschen.

Der Beispiel-Agent, damit die Zahlen prüfbar bleiben

Ein Agent beantwortet Serviceanfragen vor. Alle Mengen sind gesetzte Beispielwerte, damit Sie sie durch eigene ersetzen können; gemessen wurde hier nichts.

Zwölf Monate, fünf Zeilen, 3.302,54 Euro

Die Summe für zwölf Monate liegt bei 3.302,54 Euro. Reihenfolge je Zeile: Posten, Rechnung, Jahressumme, Anteil.

  • Token: 3,00 US-Cent je Vorgang, 36,00 US-Dollar im Monat, 31,57 Euro; zwölf Monate 378,85 Euro, Anteil 11,5 Prozent.
  • Ablaufumgebung: 20,00 Euro im Monat; zwölf Monate 240,00 Euro, Anteil 7,3 Prozent.
  • Modellwechsel: einmal im Jahr, 12 Stunden für Nachtest und Anpassung der Anweisungen, 338,28 Euro, Anteil 10,2 Prozent.
  • Fehlerfälle: 3 Prozent der Vorgänge, 6 Minuten Nacharbeit, also 3,6 Stunden und 101,48 Euro im Monat; zwölf Monate 1.217,81 Euro, Anteil 36,9 Prozent.
  • Aufbau, einmalig: 40 Stunden, 1.127,60 Euro, Anteil 34,1 Prozent.
  • Ohne den Aufbau bleiben 2.174,94 Euro laufende Kosten, das sind 15,1 Cent je Vorgang.

Token sind 11,5 Prozent, nicht 90

Der Token-Preis ist der Posten, den ein Anbieter gern vorrechnet. Auch die Betriebe schätzen ihn richtig ein: In der Bitkom-Umfrage vom 14. September 2026 nennen 8 Prozent den Token-Verbrauch als großen Kostenblock, dagegen 51 Prozent die Infrastruktur und 50 Prozent die Datenaufbereitung.

Das Modell zu wechseln verschiebt wenig. Dieselben Mengen kosten mit Claude Opus 5.5 statt Sonnet 5 im Jahr 727,39 Euro Token statt 378,85, mit Claude Haiku 4.5 nur 189,42 Euro. Die Spanne zwischen billigstem und teuerstem Modell beträgt 537,97 Euro im Jahr, weniger als die Fehlerfälle eines halben Jahres.

Der Cache wirkt stärker als die Modellwahl. Ohne Zwischenspeicher wären alle 18.000 Eingabe-Token je Vorgang frisch, und die Tokenrechnung steigt auf 644,04 Euro im Jahr, Faktor 1,70. Wie sich die Kosten je Vorgang im Einzelnen zusammensetzen, steht in KI-Kosten je Vorgang berechnen.

Der Modellwechsel steht im Kalender des Anbieters

Der Wechsel kommt, und nicht zu Ihrem Termin. Anthropic sichert mindestens 60 Tage Vorlauf vor der Abschaltung eines Modells zu und hat 2026 drei abgeschaltet: Claude Sonnet 3.7 am 19. Februar, Claude Sonnet 4 und Opus 4 am 15. Juni, Opus 4.1 am 5. August. Anfragen an ein abgeschaltetes Modell scheitern.

Ein Wechsel ist keine Zeile in der Konfiguration. Die Parameter temperature, top_p und top_k geben auf Claude Opus 4.7 und neueren Modellen einen Fehler 400 zurück. Und Modelle ab Claude 4.7 nutzen laut Anthropic einen neueren Tokenizer, der für denselben Text etwa 30 Prozent mehr Token erzeugt, was die Tokenrechnung ohne Preisänderung anhebt.

Deshalb stehen 12 Stunden im Jahr in der Tabelle: Anweisungen nachziehen, zwanzig alte Vorgänge gegen das neue Modell laufen lassen, Abweichungen prüfen, freigeben. Wer das nicht einplant, zahlt es im Störungsfall zu höheren Stundensätzen.

Fehlerfälle sind der größte laufende Posten

36,9 Prozent der Jahreskosten sind Nacharbeit. Bei 3 Prozent Fehlerquote und 6 Minuten je Fall sind das 36 Vorgänge und 3,6 Stunden im Monat, zu 28,19 Euro je Stunde also 1.217,81 Euro im Jahr. Die Quote ist gesetzt, nicht gemessen, und sie ist der empfindlichste Wert der ganzen Rechnung.

Rechnen Sie die Spanne mit. Bei 5 Prozent Fehlern und 10 Minuten Nacharbeit steigt der Posten auf 3.382,80 Euro im Jahr, die Jahressumme auf 5.467,53 Euro und der Preis je Vorgang von 22,9 auf 38,0 Cent. Der Agent wird also nicht durch Token teuer, sondern durch seine Trefferquote.

Daraus folgt eine Bedingung für das Angebot: Der Agent muss die Fälle kennzeichnen, bei denen er unsicher ist. Ein Agent ohne diese Liste kostet Sie die Kontrolle aller 1.200 Vorgänge, nicht die von 36.

Die Formel für Ihr eigenes Angebot

Eine Zeile, fünf Zahlen, kein Tabellenblatt nötig. Jahreskosten gleich 12 mal (Vorgänge je Monat mal Tokenpreis je Vorgang plus Abo) plus Migrationsstunden mal Stundensatz plus 12 mal Vorgänge mal Fehlerquote mal Nacharbeitsminuten geteilt durch 60 mal Stundensatz plus Aufbaustunden mal Stundensatz.

Vier Fragen bringen die fehlenden Zahlen ins Angebot. Schicken Sie sie wörtlich.

  • Wie viele Eingabe- und Ausgabe-Token verbraucht ein Vorgang im Mittel, gemessen an zehn echten Vorgängen aus unserem Haus?
  • Welches Modell, mit welchem Abschaltdatum, und wer bezahlt die Stunden am Tag des Wechsels?
  • Welche Fehlerquote sichern Sie zu, und wie sehen wir die unsicheren Fälle, ohne alle Vorgänge zu lesen?
  • Was kostet der Ausstieg: Bleiben Anweisungen, Regeln und Protokolle bei uns, und in welchem Format?

Ab 965 Vorgängen im Jahr trägt sich der Agent

Die Gegenrechnung ist die Handarbeit. Dieselben 14.400 Vorgänge mit vier Minuten je Vorgang sind 960 Stunden und zum Bruttostundenverdienst von 28,19 Euro 27.062,40 Euro, also Faktor 8,2 gegenüber dem Agenten. Je Vorgang stehen 1,88 Euro Handarbeit gegen 11,1 Cent variable Agentenkosten.

Damit steht der Kipppunkt fest: 965 Vorgänge im Jahr im ersten Jahr mit Aufbau, ab dem zweiten Jahr 327 Vorgänge. Ja zum Agenten also, wenn der Ablauf über 1.000 Vorgänge im Jahr gleichartig läuft und jemand die unsicheren Fälle ansieht.

Nein zum Agenten in drei Lagen: unter etwa 1.000 Vorgängen im Jahr, bei Vorgängen, die jedes Mal anders aussehen, und immer dann, wenn eine feste Regel genügt. Die Sortierung dazu steht in KI-Automatisierung im Mittelstand.

Häufige Fragen

Drei Fragen zu Angebotsformen, die häufig kommen.

  • Pauschale oder Abrechnung je Vorgang? Bei gleichmäßiger Menge ist die Pauschale ruhiger, bei schwankender Menge zahlen Sie damit Leerlauf. Fragen Sie nach der Menge, die in der Pauschale enthalten ist, und nach dem Preis darüber.
  • Geht das auch ohne Abo? Ja. Die selbst betriebene n8n-Community-Fassung kostet keine Lizenz, dafür Server und Wartung. Für reine Regelabläufe kostet Power Automate Premium 15,00 US-Dollar je Nutzer, 157,85 Euro im Jahr, unbeaufsichtigt als Process 1.578,53 Euro.
  • Was ist mit günstigeren Modellen anderer Anbieter? Die Spanne ist groß: gpt-6-luna kostet 0,10 US-Dollar je Million Eingabe-Token, gpt-6-astra 10,00. Am Ergebnis dieser Rechnung ändert das wenig, weil die Token nur 11,5 Prozent tragen.

Nächster Schritt: vier Zeilen in das nächste Angebot

Nehmen Sie das Angebot, das auf Ihrem Tisch liegt, und ergänzen Sie vier Zeilen: Token je Vorgang, Stunden je Modellwechsel, zugesicherte Fehlerquote, Stunden für Nacharbeit im Monat. Ohne diese vier Zahlen ist der Preis unten nur der Aufbau.

Rechnen Sie dann mit der Formel oben nach und vergleichen Sie mit Ihrem Handarbeitswert. Liegt die Ersparnis unter 20 Prozent, verhandeln Sie über die Fehlerquote, nicht über den Preis.

Wenn Sie die Zahlen gemeinsam durchgehen wollen, tun wir das im kostenlosen Erstgespräch; den Aufbau übernehmen wir als interne KI-Leistung.

Quellen & Stand

Quellen zuletzt geprüft: 28.09.2026. Herstellerangaben und unsere Einordnung werden im Text unterschieden.

  1. Anthropic: Preise der Claude-Modelle
  2. Anthropic: Abschaltung von Modellen
  3. OpenAI: Preise der API-Modelle
  4. n8n: Preise
  5. Microsoft: Preise für Power Automate
  6. Statistisches Bundesamt: Durchschnittliche Bruttoverdienste, Stichmonat April 2025
  7. Europäische Zentralbank: Euro-Referenzkurs US-Dollar
  8. Bitkom: Erstmals nutzt die Mehrheit der Unternehmen KI

Korrekturhinweise: [email protected].

Was heißt das für Ihren Betrieb?

Wir besprechen einen konkreten Ablauf und prüfen, ob KI dabei helfen kann.

Kostenloses Erstgespräch buchen →