Lange war KI-Software ein Abo: ein fester Preis pro Nutzer und Monat, fertig. Dieses Modell bekommt Risse. Immer mehr Anbieter rechnen nach tatsächlichem Verbrauch ab, und dann ist die Rechnung am Monatsende nicht mehr die Summe der Lizenzen.
Ich habe in den letzten Wochen mehrere Setups auf diese Logik umgestellt. Hier steht, wie ich dabei vorgehe. Wie sich die Preise der Modelle selbst entwickeln, habe ich im Beitrag KI-Preise stürzen beschrieben. Hier geht es um die Frage, wie du den Verbrauch steuerst.
Das Beispiel: GitHub Copilot seit Juni
Gut dokumentiert ist der Wechsel bei GitHub Copilot, dem KI-Assistenten für Entwickler. GitHub hat am 27. April 2026 angekündigt, dass alle Copilot-Tarife zum 1. Juni 2026 auf nutzungsbasierte Abrechnung umgestellt werden. Die Einheit heißt AI Credits.
Der Verbrauch richtet sich nach den Token, also nach den Textmengen, die das Modell liest und schreibt. Zählt werden Eingabe, Ausgabe und zwischengespeicherte Token zu den veröffentlichten API-Preisen des jeweiligen Modells. Die Grundpreise der Tarife blieben dabei gleich, jeder Tarif enthält ein monatliches Guthaben in Höhe seines Preises. Copilot Pro kostet zum Beispiel 10 US-Dollar im Monat und bringt 10 US-Dollar an Credits mit.
Code-Vervollständigungen und Next-Edit-Vorschläge verbrauchen laut GitHub keine Credits. Alles andere, was auf Modell-Token läuft, wird gezählt. Bei Business- und Enterprise-Tarifen gibt es bis einschließlich August erhöhte Einführungsguthaben.
Warum das für dich relevant ist, auch wenn du nie Code schreibst: Die Logik gilt für jedes KI-Werkzeug, das nach Token abrechnet. Wer Agenten und längere Aufgaben nutzt, verbraucht deutlich mehr als jemand, der gelegentlich eine Frage stellt. Ein Pauschalpreis mittelt das aus, eine Abrechnung nach Verbrauch nicht.
Warum die Rechnung schwer vorherzusagen ist
Bei Lizenzen weißt du vorher, was es kostet. Bei Verbrauch hängt es von Dingen ab, die du selten im Blick hast.
Ein Agent, der eine Aufgabe in zwanzig Schritten löst, liest in jedem Schritt wieder den bisherigen Verlauf. Dieselbe Frage kostet je nach Modell ein Vielfaches. Und wenn ein Ablauf in einer Schleife hängt, läuft der Zähler, bis jemand eingreift. Das Ergebnis sind Ausreißer: Der Durchschnitt wirkt harmlos, einzelne Läufe sind teuer. Ich schaue deshalb nie auf die Monatssumme allein, sondern auf die teuersten zehn Prozent der Vorgänge.
Budgets und Limits setzen
Der wichtigste Schritt ist ein hartes Limit, bevor etwas schiefgeht. GitHub bietet dafür Budgetkontrollen auf Ebene des Unternehmens, einer Kostenstelle und einzelner Nutzer. Organisationen können wählen, ob zusätzliche Nutzung zu den veröffentlichten Preisen erlaubt ist oder ob die Ausgaben gedeckelt werden.
Dieses Prinzip kannst du bei jedem Anbieter einfordern, auch wo es anders heißt. Ich prüfe vor dem Einsatz drei Dinge:
- Gibt es ein Limit, das den Verbrauch tatsächlich stoppt, oder nur eine Warnung per Mail?
- Lässt sich das Limit pro Person oder pro Projekt setzen, nicht nur für das gesamte Konto?
- Was passiert bei Erreichen: Hört alles auf, oder läuft es zum Normalpreis weiter?
Ein Limit nur als Warnung ist ein Hinweis, keine Kontrolle. Das ist beim Anbieterwechsel oft der unscheinbarste und teuerste Unterschied.
Kosten pro Vorgang statt pro Monat
Die Zahl, die mir bei Entscheidungen hilft, ist selten die Monatsrechnung. Es sind die Kosten pro erledigtem Vorgang: ein klassifiziertes Dokument, ein beantwortetes Ticket, ein fertiger Entwurf.
Dafür brauchst du keine Spezialsoftware. Teile die Kosten eines Zeitraums durch die Anzahl der Vorgänge, und trag beides einmal pro Woche in eine Tabelle ein. Nach einem Monat siehst du, ob ein Vorgang 3 Cent oder 3 Euro kostet. Mit dieser Zahl lässt sich eine Automatisierung gegen die Handarbeit rechnen, die sie ersetzt. Wenn sie plötzlich springt, hat sich etwas geändert: das Modell, der Prompt oder die Art der Eingaben.
Ein Rechenbeispiel, frei erfunden, aber realistisch im Aufbau: Eine Automatisierung bearbeitet im Monat 400 Anfragen und kostet laut Abrechnung 60 Euro. Das sind 15 Cent pro Anfrage. Dauert dieselbe Anfrage von Hand zehn Minuten, ist die Frage nach der Wirtschaftlichkeit schnell beantwortet. Ohne die Teilung durch die Anzahl der Vorgänge bleibt "60 Euro" nur eine Zahl, die teuer oder billig wirken kann.
Kleine Hebel, die wirken
Wenn der Verbrauch zu hoch ist, gibt es wenige Stellen, an denen sich wirklich etwas holen lässt.
- Das richtige Modell pro Aufgabe: Sortieren und Extrahieren braucht kein Spitzenmodell.
- Kürzerer Kontext: Nicht den ganzen Ordner mitgeben, wenn eine Seite genügt.
- Schritt-Limits für Agenten: Eine Obergrenze für die Zahl der Schritte verhindert Endlosschleifen.
- Verbrauch sichtbar machen: Wer seine Zahlen sieht, spart von selbst.
Wer Abläufe ohne Programmieren aufbauen und dabei die Kosten im Blick behalten will, findet im Bereich KI-Automatisierung die passenden Werkzeuge.
Fazit
Nutzungsbasierte Abrechnung ist nicht grundsätzlich teurer. Sie ist ehrlicher, weil sie zeigt, was eine Aufgabe tatsächlich kostet. Der Preis dafür ist, dass du selbst steuern musst, was bei einer Lizenz der Anbieter für dich gemittelt hat. Setz ein hartes Limit, miss pro Vorgang und schau auf die Ausreißer. Das ist ein Nachmittag Einrichtung, der dir die erste unangenehme Rechnung ersparen kann.
Josef vom KI Club