Zum Inhalt springen

Budget & Kontingent

Jede Lizenz beinhaltet ein monatliches Nutzungskontingent für KI-Anfragen. So hat jeder im Workspace fairen Zugang zu allen verfügbaren KI-Modellen, von den sparsamen bis zu den leistungsstärksten.

Die allermeisten Nutzer kommen nie an ihr Kontingent. Spürbar wird die Grenze in der Praxis nur bei besonders intensiver Nutzung der teuersten Premium-Modelle.

Jede Lizenz hat ein eigenes monatliches Kontingent. Je höher der Lizenztier, desto mehr Spielraum:

LizenzKontingent (Multiplikator)
Pro1x (Basis)
Business3x
Max12x

Wir setzen die Kontingente bewusst großzügig an. Konkret ist das Limit pro Lizenz so gewählt, dass die Token-Kosten der KI-Anbieter den Lizenzpreis nicht überschreiten. Die meisten Nutzer reizen ihr Kontingent selten aus. So funktioniert das Modell wirtschaftlich für beide Seiten: Du hast genug Spielraum für deinen Alltag und wir können den Service zu einem fairen Preis dauerhaft anbieten.

Das Kontingent wird am 1. jedes Monats zurückgesetzt.

Warum keine harte Anfragezahl? Eine Zahl wie „X Anfragen pro Monat” wäre trügerisch. Eine einzige lange Analyse mit einem Spitzenmodell kann so viel Kontingent verbrauchen wie mehrere hundert kurze Alltagsfragen mit einem sparsamen Modell. Statt einer Zahl, die in der Praxis nicht trägt, siehst du in der Nutzungsanalyse jederzeit den realen Verbrauch deines Workspaces.

Nicht jede KI-Anfrage verbraucht gleich viel Kontingent. Im Modell-Selector und in den Modell-Einstellungen siehst du bei jedem Modell eine Kostenkategorie:

KategorieBedeutung
Sparsam, gut für einfache Aufgaben und Routineanfragen
€€Ausgewogen, gute Balance aus Qualität und Verbrauch
€€€Hohe Qualität, deutlich höherer Kontingentverbrauch pro Anfrage
€€€€Spitzenklasse, sehr hoher Kontingentverbrauch pro Anfrage

Das Prinzip: Premium-Modelle (€€€ und €€€€) liefern die besten Ergebnisse, verbrauchen aber deutlich mehr Kontingent pro Anfrage als sparsame Modelle. Wer regelmäßig mit den teuersten Modellen arbeitet, erschöpft sein Kontingent entsprechend schneller.

Tipp: Für alltägliche Aufgaben reicht oft ein €- oder €€-Modell. Greife zu €€€- und €€€€-Modellen, wenn höchste Qualität wirklich zählt, etwa bei komplexen Analysen, anspruchsvollen Coding-Aufgaben oder besonders sensiblen Texten.

Kontingente werden innerhalb des Workspaces geteilt. Das bedeutet:

  • Nutzer, die weniger verbrauchen, geben automatisch Spielraum für Kollegen mit höherem Bedarf
  • Ein einzelner Nutzer kann bis zu 200% seines eigenen Lizenzkontingents nutzen, solange das Gesamtbudget des Workspaces dies hergibt
  • So wird sichergestellt, dass ungenutztes Kontingent nicht verfällt, sondern dem Team zugutekommt

Dieses persönliche Limit ist die Grenze dessen, was ein Einzelner aus den Kontingenten seiner Kollegen ziehen kann. Was er darüber hinaus verbraucht, wird aus dem Guthaben des Workspaces bezahlt. Er arbeitet dabei ohne Einschränkung weiter, solange Guthaben da ist; ist keines vorhanden, stehen ihm nur noch die günstigen Modelle zur Verfügung. In der Nutzungsanalyse ist so ein Nutzer in der Spalte Kontingent rot markiert und mit dem Hinweis versehen, dass sein Verbrauch auf das Guthaben läuft.

Wo du gerade stehst, siehst du jederzeit selbst, ohne Administratorrechte: Unter Einstellungen → Persönliche Einstellungen findest du die Karte Nutzung mit deinem aktuellen Stand und dem Datum, an dem dein Kontingent erneuert wird.

Die Prozentzahl ist dein Verbrauch gemessen an deinem eigenen Kontingent, also dieselbe Zahl, die Administratoren in der Nutzungsanalyse über dich sehen.

Sie kann über 100 Prozent gehen, und das ist kein Fehler: Über dein Kontingent hinaus arbeitest du normal weiter, der Mehrverbrauch läuft dann über den Workspace (siehe Budget-Sharing im Team). Erst wenn dort ebenfalls nichts mehr übrig ist, stehen dir nur noch die günstigen Modelle zur Verfügung, und genau das steht dann auch auf der Karte.

Nähert sich der Punkt, an dem wirklich Schluss ist, erscheint zusätzlich ein Hinweis in der linken Seitenleiste. Solange du komfortabel darunter liegst, bleibt die Seitenleiste ruhig und du arbeitest einfach weiter.

Mit der Agenten-Plattform lassen sich Aufgaben auch autonom (per Zeitplan oder Webhook) ausführen. Damit ein Agent niemals unbemerkt mehr Kontingent verbraucht als gewollt, hat jeder Agent eine eigene monatliche Kostenbegrenzung als Sicherheitsnetz. Bei Erreichen pausiert der Agent automatisch und der Owner wird per Mail informiert.

Gezählt wird dabei nur der autonome Verbrauch. Was ein Mensch im Chat mit dem Agenten schreibt, zählt zum Kontingent dieser Person und bremst den Agenten nicht.

Voreingestellt sind €10/Monat, für die meisten Anwendungsfälle komfortabel. Den Wert kannst du pro Agent jederzeit anpassen: nach oben für leistungshungrigere Agenten, nach unten für eine noch engere Absicherung.

Pro Agent konfigurierbar:

  • Monatliche Kostenbegrenzung: Owner und Administratoren können den Wert ändern
  • Frühwarnung bei Auslastung: Mail-Benachrichtigung bei zum Beispiel 80 % des autonomen Verbrauchs
  • Erlaubte Modelle: zum Beispiel nur sparsame Modelle erlauben, keine Premium-Modelle für High-Volume-Crons
  • Auto-Pause bei 3 Fehlern in Folge: schützt vor „davonlaufenden” Konfigurationen

Wohin der Verbrauch gebucht wird, hängt davon ab, was passiert ist, nicht davon, wem der Agent gehört:

  • Autonome Läufe (Zeitplan, Webhook, „Jetzt ausführen”): bezahlt aus dem Guthaben des Workspaces
  • Was ein Mensch im Chat tippt: zählt zum Kontingent dieser Person, in welchem Agenten auch immer

Ist das Guthaben aufgebraucht, startet kein autonomer Lauf mehr. Ein bereits laufender Vorgang wird zu Ende geführt, und im Chat arbeitet ihr normal weiter.

Administratoren sehen unter Einstellungen → Nutzungsanalyse → Agenten eine Übersicht aller Agenten mit autonomem Verbrauch, Begrenzung und Status. Sie können die Begrenzung pro Agent gezielt überstimmen.

Als Admin steuerst du den Verbrauch im Workspace gezielt dort, wo er entsteht. Zwei Stellschrauben stehen dir zur Verfügung:

  • Lizenzwahl pro Person in der Benutzerverwaltung. Pro, Business oder Max bestimmen das Basiskontingent und welche Features (Agenten, Integrationen, API) freigeschaltet sind.
  • Agenten-Kostenbegrenzung pro Agent in der Nutzungsanalyse. Du kannst die monatliche Begrenzung pro Agent als Override setzen und zusätzlich die erlaubten Modelle pro Agent einschränken, zum Beispiel nur sparsame Modelle für High-Volume-Crons.

Im Workspace gibt es mehrere unabhängige Bremsen, die den Verbrauch absichern. Sie wirken getrennt voneinander, das ist der häufigste Punkt, an dem die Frage entsteht „Mein Budget ist doch erhöht, warum läuft mein Agent trotzdem nicht?”. Die folgende Tabelle macht das Mapping eindeutig:

BremseWann sie greiftWas passiertWas du tun kannst
Workspace-Kontingent erschöpftWenn der monatliche Workspace-Pool aller Lizenzen aufgebraucht istAlle Nutzer chatten weiter mit den günstigen Modellen, die Premium-Modelle sind bis zum nächsten Reset deaktiviertGuthaben nachkaufen, Lizenz upgraden oder bis zum 1. des Folgemonats warten
Guthaben aufgebrauchtWenn das Guthaben des Workspaces verbraucht istAutonome Läufe starten nicht mehr. Im Chat arbeitet ihr normal weiter, solange die Lizenzkontingente reichenGuthaben nachkaufen
Agent-Kostenbegrenzung erreichtWenn der monatliche autonome Verbrauch eines einzelnen Agenten seine eigene Begrenzung erreicht (Standard €10)Der Agent führt keine autonomen Läufe mehr aus, Owner und Admin werden per Mail informiert. Andere Agenten laufen weiter, und chatten kannst du mit ihm auch weiterhinBegrenzung im Tab KI-Modell erhöhen, oder bis Monatsende warten. Admins können den Wert in der Nutzungsanalyse überstimmen
Auto-Pause nach drei Fehlern in FolgeWenn ein autonom getriggerter Agent dreimal hintereinander mit einem Fehler endetDer Agent pausiert, weitere Cron- und Webhook-Runs werden nicht ausgeführt. Chat-Runs sind davon nicht betroffenUrsache in der Run-Historie prüfen, Konfiguration anpassen und Agent im Tab Allgemein wieder aktivieren
Tageslimit in der TestphaseWährend der 7-tägigen Testphase, wenn das tägliche Kontingent erreicht istHarte Grenze: neue KI-Anfragen pausieren bis zum TagesresetBis zum nächsten Tag warten oder eine Lizenz buchen

Praktische Konsequenz: Eine Erhöhung deines persönlichen Anteils am Workspace-Pool hilft nicht, wenn ein einzelner Agent seine eigene Kostenbegrenzung erreicht hat. Beides sind getrennte Stellschrauben. Wenn ein Agent unerwartet pausiert, schau zuerst auf die Agenten-Kostenbegrenzung im Tab KI-Modell und auf den Status in der Nutzungsanalyse.

Auch wenn das Kontingent aufgebraucht ist, bleibst du arbeitsfähig:

  • Du chattest weiter, allerdings nur noch mit den günstigen Modellen. Diese decken die allermeisten Alltagsanfragen problemlos ab.
  • Die teuren Premium-Modelle bleiben bis zum nächsten Kontingent-Reset deaktiviert. Im Modell-Selektor erscheinen sie ausgegraut, mit einem Hinweis, ab wann sie wieder verfügbar sind.
  • Die Plattform bleibt vollständig nutzbar: Wissensmanagement, Einstellungen und bestehende Chats lesen sind ohne Einschränkung möglich.
  • In der linken Seitenleiste erscheint ein Statushinweis mit dem Reset-Datum.

Wenn du sofort wieder zu den Premium-Modellen greifen willst, hast du zwei Optionen:

  • Guthaben nachkaufen, um sofort weiterzuarbeiten
  • Auf eine höhere Lizenz upgraden, für dauerhaft mehr Kontingent (zum Beispiel von Pro auf Business oder Max)

Andernfalls werden die Premium-Modelle automatisch am 1. des Monats wieder freigeschaltet, wenn das Kontingent zurückgesetzt wird.

Hinweis zu autonomen Agenten: Cron- oder Webhook-Agenten laufen in diesem Zustand nur weiter, wenn sie ohnehin auf eines der günstigen Modelle konfiguriert sind. Steht beim Agenten ein Premium-Modell, pausiert er bis zum nächsten Reset oder bis du das Modell anpasst. Mehr dazu unter Kostenbegrenzung pro Agent.

Guthaben ist ein Konto des Workspaces, das Administratoren unter Abrechnung jederzeit aufladen können. Zwei Dinge werden daraus bezahlt:

  • Der gesamte Verbrauch autonomer Agentenläufe (Zeitplan, Webhook, „Jetzt ausführen”)
  • Was einzelne Nutzer über ihr persönliches Limit hinaus verbrauchen (siehe Budget-Sharing im Team)
  • Alles, was der Workspace über die Summe aller Lizenzkontingente hinaus verbraucht

In der Kontingent-Karte der Nutzungsanalyse steht unter dem Guthaben, wofür es im laufenden Monat draufgegangen ist, mit einem eigenen Betrag je Quelle.

Nicht verbrauchtes Guthaben verfällt nicht, es steht im nächsten Monat weiterhin zur Verfügung.

Du wählst unter Abrechnung die Anzahl der Pakete und wirst zur Bezahlseite weitergeleitet. Nach erfolgreicher Zahlung landest du wieder in der Anwendung, das Guthaben steht sofort zur Verfügung und die Rechnung geht automatisch an deine hinterlegte Rechnungsadresse. Brichst du den Bezahlvorgang ab, passiert nichts: es entsteht keine Bestellung und keine Rechnung.

Beim Bezahlen mit Karte kann eure Bank kurz nachfragen, ob ihr den Kauf bestätigt, meist über die Banking-App oder eine SMS. Ob sie das tut, entscheidet die Bank.

Zahlt ihr per Lastschrift oder auf Rechnung, läuft es umgekehrt. Ihr bekommt die Rechnung direkt mit der Bestellung, mit Zahlungsziel, und könnt sie über den Link in der Rechnungshistorie jederzeit begleichen. Diese Zahlungsarten schalten wir nach Absprache frei; sprich uns an, wenn ihr sie nutzen möchtet.

Ist das Guthaben leer, pausieren die autonomen Agenten, während im Chat weitergearbeitet wird, solange die Lizenzkontingente reichen.

Guthaben eignet sich besonders für Monate mit erhöhtem Bedarf, etwa bei Projekten, Quartalsabschlüssen oder wenn neue Mitarbeiter die Plattform intensiv kennenlernen.

Damit Agenten und Team weiterarbeiten können, lässt sich der Nachkauf automatisieren. In der Guthaben-Karte unter Abrechnung legt ihr drei Werte fest:

  • Schwelle: ab welchem Restguthaben nachgekauft wird
  • Betrag: wie viel dann gekauft wird, in Schritten von 10 € und mindestens so viel wie die Schwelle
  • Monatsgrenze: wie viel höchstens im Monat automatisch gekauft wird (optional)

Dass der Betrag mindestens die Schwelle erreicht, ist Absicht: sonst läge das Guthaben nach dem Kauf immer noch unter der Schwelle und es würde sofort wieder gekauft. Alle Beträge sind Nettobeträge, abgebucht wird der Bruttobetrag inklusive Umsatzsteuer.

Abgebucht wird von derselben Zahlungsart, mit der ihr euer Abo bezahlt; neue Zahlungsdaten braucht es nicht. Beim Einschalten bestätigt ihr einmal, dass wir diese Beträge einziehen dürfen. Ausschalten könnt ihr es jederzeit an derselben Stelle. Die Funktion ist standardmäßig aus, und ändern darf sie nur, wer die Abrechnung verwalten darf.

Voraussetzung ist Karte oder Lastschrift. Zahlt ihr mit Amazon Pay oder Klarna, bleibt der Schalter gesperrt, weil sich diese Zahlungsarten nicht für wechselnde Beträge ohne euer Zutun eignen. Ein Wechsel der Zahlungsart genügt, um die Automatik nutzen zu können.

Der Stand wird alle fünf Minuten geprüft. Fällt das Guthaben unter die Schwelle, wird genau einmal nachgekauft, nicht mehrfach hintereinander. Ist die Monatsgrenze erreicht, wird nicht mehr nachgekauft; stattdessen kommt die gewohnte Warnung, dass das Guthaben knapp wird.

Bei Karte entsteht dann weder Guthaben noch Rechnung. Alle Administratoren bekommen eine E-Mail, und der automatische Nachkauf pausiert, bis wieder ein Kauf von Hand geklappt hat. Wird die Karte dauerhaft abgelehnt, etwa weil sie gesperrt ist, schaltet sich die Automatik ganz aus: eine Karte, gegen die immer wieder gebucht wird, sperrt die Bank irgendwann von sich aus.

Bei Lastschrift stehen Guthaben und Rechnung sofort, weil das Ergebnis der Abbuchung erst Tage später feststeht. Kommt später eine Rücklastschrift, bleibt das Guthaben bestehen, unser Support meldet sich, und die Automatik pausiert.

In der Guthaben-Karte steht jederzeit, wann zuletzt automatisch gekauft wurde und wie viel in diesem Monat schon automatisch dazugekommen ist.