SilentChat

Token-Limits & Budget

Zuletzt aktualisiert: 16. September 2026

Jede AI-Anfrage verbraucht Tokens — die Maßeinheit für AI-Nutzung. Tokens sind ungefähr 0.75 Wörter.

Token-Verbrauch pro Anfrage

Eine typische AI-Anfrage verbraucht:

KomponenteTokens
System-Prompt100–500
Chat-Verlauf (Kontext)200–1000
KB-Chunks (RAG)300–1500
Bot-Antwort (Output)100–500
Gesamt pro Anfrage~700–3500

Limits

Monatslimit

Das monatliche Token-Limit wird durch Ihren Plan bestimmt:

  • Growth: Basislimit im Plan definiert
  • Professional: Höheres Limit
  • Enterprise: Benutzerdefiniert oder unbegrenzt

Das Limit kann pro Tenant über Monatliches Token-Limit in der AI-Konfiguration überschrieben werden (falls der Plan es erlaubt).

Tageslimit

Optional können Sie ein tägliches Limit setzen um Spitzen zu vermeiden:

Einstellungen → AI Chatbot → Tägliches Token-Limit

  • 0: Kein Tageslimit (nur Monatslimit gilt)
  • > 0: Maximale Tokens pro Tag

Budget-Anzeige

Unter AI Chatbot → Usage sehen Sie:

  • Verbrauchte Tokens (aktueller Monat)
  • Verbleibendes Budget
  • Täglicher Verbrauch (Graph)
  • Verbrauch pro Conversation (Top-Liste)
  • Verbrauch pro Widget (falls mehrere Widgets)

Was passiert bei Budget-Erschöpfung?

Wenn das Token-Budget aufgebraucht ist:

  1. Der Bot sendet die Fallback-Nachricht
  2. Neue Besucher-Nachrichten werden direkt an Agenten weitergeleitet
  3. Der Bot wird nicht mehr aufgerufen bis das Budget sich erneuert (nächster Monat/Tag)

Kosten schätzen

Die Kosten hängen vom Modell ab (alle bei IONOS):

ModellInput (pro 1M Tokens)Output (pro 1M Tokens)
Qwen 3.5 9B (IONOS)$0.11$0.17
Mistral Small 24B (IONOS)$0.11$0.33
GPT-OSS 120B (IONOS)$0.17$0.71
Llama 3.3 70B (IONOS)$0.71$0.71

Tipp: Starten Sie mit einem günstigen Modell (Qwen 3.5 9B oder Mistral Small 24B) und wechseln Sie bei Bedarf.

Token-Limits & Budget — Help Center — SilentChat | SilentChat