Token-Limits & Budget
Jede AI-Anfrage verbraucht Tokens — die Maßeinheit für AI-Nutzung. Tokens sind ungefähr 0.75 Wörter.
Token-Verbrauch pro Anfrage
Eine typische AI-Anfrage verbraucht:
| Komponente | Tokens |
|---|---|
| System-Prompt | 100–500 |
| Chat-Verlauf (Kontext) | 200–1000 |
| KB-Chunks (RAG) | 300–1500 |
| Bot-Antwort (Output) | 100–500 |
| Gesamt pro Anfrage | ~700–3500 |
Limits
Monatslimit
Das monatliche Token-Limit wird durch Ihren Plan bestimmt:
- Growth: Basislimit im Plan definiert
- Professional: Höheres Limit
- Enterprise: Benutzerdefiniert oder unbegrenzt
Das Limit kann pro Tenant über Monatliches Token-Limit in der AI-Konfiguration überschrieben werden (falls der Plan es erlaubt).
Tageslimit
Optional können Sie ein tägliches Limit setzen um Spitzen zu vermeiden:
Einstellungen → AI Chatbot → Tägliches Token-Limit
- 0: Kein Tageslimit (nur Monatslimit gilt)
- > 0: Maximale Tokens pro Tag
Budget-Anzeige
Unter AI Chatbot → Usage sehen Sie:
- Verbrauchte Tokens (aktueller Monat)
- Verbleibendes Budget
- Täglicher Verbrauch (Graph)
- Verbrauch pro Conversation (Top-Liste)
- Verbrauch pro Widget (falls mehrere Widgets)
Was passiert bei Budget-Erschöpfung?
Wenn das Token-Budget aufgebraucht ist:
- Der Bot sendet die Fallback-Nachricht
- Neue Besucher-Nachrichten werden direkt an Agenten weitergeleitet
- Der Bot wird nicht mehr aufgerufen bis das Budget sich erneuert (nächster Monat/Tag)
Kosten schätzen
Die Kosten hängen vom Modell ab (alle bei IONOS):
| Modell | Input (pro 1M Tokens) | Output (pro 1M Tokens) |
|---|---|---|
| Qwen 3.5 9B (IONOS) | $0.11 | $0.17 |
| Mistral Small 24B (IONOS) | $0.11 | $0.33 |
| GPT-OSS 120B (IONOS) | $0.17 | $0.71 |
| Llama 3.3 70B (IONOS) | $0.71 | $0.71 |
Tipp: Starten Sie mit einem günstigen Modell (Qwen 3.5 9B oder Mistral Small 24B) und wechseln Sie bei Bedarf.