Embeddings: die unsichtbaren Kosten einer KI-Wissensdatenbank
Damit die KI aus Ihrer Wissensdatenbank antwortet, braucht jeder Abschnitt einen Vektor — und jede Besucherfrage auch. Diese Embeddings kosten pro Aufruf fast nichts, fallen aber ständig an. SilentChat berechnet sie bei IONOS in Deutschland, bucht sie getrennt und überspringt unveränderte Inhalte.
Wo Embeddings entstehen
- Beim Speichern: Wird ein Artikel veröffentlicht oder geändert, zerlegt SilentChat ihn in Abschnitte von etwa 512 Token mit 100 Token Überlappung, stellt jedem den Artikeltitel voran und berechnet die Vektoren im Hintergrund. Nur veröffentlichte Artikel und aktive Textbausteine landen im Index.
- Beim Einlesen der Website: Neue oder geänderte Seiten werden eingebettet.
- Bei jeder Besucherfrage: Die Frage selbst wird eingebettet, um passende Abschnitte zu finden. Ist ein Widget nicht mit der Wissensdatenbank verbunden, entfällt dieser Schritt.
- Beim Neuindexieren: alles auf einmal, in Stapeln zu 64 Abschnitten.
Was das kostet
Wir nutzen das Modell BAAI/bge-m3 bei IONOS mit 1024 Dimensionen. Laut IONOS-Preisliste (geprüft am 11.08.2026) kostet es 2 US-Cent je eine Million Eingabe-Token. Ein Abschnitt mit 512 Token kostet damit rund ein Tausendstel Cent.
So kleine Beträge haben uns zweimal zu falschen Zahlen verleitet: Zuerst standen Embeddings mit null im Kostenbuch, dann wurde je Aufruf auf ganze Cent gerundet — eine einzelne Abfrage kostete wieder null. Seit dem 14.09.2026 rechnet SilentChat in Millionstel Cent und trägt Reste je Mandant weiter. Gebucht wird getrennt nach Index, Besucherfrage und Duplikaterkennung.
Wie wir unnötige Neuberechnungen vermeiden
- Nur Geändertes neu: Beim erneuten Einlesen fragt der Crawler, ob sich eine Seite geändert hat. Antwortet der Server „nicht geändert“, wird nichts geladen; sonst vergleicht SilentChat eine Prüfsumme des Inhalts und überspringt unveränderte Seiten.
- Intervall nach Tarif: Automatisches Neueinlesen läuft alle 30 Tage (Growth), alle 7 Tage (Professional) oder täglich (Enterprise).
- Keine Suche ohne Nutzen: Widgets ohne Wissensdatenbank erzeugen keine Such-Embeddings.
Ein Modellwechsel heißt Neuaufbau
Bis zum 13.08.2026 liefen die Embeddings über OpenAI in den USA, mit 1536 Dimensionen. Vektoren zweier Modelle sind nicht vergleichbar. Für den Wechsel zu IONOS wurde die Spalte deshalb leer neu angelegt und jede Wissensdatenbank neu indexiert.
Damit das Modell nicht kalt startet, schickt SilentChat ihm jede Minute eine kleine Anfrage. Diese Anfragen werden ohne Mandanten gebucht und belasten kein Kundenbudget.