Websuche¶
Websuche für beide Assistenten (ab Chart 0.82.13)
Beide Assistenten können optional im Internet nach aktuellen Informationen suchen. Die Funktion ist standardmäßig deaktiviert und wird über einen einzigen Schalter im Customer Portal aktiviert. Ausgelöst wird die Suche danach pro Unterhaltung von den Nutzern über das Globus-Symbol.
Bis Chart 0.81.67 stand die Websuche nur Inovetra AI zur Verfügung; der Wissensassistent war strikt dokumentenbasiert.
Beteiligte Komponenten¶
| Komponente | Typ | Zweck | Betrieb |
|---|---|---|---|
| SearXNG | Deployment (inovetra-searxng) |
Selbst-gehostete Meta-Suchmaschine — liefert Trefferlisten | on-demand (replicas 0 ↔ 1) |
| web-scraper | Deployment (inovetra-web-scraper) |
Inhaltsabruf der gefundenen Seiten (Firecrawl-kompatibel, FastAPI + httpx + trafilatura) | on-demand (replicas 0 ↔ 1) |
| LibreChat | Deployment | Bindet die Websuche für „Inovetra AI" ein (interface.webSearch) |
dauerhaft |
| rag-api | Deployment | Eigener Web-Retriever für „Inovetra RAG" — fragt SearXNG und web-scraper direkt ab | dauerhaft |
| Customer API | Deployment | Steuert Toggle, Scaling und Spiegelung nach LibreChat | dauerhaft |
web-scraper — Eckdaten
Der web-scraper (v0.1.2) ruft ausgewählte Webseiten ab und extrahiert den Textinhalt. Er rendert kein JavaScript und liefert daher die besten Ergebnisse bei textbasierten Seiten. Er besitzt SSRF-Schutz und ist über NetworkPolicies abgesichert.
Datenfluss¶
flowchart LR
subgraph Instanz["Kunden-Instanz (inovetra-platform)"]
LC["LibreChat<br/>Inovetra AI"]
RAG["rag-api<br/>Inovetra RAG"]
SX["SearXNG<br/>(on-demand)"]
WS["web-scraper<br/>(on-demand)"]
end
subgraph Internet["Internet (Egress 80/443)"]
SE["Externe<br/>Suchmaschinen"]
WEB["Webseiten"]
end
LC -->|"Suchbegriff"| SX
RAG -->|"Suchbegriff"| SX
SX -->|"Meta-Suche"| SE
LC -->|"Inhaltsabruf"| WS
RAG -->|"Inhaltsabruf"| WS
WS -->|"HTTP GET"| WEB
Daten verlassen die Instanz
Bei aktivierter Websuche werden Suchbegriffe an externe Suchmaschinen (via SearXNG) übermittelt und ausgewählte Webseiten über den web-scraper abgerufen (Internet-Egress über Ports 80/443). Die Aktivierung ist daher eine bewusste Administrator-Entscheidung mit Datenschutz-Relevanz.
Aktivieren / Deaktivieren¶
Die Steuerung erfolgt über einen einzigen Schalter im Customer Portal:
- Customer Portal → KI-Einstellungen öffnen
- Schalter Websuche umlegen (Ein/Aus)
- Speichern — die Customer API (
PATCH /rag/settings) übernimmt alle weiteren Schritte automatisch
Standard: deaktiviert
Die Websuche ist nach der Installation und nach jedem Update standardmäßig ausgeschaltet. Sie muss aktiv eingeschaltet werden.
Was beim Einschalten technisch passiert¶
| Schritt | Aktion |
|---|---|
| Scaling | Customer API skaliert inovetra-searxng und inovetra-web-scraper von replicas 0 → 1 |
| LibreChat-Spiegelung | interface.webSearch wird live in der ConfigMap inovetra-chat-config gesetzt und in inovetra-user-settings persistiert; die LibreChat-Pods werden neu erstellt |
| rag-api | wird NICHT neu gestartet (siehe Hinweis unten) |
Beim Ausschalten wird der Vorgang umgekehrt: beide Deployments werden auf replicas 1 → 0 herunterskaliert und interface.webSearch deaktiviert.
Kein rag-api-Neustart durch den Websuche-Toggle
Das Umlegen des Websuche-Schalters löst keinen Rollout der rag-api aus. Nur ein Wechsel des KI-Modellanbieters oder des Embedding-Modus startet die rag-api neu (siehe LLM-Modelle).
Unterschied zwischen den Assistenten¶
Beide nutzen dieselben Backends, lösen die Suche aber verschieden aus — relevant fürs Erwartungsmanagement im Support:
| Assistent | Auslöser | Verhalten |
|---|---|---|
| Inovetra AI | Modell entscheidet per Tool-Calling | Sucht, wenn es die Frage für aktualitätsbedürftig hält. Nicht garantiert. |
| Inovetra RAG | rag-api wertet den Schalter aus | Sucht bei aktiviertem Globus immer zusätzlich zu den Dokumenten. Vorhersagbar. |
Ohne Globus bleibt der Wissensassistent dokumentenbasiert
Ist das Globus-Symbol aus, antwortet Inovetra RAG ausschließlich aus den Unternehmensdokumenten. Findet er nichts Passendes, sagt er das ehrlich („keine Informationen in den Dokumenten") — statt zu raten.
Der frühere automatische Web-Fallback (Zumischen bei schwachen Treffern) bleibt entfernt. Die Suche läuft ausschließlich auf ausdrückliche Nutzeraktion, und die Antwort kennzeichnet die Herkunft je Aussage (📄 Dokument / 🌐 Web).
Latenz
Eine Anfrage mit aktivierter Websuche dauert einige Sekunden länger (Suche + Inhaltsabruf, typisch 1–3 s zusätzlich). Ohne Globus ändert sich nichts.
Siehe auch¶
- Komponenten — Komponentenübersicht inkl. SearXNG und web-scraper
- LLM-Modelle — KI-Modellanbieter und rag-api-Neustarts
- Runbook Websuche — Troubleshooting der Websuche
- Netzwerk und Kommunikation — Egress und interne DNS-Namen