KI-Chat
LibreChat, Konfiguration und Benutzeroberfläche kontrolliert betreiben.
WZ-IT betreibt LibreChat als zentrale KI-Oberfläche, verbindet freigegebene Modelle und Werkzeuge und sichert Identitäten, Datenflüsse und Updates ab.
Die genannten Namen sind Marken ihrer jeweiligen Inhaber: LibreChat (the LibreChat project). WZ-IT ist ein unabhängiger Dienstleister und steht in keiner geschäftlichen, partnerschaftlichen oder vertraglichen Beziehung zu diesen Unternehmen. Wir bieten unabhängige Migrations-, Installations-, Hosting- und Betriebsdienstleistungen an.
LibreChat kann lokale Inferenz und externe Modell-APIs in einer gemeinsamen Oberfläche bündeln. Welche Daten wohin fließen, hängt von jedem eingerichteten Endpunkt und Werkzeug ab.
Wir richten Anwendung, Datenbank, Suche, RAG-Komponenten, Authentifizierung und Modellzugänge ein und dokumentieren die erlaubten Datenwege.
Eine selbst gehostete Oberfläche macht externe Modelle nicht automatisch lokal. Wir kennzeichnen lokale und externe Endpunkte und begrenzen Modelle, Agents und MCP-Werkzeuge nach Nutzergruppen.
Modellkosten, Nutzungsbedingungen und fachliche Eignung bleiben abhängig vom jeweiligen Anbieter und werden nicht durch den Hostingpreis abgedeckt.
Anwendung, MongoDB, Suche, RAG, Modellzugänge, Agents und MCP-Werkzeuge bilden gemeinsam den sicherheitsrelevanten KI-Stack.
LibreChat, Konfiguration und Benutzeroberfläche kontrolliert betreiben.
Lokale und externe Endpunkte, Tools und Agents gezielt freigeben.
Wissensdaten, RAG API und MCP-Server mit klaren Rechten anbinden.
Secrets, Datenbanken, Updates, Monitoring und Backups absichern.
WZ-IT betreibt den technischen Stack; erlaubte Daten, Modelle, Tools und fachliche Nutzung werden gemeinsam beziehungsweise kundenseitig festgelegt.
| Bereich | Verantwortung | Leistung und Abgrenzung |
|---|---|---|
| LibreChat-Plattform | WZ-IT | Anwendung, Datenbanken, Proxy, Updates, Monitoring und Backup. |
| Secrets und Modellendpunkte | WZ-IT | Technisch gesicherte Credentials und definierte Netzwerkpfade. |
| Modelle und Nutzergruppen | Gemeinsam | Wir konfigurieren Freigaben; der Kunde legt zulässige Modelle und Rollen fest. |
| RAG und MCP-Werkzeuge | Gemeinsam | WZ-IT integriert technisch; Daten- und Fachverantwortliche genehmigen Quellen und Aktionen. |
| Inhalte und KI-Governance | Kunde | Der Kunde verantwortet zulässige Eingaben, Prüfung von Ausgaben und interne Richtlinien. |
| Individuelle Agents und Tools | Optional durch WZ-IT | Eigene MCP-Server, APIs und Workflows werden separat entwickelt und evaluiert. |
Eine vertraute Chat-Oberfläche mit Verlauf, Dateien und freigegebenen Funktionen bereitstellen.
Assistenten, Tools und Automatisierungen für klar definierte Aufgaben konfigurieren.
Lokale Inferenz und unterstützte externe Modellanbieter kontrolliert über eine Plattform nutzbar machen.
Dokumente und Wissensbestände über die vorgesehenen RAG-Komponenten einbinden.
Authentifizierung, Gruppen, Secrets und administrative Zugänge passend zur Zielarchitektur schützen.
Freigegebene MCP-Server und APIs mit begrenzten Rechten und dokumentierten Datenflüssen anbinden.
Bestehende Daten und Konfigurationen prüfen, testweise übernehmen und mit einem kontrollierten Cutover in den Betrieb überführen.
SSO, Rollen, administrative Wege und externe Zugriffe passend zu Anwendung und vorhandener Infrastruktur absichern.
Alle zustandsbehafteten Komponenten konsistent sichern und den Wiederherstellungsweg für den vereinbarten Umfang dokumentieren.
Anwendung und technische Abhängigkeiten überwachen, kontrolliert aktualisieren und nach vereinbartem Service Level betreiben.
Ein klarer Betriebsumfang statt einer unübersichtlichen Hosting-Pauschale.
Wir richten eine Testinstanz für Sie ein, in der Regel am nächsten Werktag. Ohne Zahlungsdaten. Nach sieben Tagen wird sie gelöscht, sofern Sie nicht übernehmen.
Wir verbinden die passende Compute-Größe mit laufendem Betrieb, Backups, Monitoring und einem Service Level, das zur Kritikalität von LibreChat passt. Hochverfügbarkeit und Recovery-Ziele werden bei Bedarf separat geplant.
Wir planen auch individuelle Hosting-Architekturen, Integrationen und Migrationen rund um LibreChat. Kontaktieren Sie uns für ein technisches Assessment.
Eine verwaltete LibreChat-Standardanwendung ist im Starter-Workload enthalten. Ab Business kommt ein flexibel nutzbares Betriebsbudget für planbare Leistungen innerhalb der regulären Servicezeit hinzu. Wählen Sie Compute, weitere Anwendungen, Speicher und das passende Service Level.
Ein Workload ist eine Compute-Instanz mit den darauf vereinbarten Anwendungen.
Ein Standard-App je Workload ist bereits enthalten. Zusätzliche dedizierte Server zählen als weitere Workloads.
79,90 € je angefangenem TB und Monat, inklusive täglichem verschlüsseltem Offsite-Backup mit 7 Tagen Aufbewahrung.
Anfrage
Nennen Sie kurz Ausgangslage und Ziel für LibreChat. Wir ordnen Infrastruktur, Integration und laufenden Betrieb ein.
Die Oberfläche selbst ist leicht; lokale Inferenz, parallele Chats, große Dateien, RAG und Tools bestimmen den Gesamtbedarf.
| Nutzungsszenario | Technischer Startpunkt | Wichtige Einflussfaktoren |
|---|---|---|
| Externe Modell-APIs und kleines Team | M | Anwendung, MongoDB, Suche und normale Dateiverarbeitung. |
| Mehrere Teams mit RAG | M oder L plus Speicher | Dokumente, Embeddings, Suche und Hintergrundjobs werden berücksichtigt. |
| Lokale Modelle | GPU-Assessment | Modell, Quantisierung, Kontext und Parallelität bestimmen die Inferenzplattform. |
| Viele Agents und MCP-Tools | Security- und Last-Assessment | Berechtigungen, Laufzeiten und externe Aktionen werden einzeln geprüft. |
Der Standardrechner deckt die Anwendung ab. GPU, Modellkosten, große RAG-Bestände und individuelle Tools werden separat kalkuliert.
Oberfläche, Modelle und Wissensquellen können gemeinsam oder getrennt platziert werden.
KI-Oberfläche mit freigegebenen externen oder angebundenen lokalen Modellen.
Betrieb im eigenen Account und mit vorhandenen Modellendpunkten.
Lokale Plattform mit lokalen Modellen oder dem WZ-IT AI Cube.
Lokale Daten und freigegebene externe Modelle über kontrollierte Routen.
Jeder Modellendpunkt, jede Wissensquelle und jedes MCP-Werkzeug erhält einen dokumentierten Daten- und Berechtigungsweg.
Chat, Dateien, Agents und freigegebene APIs.
Proxy, SSO, Gruppen und begrenzte administrative Wege.
Nutzergruppen, Modelle, Agents und Tools nach Bedarf.
Chat-Oberfläche, Modellrouting, Agents, RAG und MCP.
Chats, Konfiguration, Indexe und Plattformzustand.
Lokale Inferenz, externe APIs und Wissensdienste.
Werkzeuge mit minimalen Rechten und nachvollziehbaren Aktionen.
Self-Hosting der Oberfläche bedeutet nicht automatisch lokale Modellverarbeitung. Externe Datenwege werden pro Endpunkt ausgewiesen.
Antworten zu Modellen, RAG, MCP und Datenschutz.
Ja, wenn Anwendung, Inferenz, RAG und Tools lokal bereitgestellt werden. Externe Endpunkte werden nur angebunden, wenn sie Teil der freigegebenen Architektur sind.
LibreChat legt einen starken Schwerpunkt auf mehrere Modellanbieter, Agents und MCP. Open WebUI bleibt unser Standard für den AI Cube; die Auswahl folgt dem Anwendungsfall.
Ja. Wir prüfen Funktionen, Credentials, erlaubte Aktionen, Netzwerkwege und Protokollierung und begrenzen Zugriffe pro Nutzergruppe.
Nein. Externe API-Kosten oder dedizierte GPU-Ressourcen werden getrennt vom Anwendungsbetrieb ausgewiesen.
Wir sichern die vereinbarten Datenbanken, Suchindizes, Konfigurationen und Dateispeicher konsistent und dokumentieren den Restore.
Als Alternative zum Managed Hosting im Rechenzentrum stellt WZ-IT die Hardware bereit, richtet LibreChat ein und übernimmt Absicherung, Monitoring, Updates, Backup und technischen Support. Der Zugriff kann auf das interne Netz begrenzt oder über VPN und vorhandene Identitäten freigegeben werden.
ab 349 € netto / Monat · zzgl. einmalig Bereitstellung und Ersteinrichtung

08.11.2025
Die Nutzung von Large Language Models (LLMs) wie GPT-4, Claude oder Llama hat sich in den letzten Jahren von experimentellen Anwendungen zu unternehmenskritischen Werkzeugen entwickelt....
09.11.2025
Lokale KI-Inferenz bedeutet, dass ein Sprach- oder Multimodalmodell auf eigener Hardware statt über eine öffentliche API ausgeführt wird. Unternehmen gewinnen damit Kontrolle über Datenwege, Modellwahl...
24.11.2025
OpenAI hat GPT-OSS 120B am 5. August 2025 als Open-Weight-Reasoning-Modell veröffentlicht. Durch die ab Werk verwendete MXFP4-Quantisierung positioniert OpenAI das Modell für eine einzelne GPU...
Diese Lösungen werden oft zusammen mit LibreChat eingesetzt
Diese Lösungen bieten ähnliche Funktionalitäten und können gemeinsam evaluiert werden
Diese Lösungen sind direkte Alternativen mit ähnlichen Einsatzgebieten
Kein Risiko: Im schlechtesten Fall gehen Sie mit mehr Klarheit über Ihr Projekt heraus als vorher.


„Die Beratung von WZ-IT zu unserer Azure-Migration war schon im Erstgespräch fachlich sehr fundiert und völlig unverbindlich - wir haben eine Menge mitgenommen.“
Ob konkrete IT-Herausforderung oder einfach eine Idee - wir freuen uns auf den Austausch. In einem kurzen Gespräch prüfen wir gemeinsam, ob und wie Ihr Projekt zu WZ-IT passt.