Dokumentverarbeitung
Formate, Layouts, Tabellen, OCR und Chunking mit repräsentativen Unterlagen testen.
WZ-IT plant und betreibt RAGFlow für anspruchsvolle Wissensbestände und stimmt Parsing, Embeddings, Retrieval, Modelle und Infrastruktur auf den Anwendungsfall ab.
Die genannten Namen sind Marken ihrer jeweiligen Inhaber: RAGFlow (InfiniFlow). WZ-IT ist ein unabhängiger Dienstleister und steht in keiner geschäftlichen, partnerschaftlichen oder vertraglichen Beziehung zu diesen Unternehmen. Wir bieten unabhängige Migrations-, Installations-, Hosting- und Betriebsdienstleistungen an.
Bei RAGFlow bestimmen Dateiformate, Layouts, Tabellen, Chunking, Embeddings und Suchstrategie, ob Nutzer belastbare Quellen erhalten. Ein reiner Softwarestart beantwortet diese Fragen nicht.
Wir testen repräsentative Dokumente, definieren Qualitätsfragen und planen anschließend Komponenten, Speicher, Modellendpunkte und Betriebsprozesse.
Produktive Setups umfassen mehrere Daten-, Such- und Hintergrunddienste. Ressourcenbedarf und Betrieb hängen von Dokumentvolumen, Importlast, Parallelität und Modellen ab.
Der Rechner bildet den Standardbetrieb ab. Parser, Datenquellen, Modelle und individuelle RAG-Integrationen werden im Angebot separat abgegrenzt.
Parsing, Chunking, Embeddings, Suche und Antwortmodell müssen anhand echter Dokumente evaluiert werden. Der technische Betrieb umfasst deshalb mehr als das Starten von Containern.
Formate, Layouts, Tabellen, OCR und Chunking mit repräsentativen Unterlagen testen.
Vektoren, Schlüsselwortsuche, Metadaten und Reranking kontrolliert betreiben.
Embedding-, Reranking- und Antwortmodelle passend zu Sprache und Qualität anbinden.
Ingestion, Fehler, Speicher, Backups und Versionswechsel überwachen.
WZ-IT betreibt die Plattform und setzt die technische Pipeline um. Dokumentfreigaben und fachliche Qualitätsbewertung erfolgen gemeinsam mit dem Kunden.
| Bereich | Verantwortung | Leistung und Abgrenzung |
|---|---|---|
| RAGFlow-Plattform | WZ-IT | Deployment, Daten- und Suchdienste, Proxy, Monitoring und Updates. |
| Dokument-Pipeline | WZ-IT | Technische Konfiguration für Parsing, Chunking, Embeddings und Retrieval. |
| Testkorpus und Qualitätsfragen | Gemeinsam | Wir erstellen Messung und Varianten; der Kunde liefert repräsentative Dokumente und Sollantworten. |
| Berechtigungen und Quellen | Gemeinsam | Zugriffsschutz und Datenwege werden passend zur Quelle geplant und getestet. |
| Fachliche Freigabe | Kunde | Der Kunde bewertet Richtigkeit, Vollständigkeit und zulässige Nutzung der Antworten. |
| Individuelle Konnektoren | Optional durch WZ-IT | Automatisierte Quellen, ACLs und Folgeprozesse werden separat entwickelt. |
PDFs und weitere Formate mit abgestimmten Parsing- und Chunking-Verfahren für die Suche vorbereiten.
Vektor-, Schlüsselwort- und hybride Suchverfahren passend zu Inhalt und Fragestellung konfigurieren.
Freigegebene Dokumentenquellen über vorhandene Schnittstellen oder individuelle Pipelines integrieren.
Fundstellen, Quellen und Antworten mit einem repräsentativen Testset nachvollziehbar bewerten.
Benutzer, administrative Oberflächen, Modellzugänge und Datenpfade passend zur Zielarchitektur schützen.
RAG-Funktionen über definierte Schnittstellen in interne Assistenten und Fachanwendungen einbinden.
Bestehende Daten und Konfigurationen prüfen, testweise übernehmen und mit einem kontrollierten Cutover in den Betrieb überführen.
SSO, Rollen, administrative Wege und externe Zugriffe passend zu Anwendung und vorhandener Infrastruktur absichern.
Alle zustandsbehafteten Komponenten konsistent sichern und den Wiederherstellungsweg für den vereinbarten Umfang dokumentieren.
Anwendung und technische Abhängigkeiten überwachen, kontrolliert aktualisieren und nach vereinbartem Service Level betreiben.
Ein klarer Betriebsumfang statt einer unübersichtlichen Hosting-Pauschale.
Wir richten eine Testinstanz für Sie ein, in der Regel am nächsten Werktag. Ohne Zahlungsdaten. Nach sieben Tagen wird sie gelöscht, sofern Sie nicht übernehmen.
Wir verbinden die passende Compute-Größe mit laufendem Betrieb, Backups, Monitoring und einem Service Level, das zur Kritikalität von RAGFlow passt. Hochverfügbarkeit und Recovery-Ziele werden bei Bedarf separat geplant.
Wir planen auch individuelle Hosting-Architekturen, Integrationen und Migrationen rund um RAGFlow. Kontaktieren Sie uns für ein technisches Assessment.
Eine verwaltete RAGFlow-Standardanwendung ist im Starter-Workload enthalten. Ab Business kommt ein flexibel nutzbares Betriebsbudget für planbare Leistungen innerhalb der regulären Servicezeit hinzu. Wählen Sie Compute, weitere Anwendungen, Speicher und das passende Service Level.
Ein Workload ist eine Compute-Instanz mit den darauf vereinbarten Anwendungen.
Ein Standard-App je Workload ist bereits enthalten. Zusätzliche dedizierte Server zählen als weitere Workloads.
79,90 € je angefangenem TB und Monat, inklusive täglichem verschlüsseltem Offsite-Backup mit 7 Tagen Aufbewahrung.
Anfrage
Nennen Sie kurz Ausgangslage und Ziel für RAGFlow. Wir ordnen Infrastruktur, Integration und laufenden Betrieb ein.
Seitenzahl allein reicht nicht. Dateikomplexität, OCR, Tabellen, Änderungsrate, Kontext und parallele Anfragen bestimmen Compute und Speicher.
| Nutzungsszenario | Technischer Startpunkt | Wichtige Einflussfaktoren |
|---|---|---|
| Pilot mit ausgewähltem Dokumentbestand | Testkorpus und Evaluation | Parser, Chunking und Suche werden vor der Skalierung abgestimmt. |
| Großer oder heterogener Bestand | Ingestion- und Speicher-Assessment | OCR, Worker, Index und Wiederaufbauzeiten werden gemessen. |
| Viele parallele Nutzer | Lasttest für Retrieval und Modelle | Such- und Inferenzpfad werden getrennt dimensioniert. |
| Geschäftskritisches Wissenssystem | Recovery- und Qualitätskonzept | Backups, Reindexierung, Evaluation und Rollback werden geplant. |
Dokumentprofile, Datenmenge, Aktualisierung, Modelle und Qualitätsziel werden vor dem Angebot praktisch geprüft.
Datenquellen, Suchdienste und Modelle werden passend zu Schutzbedarf und Leistung platziert.
Betrieb auf europäischer Infrastruktur nach Daten- und Modell-Assessment.
Bereitstellung im eigenen Account nahe vorhandener Object- und Datenservices.
Dokumente, Suche und Modelle vollständig im Unternehmensnetz betreiben.
Lokale Datenhaltung mit kontrolliert angebundenen Modell- oder Suchdiensten.
Die Architektur trennt Quellen, Verarbeitung, Suchindex, Modelle und Nutzerzugriff nachvollziehbar.
Suche, Chat oder eine integrierte RAG-API.
TLS, Identity, Rollen und definierte API-Wege.
Berechtigungen werden pro Sammlung und Integration geplant.
Parsing, Chunking, Retrieval, Reranking und Antwortorchestrierung.
Dokumente, Parse-Ergebnisse und gesicherte Artefakte.
Chunks, Embeddings, Metadaten und Suchzustand.
Parser, Embeddings, Reranking und Antwortmodelle.
RAG reduziert Halluzinationen nicht automatisch. Qualität wird mit bekannten Fragen, erwarteten Quellen und wiederholbaren Tests bewertet.
Antworten zu Dokumenten, Modellen, Qualität und Betrieb.
Die Plattform ist besonders für dokumentenzentrierte RAG-Szenarien interessant. Eignung und Qualität prüfen wir mit realen PDFs, Tabellen, Scans und Fachfragen.
Ja. Dokumente, Suchdienste und Modelle können lokal betrieben werden, sofern die benötigten Ressourcen bereitstehen.
Sammlungen, Nutzergruppen und Quellrechte werden pro Integration geplant. Komplexe ACL-Synchronisation ist ein eigener Integrationsumfang.
Dokumentkomplexität, OCR, Index, Modelle und Qualitätsziel verändern Architektur und Aufwand erheblich. Ein pauschaler Kleinserver wäre unseriös.
Ja. Wir vergleichen Parsing, Chunking, Retrieval und Modelle anhand eines vereinbarten Testkorpus und dokumentieren die Ergebnisse.
Als Alternative zum Managed Hosting im Rechenzentrum stellt WZ-IT die Hardware bereit, richtet RAGFlow ein und übernimmt Absicherung, Monitoring, Updates, Backup und technischen Support. Der Zugriff kann auf das interne Netz begrenzt oder über VPN und vorhandene Identitäten freigegeben werden.
ab 349 € netto / Monat · zzgl. einmalig Bereitstellung und Ersteinrichtung

08.11.2025
Die Nutzung von Large Language Models (LLMs) wie GPT-4, Claude oder Llama hat sich in den letzten Jahren von experimentellen Anwendungen zu unternehmenskritischen Werkzeugen entwickelt....
09.11.2025
Lokale KI-Inferenz bedeutet, dass ein Sprach- oder Multimodalmodell auf eigener Hardware statt über eine öffentliche API ausgeführt wird. Unternehmen gewinnen damit Kontrolle über Datenwege, Modellwahl...
24.11.2025
OpenAI hat GPT-OSS 120B am 5. August 2025 als Open-Weight-Reasoning-Modell veröffentlicht. Durch die ab Werk verwendete MXFP4-Quantisierung positioniert OpenAI das Modell für eine einzelne GPU...
Diese Lösungen werden oft zusammen mit RAGFlow eingesetzt
Diese Lösungen bieten ähnliche Funktionalitäten und können gemeinsam evaluiert werden
Diese Lösungen sind direkte Alternativen mit ähnlichen Einsatzgebieten
Kein Risiko: Im schlechtesten Fall gehen Sie mit mehr Klarheit über Ihr Projekt heraus als vorher.


„Die Beratung von WZ-IT zu unserer Azure-Migration war schon im Erstgespräch fachlich sehr fundiert und völlig unverbindlich - wir haben eine Menge mitgenommen.“
Ob konkrete IT-Herausforderung oder einfach eine Idee - wir freuen uns auf den Austausch. In einem kurzen Gespräch prüfen wir gemeinsam, ob und wie Ihr Projekt zu WZ-IT passt.