07.09.2026
Dokumente automatisch auslesen und prüfen mit KI: selbst gehostet
Seit dem 1. Januar 2025 muss jedes inländische Unternehmen E-Rechnungen empfangen können. Ein Teil der Belege kommt damit als strukturiertes XML an und wird geparst...
WZ-IT entwickelt, prüft, migriert und betreibt KI-Anwendungen. Dazu verbinden wir individuelle Software, RAG und Automatisierung mit lokalen Modellen, kontrollierter Infrastruktur und einem belastbaren Deployment- und Betriebsweg.
Unternehmenswissen mit Quellen und Rechten nutzbar machen.
KI-Funktionen, Agenten und Automatisierung in bestehende Systeme integrieren.
GPU-Infrastruktur, Monitoring und Betrieb aus einem Team.
Unternehmen weltweit vertrauen WZ-IT
Ob Sie zuerst prüfen lassen, direkt umsetzen oder den Betrieb abgeben wollen - jeder Einstieg hat einen festen Umfang und einen genannten Preis.
Prüfen
Einen wiederkehrenden Geschäftsprozess, seine Daten, Systeme, Risiken und sinnvolle Automatisierungsgrenzen prüfen.
1.490 € netto
Optionale Folgeleistung: Abgegrenzter Pilot oder individuelle KI- und Workflow-Umsetzung.
Details ansehenUmsetzen
Einen definierten Dokumentenbestand mit Quellenanzeige, Berechtigungskonzept und fachlichen Testfragen für KI nutzbar machen.
ab 2.900 € netto
Optionale Folgeleistung: Managed KI, weitere Wissensquellen oder AI Cube.
Details ansehenUmsetzen
E-Mails, PDFs, Scans und Formulare klassifizieren, Inhalte extrahieren, prüfen und strukturiert weitergeben.
Pilot ab 4.990 € netto
Optionale Folgeleistung: Produktive Dokumentenstrecke und optionaler Managed Betrieb.
Details ansehenUmsetzen
Ausschreibungen und Sicherheitsfragebögen mit belegten Antwortentwürfen bearbeiten. WZ-IT verbindet Ihre Quellen mit fachlicher Freigabe und Word-/Excel-Export.
ab 6.900 € netto
Optionale Folgeleistung: Integrationen erweitern und den vereinbarten Workflow dauerhaft betreuen lassen.
Details ansehenBetreiben
Traces, Qualität, Retrieval, Kosten, Latenz und Änderungen einer produktiven KI-Anwendung laufend kontrollieren.
ab 990 € netto / Monat
Vor dem laufenden Betrieb wird eine technische Baseline erstellt.
Details ansehenBetreiben
Dedizierte NVIDIA GPU inklusive abgestimmtem Modell, gemanagtem vLLM, Open WebUI, Monitoring, Updates und technischem Betrieb.
ab 599,90 € netto / Monat
Zwei GPU-Konfigurationen mit jeweils ausgewiesener einmaliger Einrichtung verfügbar.
Details ansehenVor Ort einsetzen
Lokale KI-Plattform für Chat, Dokumentensuche und eigene Assistenten mit abgestimmtem Modell und laufendem Betrieb.
ab 899 € netto / Monat
Hardware und Betrieb inklusive; sechs Monate Mindestlaufzeit.
Details ansehenDer vollständige Leistungskatalog zeigt weitere Audits, Managed Services, lokale Systeme und Projektangebote mit ihrem jeweiligen Preis- oder Scoping-Modell.
Alle Preise verstehen sich netto zuzüglich gesetzlicher Umsatzsteuer. Die Angebote richten sich an Unternehmen.
Alle Leistungen & PreiseSechs klare Einstiege, ein Prinzip: Wir wählen den kleinsten belastbaren Umfang und verbinden Umsetzung und Betrieb nur dort, wo es fachlich nötig ist.
| Ihre Ausgangslage | Das passende System | Wann es nicht passt |
|---|---|---|
| Ein wiederkehrender Prozess kostet Zeit, aber es ist unklar, ob KI, feste Regeln oder klassische Automatisierung sinnvoll sind. | KI-ProzesscheckEin Prozess, seine Daten, Systeme, Risiken und ein belastbarer Pilotweg. | Wenn Ablauf, Daten und Ziel noch nicht konkret benannt werden können, muss zuerst der Prozess selbst geklärt werden. |
| Besucher landen auf der Website und finden nicht, welches unserer Angebote zu ihrem Vorhaben passt. | AngebotsfinderChat-Widget auf Ihrer Website. | Wenn Ihr Angebot aus drei klaren Leistungen besteht - dann reicht eine gute Navigation. |
| Mitarbeiter suchen alte Angebote, kopieren wiederkehrende Positionen und übertragen sie anschließend erneut ins Rechnungssystem. | KI-AngebotsassistentInternes Arbeitssystem für prüfbare Angebotsentwürfe. | Wenn nur wenige standardisierte Produkte angeboten werden, genügt häufig ein gepflegter Katalog im Rechnungssystem. |
| Wir haben einen großen Bestand. Leser brauchen die maßgebliche Stelle, nicht eine Zusammenfassung. | Wissens-NavigatorGeführte Suche mit Quelle und Stand. | Solange gültige und abgelöste Fassungen im Bestand nicht auseinanderzuhalten sind, ist Aufräumen der erste Schritt - nicht ein Navigator darüber. |
| Mitarbeiter suchen in internen Dokumenten. Wer was sehen darf, muss technisch greifen, nicht per Anweisung. | Interner AssistentRAG auf Ihren Dokumenten, Rechte vor der Suche. | Wenn es um wenige, immer gleiche Fragen geht, sind eine FAQ oder ein Formular billiger. |
| Ein Vorgang soll nicht nur beantwortet, sondern ausgeführt werden - Ticket anlegen, Termin buchen, Daten abfragen. | KI-AgentenAktionen in Ihren Systemen: Tickets, Workflows, Integrationen. | Solange niemand benennen kann, was der Agent im Fehlerfall angerichtet haben darf, ist es zu früh. |
Für den lokalen Einstieg steht mit dem AI Cube Pro eine vorbereitete Plattform bereit. Reichen Standardhardware oder der Betrieb am eigenen Standort nicht aus, folgen daraus die passenden Ausbaupfade: AI Cube Pro, GPU-Server oder LLM-Hosting.
Vier Muster, die wir immer wieder sehen - und die sich mit einem weiteren Tool selten lösen lassen.
Prototypen beeindrucken, gehen aber nicht in den sicheren Dauerbetrieb.
Dokumente, Wikis, Tickets, Datenbanken und APIs sind nicht als KI-Kontext nutzbar.
Chatbots stehen neben den Prozessen, statt in Portale, Workflows und Systeme eingebettet zu sein.
Rollen, Quellen, Logging, Monitoring, Kostenkontrolle und Updates werden zu spät geplant.
Produktive KI braucht vier Schichten, die zusammen geplant werden: Anwendung, Wissen, Inferenz und Betrieb. Wir bauen und betreiben sie als Ganzes.
Assistenten, Agenten, UX, Workflows, Portale und Business Apps.
RAG, Datenquellen, Embeddings, Qdrant, Quellen und Rechte.
Ollama, vLLM, Modelle, GPU-Sizing und LiteLLM als Gateway.
Langfuse, Monitoring, Evaluation, Kostenkontrolle, Updates, Security und SLA.
Der AI Cube Pro bringt lokale KI in unter zwei Wochen als vorbereitete Plattform in Ihr Unternehmen. Darauf bauen wir interne Assistenten, Wissenssysteme und individuelle Integrationen auf, ohne für jeden Anwendungsfall die Infrastruktur neu zu erfinden.

Nach Konfigurationsfreigabe in unter zwei Wochen einsatzbereit
ab 899 € netto / Monat
zzgl. einmalig Bereitstellung und Ersteinrichtung · 6 Monate Mindestlaufzeit
RAG, Datenquellen, Schnittstellen, sichere Vernetzung und individuelle Workflows werden separat geplant.
Der technische Betrieb ist in der monatlichen Rate enthalten. Verfügbare Service Levels und weitergehende Integrationen werden passend zum Einsatz vereinbart; im §203-Scope mit AVV, begrenzten Administrationsrechten sowie schriftlicher Verpflichtung der beteiligten Personen zur Geheimhaltung und Belehrung über die strafrechtlichen Folgen.
Wissen zugänglich machen, Vertrieb und Einkauf entlasten oder wiederkehrende Vorgänge bearbeiten: Die Angebote verbinden einen konkreten Arbeitsablauf mit passenden Daten, Freigaben und Betrieb.
Erfahrungswissen, Unternehmensunterlagen und Servicefälle für die tägliche Arbeit zugänglich machen.
Angebotsentwürfe und belegte Antworten mit vorhandenen Unternehmensdaten vorbereiten.
Lieferantenbestätigungen prüfen und Produktdaten mit kontrollierten Freigaben aufbereiten.
Eingehende Bestellungen, Dokumente und Nachrichten erfassen, prüfen und an die zuständigen Systeme übergeben.
Modelle lokal, hybrid oder in einer geeigneten Cloud bereitstellen und die Anwendung betreuen.
Weitere Anwendungsfälle einordnen und mit Schnittstellen, Freigaben und vorhandener Software verbinden.
Die Leistungen können einzeln oder als aufeinanderfolgende Schritte beauftragt werden. Zielumgebung, Betriebsort und Verantwortungsmodell werden anschließend passend zur Anwendung festgelegt.
Entwickeln
KI-Funktionen, RAG, Agenten, APIs und Benutzeroberflächen neu entwickeln oder gemeinsam mit Ihrem Team weiterführen.
KI-Softwareentwicklung ansehenPrüfen
KI-generierte Anwendungen vor dem Go-live auf Code, Authentifizierung, Daten, Security, Tests, Deployment und Betrieb prüfen.
Audit ansehenLaufend prüfen
Änderungen, CVEs und Release-Risiken nach einer bestätigten Baseline regelmäßig menschlich prüfen und priorisieren lassen.
Review-Retainer ansehenProduktionsreif machen
MVPs aus Lovable, Bolt, v0, Replit oder Base44 übernehmen, priorisierte Befunde beheben und einen kontrollierten Produktionsweg aufbauen.
Übernahmeprozess ansehenMigrieren
Supabase Cloud, Firebase, Lovable oder bestehende Backends mit Anwendung, Auth, Storage und Functions auf eine passende Supabase-Zielumgebung überführen.
Migrationsangebot ansehenNach dem Go-live
Je nach System übernimmt WZ-IT den vereinbarten Anwendungs-, Plattform- oder Infrastrukturbetrieb. Ihr Team kann die Software im Co-Managed-Modell weiterentwickeln; Deployments, Monitoring, Backups, Updates und Reaktion werden klar zugeordnet.
Konkrete Einstiege an der Schnittstelle von Geschäftsprozess, KI, Software und Betrieb.
Antworten mit Quellenangabe aus eigenen Dokumenten und Systemen - mit Rollen und Rechten.
Verteiltes Wissen anbinden, aufbereiten und Besucher zur passenden Antwort führen - mit Quelle und Stand.
E-Mails, PDFs, Scans und Formulare klassifizieren, extrahieren, prüfen und strukturiert übergeben.
Kundenbestellungen gegen Stamm- und Pflichtdaten prüfen und kontrolliert für ERP oder CRM vorbereiten.
Anfragen klassifizieren, priorisieren, routen und als Antwortentwurf vorbereiten.
Ablauf, Daten, Systeme, Risiken und einen realistischen Pilotweg vor der Umsetzung einordnen.
KI-generierte MVPs übernehmen, absichern und betreibbar machen.
Traces, Qualität, Retrieval, Kosten, Latenz und Änderungen laufend kontrollieren.
Wir wählen Komponenten nach Use Case, Datenschutz, Last und Betriebsmodell - nicht nach Hype. Open Source gibt Kontrolle, produktiv wird der Stack erst durch Integration, Rechte, Monitoring und Betrieb.

Lokale Inferenz-Engine
Modelle lokal ausführen, verwalten und über APIs nutzbar machen.

Hochdurchsatz-Inferenz
Tensor-Parallelität und OpenAI-kompatible APIs für viele gleichzeitige Nutzer.
Chat- und Admin-Interface
Benutzeroberfläche für lokale Modelle, Teams, Tools und Dokumenten-Chat.

Enterprise RAG-App
RAG-System für Dokumente, Workspaces, Agenten und Wissensdatenbanken.

Multi-LLM-Gateway
Zentrale API-Schicht für Routing, Budgets, Keys und Provider-Fallbacks.
LLM Observability
Tracing, Prompt Management, Evaluationen, Kosten und Qualitätskontrolle.

Vector Database
Semantische Suche und Retrieval-Schicht für produktive RAG-Systeme.
Automatisierungsbaustein
Prozesse, APIs und LLMs zu kontrollierten Workflows verbinden.
Wir planen KI-Betrieb nicht theoretisch. WZ-IT betreibt Cloud-, Open-Source- und Software-Stacks produktiv, dazu IoT- und Remote-Site-Systeme für reale Standorte wie ABCO Water Systems und nextGYM. Diese Betriebserfahrung fließt in lokale und hybride KI-Systeme ein.
Nicht jeder Use Case braucht eigene GPUs. Entscheidend sind Datenschutz, Latenz, Kosten, Modellgröße und Betriebsverantwortung. Wir legen den Stack so aus, dass er zum Risiko und zur Last passt.
Anfrage
Beschreiben Sie Ziel, Daten und bestehende Systeme. Wir ordnen Lösung, Infrastruktur und nächsten Schritt ein.
Läuft, wo Sie wollen
Antworten auf die wichtigsten Fragen
Geeignet sind vor allem wiederkehrende Abläufe mit E-Mails, Dokumenten, Prüfregeln und klaren Zielsystemen. Dazu gehören Dokumentenverarbeitung, Auftragserfassung, Ticket- und Postfachautomatisierung sowie individuelle Workflows. Im KI-Prozesscheck klären wir zunächst, ob KI, feste Regeln oder klassische Automatisierung sinnvoll sind.
Der KI-Prozesscheck kostet 1.490 Euro netto. Piloten für Dokumentenverarbeitung und Ticketautomatisierung beginnen ab 4.990 Euro netto, die automatisierte Auftragserfassung ab 6.900 Euro netto. Individuelle Vorhaben werden nach Prozess, Daten, Schnittstellen und Kontrollbedarf angeboten.
Die Dokumentenverarbeitung extrahiert und prüft Daten aus unterschiedlichen Eingängen. Die Auftragserfassung verarbeitet eingehende Kundenbestellungen für ERP oder CRM. Der Angebotsassistent bereitet dagegen aus eigenen Produkt- und Altdaten neue ausgehende Angebotsentwürfe vor.
Retrieval-Augmented Generation verbindet das Sprachmodell mit Ihren Dokumenten: Vor jeder Antwort werden passende Textstellen gesucht und mitgegeben. So antwortet das System mit Ihrem Wissen, ohne dass ein Modell trainiert werden muss - und Berechtigungen lassen sich vor der Suche technisch erzwingen, nicht erst im Prompt.
Lokale oder kontrolliert europäisch betriebene Modelle können sinnvoll sein, wenn Datenwege, Modellwahl, Latenz oder laufende Kosten besondere Anforderungen stellen. Die passende Architektur hängt von Use Case, Datenarten, Modellgröße, Parallelität und Integrationen ab.
Der Managed KI-Server umfasst die technische Infrastruktur wie GPU, Betriebssystem, Treiber, Container und Inferenz-Runtime. Managed LLMOps betrachtet die Anwendung darüber: Traces, Qualität, Retrieval, Kosten, Latenz sowie Modell-, Prompt- und Wissensänderungen.
Nein. Lokaler Betrieb kann Datenwege begrenzen und technische Kontrolle verbessern. Zusätzlich müssen Zweck, Rechtsgrundlage, Benutzerrechte, Löschung, menschliche Kontrolle und der konkrete Risikorahmen des Einsatzes geprüft und dokumentiert werden.
Kein Risiko: Im schlechtesten Fall gehen Sie mit mehr Klarheit über Ihr Projekt heraus als vorher.


„Die Beratung von WZ-IT zu unserer Azure-Migration war schon im Erstgespräch fachlich sehr fundiert und völlig unverbindlich - wir haben eine Menge mitgenommen.“
Von der lokalen KI-Integration bis zu Architektur, Datenhoheit und laufendem Betrieb.
“WZ-IT hat unsere Studio-Infrastruktur von dezentralen Einzelgeräten auf eine zentrale Plattform gehoben: Jeder Standort ist per VPN sicher angebunden, neue Geräte werden automatisiert onboardet und ein kompletter Standort wird per Vorlage provisioniert - ohne manuelle Schritte vor Ort. Was mich am meisten beeindruckt hat, ist die Breite und Tiefe des Wissens: Timo und Robin sind kein normaler IT-Dienstleister, der einen Server aufsetzt und wieder geht. Die beiden denken sich in hochkomplexe Infrastruktur- und Softwarethemen rein, arbeiten sich in jede Anforderung ein, die wir ihnen hinlegen, und bauen Vernetzung, Provisioning und Betrieb so auf, dass am Ende alles zusammenpasst. WZ-IT ist ein hervorragender Partner, wenn es um komplexe Software-, Netzwerk- und Architekturprojekte geht.”

Steve Kirchner
Geschäftsführer, nextGYM GmbH

07.09.2026
Seit dem 1. Januar 2025 muss jedes inländische Unternehmen E-Rechnungen empfangen können. Ein Teil der Belege kommt damit als strukturiertes XML an und wird geparst...
24.05.2026
Wer KI in produktive Geschäftsprozesse bringt, steht schnell vor einer unbequemen Frage: Was passiert da eigentlich genau? Welcher Prompt ging an welches Modell, warum kam...
10.05.2026
Drei unauthentifizierte API-Calls. Kein Login, kein Exploit-Framework, keine Privilege Escalation. Drei POST-Requests an einen Standard-Port, und der Speicher der Maschine ist auf Reisen — mit...
05.05.2026
Die Hochrisiko-Pflichten des EU AI Act greifen nicht zum 2. August 2026. Eigenständige Hochrisiko-Systeme nach Anhang III haben jetzt bis zum 2. Dezember 2027 Zeit,...
24.11.2025
OpenAI hat GPT-OSS 120B am 5. August 2025 als Open-Weight-Reasoning-Modell veröffentlicht. Durch die ab Werk verwendete MXFP4-Quantisierung positioniert OpenAI das Modell für eine einzelne GPU...
Ob konkrete IT-Herausforderung oder einfach eine Idee - wir freuen uns auf den Austausch. In einem kurzen Gespräch prüfen wir gemeinsam, ob und wie Ihr Projekt zu WZ-IT passt.