25.06.2026
Lokale KI für Anwaltskanzleien: §203, Mandatsdaten und RAG
Wie lokale RAG-Systeme Mandatswissen erschließen, Quellen belegen und Aktenrechte bis in die Antwort übernehmen.
Der WZ-IT AI Cube bringt ChatGPT-ähnliche KI, lokale Modelle und interne Wissenssuche in Ihr Unternehmen - fertig eingerichtet, ohne Cloud-Zwang und mit Support durch WZ-IT. Einfach einstecken, im Browser öffnen und mit der eigenen KI arbeiten.
Fertig eingerichtet mit Open WebUI, vLLM/Ollama und lokalen Modellen
Lokale Datenverarbeitung im eigenen Netzwerk
Eigene Hardware statt externe API-Abhängigkeit
Remote-Inbetriebnahme & Support auf Deutsch und Englisch
Diese Seite ist die Betriebsebene unseres KI-Angebots: Sie trägt die Lösungen, die Sie kaufen - vom Angebotsfinder bis zum internen Assistenten. Der Stack bleibt dabei in Ihrem Besitz.
Cloud-Dienste bieten Komfort - aber auch Abhängigkeit. Mit einem AI Cube behalten Sie die volle Kontrolle über Ihre Daten, Ihre Modelle und Ihre Systeme. Ob Chatbots, RAG-Systeme oder interne KI-Automatisierungen: Ihre sensiblen Daten bleiben im Unternehmen, während die Rechenleistung direkt vor Ort erfolgt.
Der AI Cube ist Hardware in Ihrem Besitz - ohne externe Token-Limits und ohne Vendor Lock-in. Sie entscheiden, welche Modelle genutzt werden, welche Daten eingebunden werden und ob WZ-IT den Betrieb optional übernimmt.
Ihre Modelle und Daten bleiben in Ihrem Firmennetzwerk. Sie behalten die Kontrolle über sensible Informationen.
Keine API-Limits, keine fremden Updates, keine Sperren. Sie entscheiden über jeden Aspekt Ihrer KI-Infrastruktur.
Minimale Latenz durch lokale Inferenz. Keine Wartezeiten durch Cloud-Verbindungen.
Keine externen Token- oder Pay-per-Use-Gebühren. Lokale Betriebskosten bleiben planbar.
Der AI Cube gehört vollständig Ihnen. Kein Cloud-Abo, keine externe API-Abhängigkeit.
Auf Wunsch übernehmen wir Betrieb, Wartung und Updates - Sie konzentrieren sich auf Ihre Projekte.
Der Einstiegspreis ist klar. Ob sich lokale KI wirtschaftlich lohnt, hängt von Nutzung, Datenschutz, Modellgröße und Betriebsmodell ab.
Pay-per-use / Cloud
Gut für schnellen Start. Kritisch bei sensiblen Daten, hohen Volumen oder Wunsch nach eigener Kontrolle.
On-Premises
128 GB Unified Memory • Open WebUI • Ollama/vLLM • RAG optional
Konservativer interaktiver Richtwert: ca. 80-90 tok/s. Lange Kontexte reduzieren die sichtbare Ausgabe auf etwa 60-80 tok/s.
Konservativer interaktiver Richtwert: ca. 35-60 tok/s. Unter Parallelität steigt der Gesamtdurchsatz deutlich, die einzelne Antwort bleibt aber workloadabhängig.
Basis: öffentlich verfügbare DGX Spark / GB10 Benchmarks mit vLLM, SGLang und llama.cpp. Finale Werte validieren wir mit Zielmodell, Kontextlänge und RAG-Setup des Kunden.
Nutzen Sie Open WebUI für eine ChatGPT-ähnliche Erfahrung - vollständig lokal auf Ihrer eigenen Hardware
Der AI Cube kann je nach Kundenanforderungen mit Open WebUI ausgeliefert werden - einer intuitiven, benutzerfreundlichen Oberfläche, die eine lokale ChatGPT-ähnliche Erfahrung ermöglicht. Keine Cloud-Abhängigkeit, keine API-Schlüssel, keine Abrechnung pro Token. Die Grenze setzen Modell und Hardware, nicht eine Rechnung pro Anfrage.
Vertraute und intuitive Benutzeroberfläche für natürliche Konversationen mit Ihren lokalen KI-Modellen
Alle Daten und Gespräche bleiben auf Ihrer Hardware - keine Verbindung zu externen Servern erforderlich
Wechseln Sie nahtlos zwischen verschiedenen KI-Modellen innerhalb derselben Oberfläche
Nutzung ohne Pay-per-Use-Gebühren oder monatliche API-Kosten
Beispiele für Anforderungen, bei denen lokal betriebene KI sinnvoll ist: unabhängig, sicher und kontrollierbar.
RAG-basierte Dokumentenrecherche
In einer mittelgroßen Anwaltskanzlei mit großem Aktenarchiv ist die Recherche nach Präzedenzfällen, Schriftsätzen und internen Nachweisen zeitaufwendig. Gleichzeitig liegen sensible Mandantendaten vor, die nicht in externe Cloud-Systeme gehören.
Kürzere Recherchezeiten
Belege und Präzedenzfälle sind schneller auffindbar
Gestärkte Wissensbasis
Neue Mitarbeitende finden bewährte Dokumente ohne Umweg über Kolleginnen und Kollegen
Wissensdatenbank für medizinische Protokolle
Gesundheits- und Pflegeeinrichtungen müssen große Mengen an Protokollen, SOPs, Schulungsunterlagen und internen Reports verwalten. Die Dokumentation ist oft verteilt und schwer zugänglich - besonders wenn Teams schnell verlässliche Informationen für Abläufe, Qualitätssicherung oder interne Schulungen benötigen.
Schnellerer Zugriff auf Dokumente
Relevante Stellen werden direkt mit Quellenangabe angezeigt
Gestärkte Qualität & Compliance
Mitarbeitende an verschiedenen Standorten greifen auf denselben Wissenspool zu
Als Reseller bieten Sie lokale KI-Lösungen an - wir liefern die Hardware und den Service
Sie möchten lokale KI-Lösungen nicht nur selbst nutzen, sondern auch an Ihre Kunden weiterverkaufen? Als Reseller erhalten Sie bevorzugte Konditionen, technische Unterstützung und vollständig vorinstallierte Systeme mit WZ-IT Local AI Stack.
Direkte Margenvorteile für Wiederverkäufer und Integratoren.
Auf Wunsch liefern wir den AI Cube vollständig neutral - ideal für Systemhäuser, die unter eigener Marke auftreten möchten.
Ollama, vLLM, Open WebUI - sofort einsatzbereit für Ihre Endkunden.
Direkter Kontakt zu uns bei Fragen zu Integration, RAG, Modellen & Hardware.
Eigene Modelle, RAG-Pipelines, GPU-Layouts und Netzwerk-Setups für spezifische Kundenanforderungen.
Sie können Ihren Kunden nun eigene lokale KI-Lösungen anbieten - ohne selbst Hardware entwickeln zu müssen.
Kontaktieren Sie uns für ein unverbindliches Gespräch über Konditionen, technische Details und Ihre individuellen Anforderungen.
Der AI Cube wird von WZ-IT vorbereitet, mit dem Local-AI-Stack installiert und remote in Betrieb genommen. Vor-Ort-Termine, Workshops oder tiefe Netzwerkintegration stimmen wir projektbezogen ab.
Hardware, Betriebssystem, Treiber und KI-Stack werden vor der Übergabe vorbereitet.
Wir begleiten die erste Einrichtung im Kundennetzwerk remote und dokumentieren die wichtigsten Schritte.
Betriebssystem, GPU-Treiber, Container-Umgebung und Security-Konfiguration (VPN, Firewall, Backup)
Leistungstest, Stabilitätscheck und DSGVO-Konformitätsprüfung vor Inbetriebnahme
Für Standard und Custom Builds
Wir nehmen Ihren AI Cube remote in Betrieb - Installation, Modell-Setup und Konfiguration übernehmen wir, Sie müssen sich um nichts kümmern. Vor-Ort-Termine stimmen wir projektbezogen ab.
Perfekt für Unternehmen, die Wert legen auf:
Der AI Cube verbindet geprüfte ASUS/NVIDIA-Hardware mit unserem offenen Local-AI-Stack. Für besondere Anforderungen liefern wir weiterhin individuelle Custom Builds mit größeren GPUs, Rackmount oder Multi-GPU.
Seit August 2026: Transparenzpflichten des EU AI Act. Hochrisiko-Anforderungen folgen ab Dezember 2027. Lokale Infrastruktur erleichtert Protokollierung und Nachweis.
Der WZ-IT AI Cube ist der schnelle Einstieg in lokale Unternehmens-KI. AI Cube Custom bleibt für größere oder spezielle Anforderungen verfügbar.
Der WZ-IT AI Cube startet bei 5.990,90 € exkl. USt. inklusive Hardware, vorinstalliertem KI-Stack, erstem Modellsetup, Remote-Inbetriebnahme und technischer Einweisung. Custom Builds kalkulieren wir projektbezogen.
ASUS/NVIDIA Appliance-Basis
128 GB
Performance
bis zu 1 PFLOP FP4
GPU
NVIDIA GB10
Ideal für:
Interne KI-Assistenten, Dokumenten-Chat und lokale LLMs
Wir testen Zielmodell, Kontextlänge und parallele Nutzer vor dem Projektstart.
RTX PRO / Multi-GPU / Rackmount / Spezialhardware
Konfigurierbar
Performance
Konfigurierbar
GPU
Konfigurierbar
Ideal für:
Große Modelle, viele parallele Nutzer, Spezialanforderungen
Hinweis zu Preisen: Angegebene Preise sind unverbindliche Richtpreise und können sich ändern. Der konkrete Preis hängt von Ihrer individuellen Konfiguration, Laufzeit und Leistungsumfang ab. Für ein verbindliches Angebot sprechen Sie uns bitte direkt an.
Als Kunde eines Managed Services bei WZ-IT haben Sie Zugriff auf unser exklusives Portal: Überwachen Sie Ihre Infrastruktur in Echtzeit, planen Sie Wartungen, fordern Sie Angebote an und erhalten Sie direkten Support - alles zentral an einem Ort.

Testen Sie verschiedene Token-Geschwindigkeiten und sehen Sie den Unterschied
Interaktive Ausgabe für GB10-basierte AI-Cube-Setups
Bei 45 tok/s dauert die Generierung von:
1.1s
Chat-Antwort
(~50 tokens)
3.3s
(~150 tokens)
44.4s
Bericht
(~2000 tokens)
* Sichtbare Chat-Geschwindigkeit. Parallele Batch-Workloads können deutlich höheren Gesamtdurchsatz erreichen.
Ihre Anforderungen steigen - z. B. größere Modelle, mehr gleichzeitige Nutzer oder intensivere KI-Workloads? Mit unserem Trade-In-Programm können Sie Ihren bestehenden AI Cube unkompliziert gegen ein leistungsstärkeres Modell eintauschen - z. B. vom AI Cube zum Custom Build.
Günstiger upgraden
Keine komplette Neuanschaffung - Gutschrift auf Ihr neues System
Planungssicherheit
Klein beginnen und bei Bedarf aufrüsten
Nachhaltig & sicher
Sichere Datenlöschung und umweltgerechte Weiterverwertung
Interesse melden
Kontaktieren Sie uns
Bewertung
Wir prüfen Ihr Gerät und ermitteln einen fairen Restwert
Gutschrift erhalten
Gutschrift auf Ihren neuen AI Cube oder AI Cube Custom
Bei uns bekommen Sie nicht nur leistungsstarke Hardware, sondern auch einen kompetenten Partner für Ihre gesamte KI-Infrastruktur
Von der Planung bis zur Implementierung - wir bauen Ihre komplette KI-Infrastruktur auf und integrieren den AI Cube nahtlos.
Maßgeschneiderte Software-Lösungen, RAG-Pipelines, APIs und Integrationen - perfekt abgestimmt auf Ihre Anforderungen.
Gemeinsam entwickeln wir neue KI-Anwendungen für Ihre spezifischen Use Cases - von der Idee bis zur Produktionsreife.
Kontinuierliche Betreuung, Updates und Optimierungen - damit Ihre KI-Infrastruktur immer optimal läuft.
Timo Wevelsiep & Robin Zins
CEOs of WZ-IT
Ein typisches Projekt startet mit dem AI Cube als lokaler KI-Infrastruktur und wächst zur Fachlösung: RAG-Pipeline, Wissensquelle, Open WebUI und Betrieb werden auf den konkreten Anwendungsfall abgestimmt. So entsteht aus der Box eine produktive KI-Plattform, ohne sensible Daten an externe Cloud-Dienste zu senden.
Lassen Sie uns gemeinsam Ihre KI-Vision verwirklichen
Einsatzbereit mit führenden Open-Source-Frameworks

Einfaches Modell-Management mit Ein-Befehl-Installation. Perfekt für Rapid Prototyping und kleinere Projekte.
$ ollama run gpt-oss:120b
High-Performance-Inferenz mit PagedAttention für produktive Workloads mit hohem Durchsatz.
$ vllm serve openai/gpt-oss-120bModell, Quantisierung, Kontextlänge, gleichzeitige Nutzer und RAG-Setup entscheiden darüber, welche Hardware sinnvoll ist. Die oben genannten Token/s sind deshalb konservative Richtwerte, keine zugesicherte Standardleistung - Ihren Ziel-Workload testen wir vor dem Angebot.
Für interne Assistenten, Dokumenten-Chat, erste RAG-Systeme und lokale LLM-Nutzung.
Für große Modelle, viele parallele Nutzer, spezielle Netzwerk- oder Rack-Anforderungen.
Wir messen relevante Modelle mit Ihrem Ziel-Setup und dokumentieren die realistische Performance.
Mehr technische Details auf Anfrage
| Komponente | WZ-IT AI Cube |
|---|---|
| Grafikkarte | ASUS/NVIDIA-Appliance-Basis mit NVIDIA GB10-Klasse und 128 GB Unified Memory |
| Netzwerk | Standard-Netzwerk, erweiterte Anbindung projektbezogen |
| Abmessungen & Gewicht | Kompakter Appliance-Formfaktor, abhängig von Hardwarekonfiguration |
| Konformität | CE, RoHS (Hardware-Hersteller) |
| Sicherheit | Secure Boot, TPM 2.0, WireGuard VPN |
Finden Sie das richtige Modell für Ihr Unternehmen
Alle Vorteile auf einen Blick
Cloud-basierte LLM-APIs wie OpenAI, Anthropic oder Google Gemini sind bequem - aber teuer und riskant. Bei hohen Volumen können die Kosten schnell außer Kontrolle geraten. Mit einem AI Cube betreiben Sie lokale Inferenz im eigenen Netzwerk - ohne externe Token-Abhängigkeit und ohne monatliche API-Rechnung pro Anfrage.
Zusätzlich behalten Sie mit On-Premise-LLM-Hosting die volle Kontrolle über Ihre Daten. Sensible Informationen - Kundendaten, interne Dokumente, proprietäre Inhalte - verlassen nie Ihr Firmennetzwerk. Sie sind unabhängig von API-Downtimes, Preiserhöhungen oder plötzlichen Serviceänderungen.
Wir bewerten gemeinsam Ihre Anforderungen und Einsatzszenarien. In einem kostenlosen Beratungsgespräch klären wir, welche Hardware-Konfiguration für Ihre Modelle und Use Cases optimal ist.
Je nach Modellgröße und Anforderungen wählen wir die passende GPU-Ausstattung. Wir konfigurieren das System vollständig und installieren Ollama, vLLM, Open WebUI und weitere Software nach Ihren Wünschen.
Der Cube wird vorinstalliert und getestet geliefert. Nach dem Einstecken kann er innerhalb weniger Minuten in Betrieb genommen werden. Wir unterstützen Sie bei der Integration in Ihr Netzwerk.
Sie betreiben den Cube eigenständig mit vollem Root-Zugriff - oder überlassen uns auf Wunsch Betrieb, Wartung und Updates. Wir bleiben Ihr Ansprechpartner für Erweiterungen, Support und neue Anforderungen.
Für sensible Daten, die nicht in die Cloud dürfen. Betreiben Sie interne Chatbots, Dokumentenanalyse oder Code-Assistenten vollständig lokal und DSGVO-konform.
Testen und entwickeln Sie KI-Anwendungen lokal ohne Cloud-Abhängigkeit. Ideal für Rapid Prototyping, Model Fine-Tuning und experimentelle Projekte.
Integrieren Sie KI-Funktionen direkt in Ihre bestehende Infrastruktur. Keine Internetverbindung erforderlich, vollständige Kontrolle über Ihre Daten.
Maßgeschneiderte KI-Lösungen für spezifische Anforderungen
Dokumentenrecherche, Vertragsanalyse und Mandantenkommunikation - die Verarbeitung läuft auf Hardware im Netzwerk der Kanzlei.
Lokale KI für Patientendaten, Protokollanalyse und medizinische Wissensdatenbanken.
Compliance-konforme KI für Risikobewertung, Dokumentenanalyse und Beratungsunterstützung.
Ihre Branche ist nicht dabei? Wir erstellen individuelle Lösungen für Ihre Anforderungen.
Mit den AI Cubes behalten Sie volle Entscheidungsfreiheit: Sie können eigene Modelle installieren, bestehende Setups migrieren oder Softwarelösungen Ihrer Wahl integrieren - ohne Lizenzbindung, API-Zwang oder externe Kontrolle. Alle Komponenten sind Open-Source-basiert und dokumentiert.
Antworten auf die wichtigsten Fragen zu Ihrer lokalen KI-Lösung
Themen
Der AI Cube ist eine Plug-and-Play KI-Hardware für Unternehmen - ideal, um LLMs, Transkriptionen oder datenintensive Workloads lokal im eigenen Netzwerk auszuführen, ohne Cloud-Abhängigkeit und ohne Datenabfluss an Dritte.
Der WZ-IT AI Cube ist das Standardprodukt auf geprüfter ASUS/NVIDIA-Appliance-Basis. Für größere Modelle, viele parallele Nutzer oder besondere Infrastruktur-Anforderungen planen wir AI Cube Custom Builds mit dedizierten NVIDIA-GPUs, Multi-GPU, Rackmount oder individueller Netzwerkanbindung.
Der Verbrauch hängt vom gewählten Appliance- oder Custom-Setup und der tatsächlichen Last ab. Der Standard-AI-Cube ist als kompakte lokale KI-Box für Büro- und Unternehmensumgebungen ausgelegt; größere Custom-Systeme prüfen wir vorab hinsichtlich Strom, Kühlung und Standortbedingungen.
Beim Standard-AI-Cube ist der M.2-NVMe-Speicher austauschbar. GPU und Unified Memory sind Teil des GB10-Superchips und damit fest verbaut - mehr Rechenleistung oder mehr Speicher bekommen Sie über einen AI Cube Custom Build, bei dem wir Komponenten frei wählen. Die Hardware gehört in beiden Fällen Ihnen, Sie können sie also jederzeit selbst warten oder warten lassen.
Ja - der AI Cube läuft lokal in Ihrem Netz. Im Standardbetrieb kommuniziert er nicht mit externen Cloud-Servern; Updates und Fernwartung erfolgen nur über die Wege, die Sie freigeben. Damit bleibt die Datenhoheit bei Ihnen, und Ihre DSGVO-Dokumentation wird deutlich einfacher.
Der AI Cube speichert Daten ausschließlich lokal. Mit TPM 2.0, Secure Boot und optional verschlüsselter SSD/NVMe sorgen wir für maximalen Schutz. Für sensible Daten empfehlen wir verschlüsseltes Filesystem und restriktive Zugriffskontrolle.
Ja - auf Wunsch liefern wir den AI Cube als Plug-and-Play: mit vorinstallierter Software, GPU-Treibern und Grundkonfiguration. Nach dem Einschalten kann direkt mit KI-Modellen gearbeitet werden - ohne aufwendiges Setup.
Ja. Der AI Cube wird von uns vorbereitet, mit dem Local-AI-Stack installiert und remote in Betrieb genommen. Vor-Ort-Termine, Schulungen oder Integrationsworkshops stimmen wir bei Bedarf projektbezogen ab.
Standardmäßig enthalten sind die technische Vorbereitung, der vorinstallierte KI-Stack, ein erstes Modellsetup, Remote-Inbetriebnahme und eine technische Einweisung. RAG, SSO, Monitoring oder Managed Service können optional ergänzt werden.
Der AI Cube wird mit einem offenen Local-AI-Stack vorbereitet: Open WebUI als Oberfläche, Ollama und/oder vLLM für lokale Inferenz, passende Open-Source-Modelle nach Anwendungsfall und optional RAG mit Qdrant oder pgvector. Die konkrete Modellwahl prüfen wir anhand Ihres Use Cases.
Ja - je nach Hardware-Ausstattung können mehrere Modelle parallel betrieben werden. Für intensive oder parallele Nutzung empfehlen wir leistungsstärkere bzw. angepasste Hardware-Konfigurationen.
Neben Chatbots und RAG-Systemen: Audio/Video-Transkription, Dokumenten-Indizierung, Data-Processing, Code-Assistenz, Automatisierung interner Prozesse - ideal für datenschutzkritische oder compliance-relevante Szenarien.
Der Standard-AI-Cube startet bei 5.990,90 € exkl. USt. AI Cube Custom Builds kalkulieren wir projektbezogen - Preis, Lieferumfang und Service-Level hängen dort von GPU, Speicher, Formfaktor, Software-Stack und Betriebsmodell ab; dafür erhalten Sie ein verbindliches Angebot auf Anfrage. Wirtschaftlich wird der AI Cube vor allem bei sensiblen Daten, planbarer Last und langfristiger Nutzung: keine externen Token-Abhängigkeiten, volle Kontrolle über Daten und Hardware.
Wenn Datenschutz, Kontrolle, konstante Performance und langfristige Planung wichtig sind - z. B. bei sensiblen Daten, Compliance-Anforderungen oder häufigem KI-Einsatz.
Ja. Wir unterstützen die Migration: Daten- und Modell-Übernahme, Neuaufsetzung auf Ihrem On-Prem-System - ohne externe Abhängigkeit.
Der AI Cube wird gekauft und gehört Ihrem Unternehmen, während unsere AI Server gemietet werden und als monatlicher Managed Service laufen. Der Cube eignet sich für langfristige Planung, lokale Kontrolle und feste Standorte; der gemietete Server für flexible Projekte oder variable Last.
Unsere vorkonfigurierten Modelle sind wartungsarm ausgelegt. Bei Bedarf bieten wir Managed Service: regelmäßige Sicherheitspatches, Monitoring, Updates - damit Ihre Infrastruktur stabil und sicher bleibt.
Ja - der AI Cube ist kompatibel mit üblichen Unternehmensnetzwerken. Auf Wunsch konfigurieren wir VPN, Firewall und Anbindung, damit der Cube sicher und nahtlos integriert ist.
Neben der Hardware bieten wir optional Managed Service, Wartung, Updates, Monitoring und Support - insbesondere für Enterprise-Kunden. Hardware, Software und Betreuung aus einer Hand.
Auf Wunsch liefern wir ein Backup-Konzept: regelmäßige Snapshots, redundante oder externe Speicheroptionen, Remote-Backup - so sind Sie auch bei Hardware-Defekt abgesichert.
Inbetriebnahme und Support leisten wir remote, auf Deutsch und Englisch. Vor-Ort-Termine oder Auslieferung über Partner stimmen wir bei passenden Projekten ab.
Der Standard-AI-Cube basiert auf einer geprüften ASUS/NVIDIA-Appliance. Konfiguration, Installation des Local-AI-Stacks, Test und Inbetriebnahme erfolgen bei uns in Deutschland. Für AI Cube Custom Builds stellen wir zusätzlich die Komponenten passend zum Workload zusammen und integrieren sie bei uns.
Ja - wir bieten ein Reseller-Programm mit attraktiven Einkaufskonditionen, technischer Unterstützung und optionaler White-Label-Lizenz. Ideal für Systemhäuser und IT-Dienstleister.
Noch Fragen? Wir helfen Ihnen gerne weiter!
Noch Fragen? Kontaktieren Sie uns!Entdecken Sie unsere anderen AI-Services
Lokale KI für Kanzleien, Ärzte, Notare & Co. - die Daten bleiben im Haus.
Gemietete GPU-Server mit vollständigem Managed Service - Preis auf Anfrage
Detaillierte Informationen zu unseren GPU-Servern und deren Einsatzmöglichkeiten
Managed Hosting für Large Language Models - wir betreiben die Infrastruktur, Sie nutzen die Modelle
White-Label und Staffelkonditionen für Systemhäuser und IT-Dienstleister
Token-Geschwindigkeit interaktiv erleben - mit Richtwerten für den AI Cube
25.06.2026
Wie lokale RAG-Systeme Mandatswissen erschließen, Quellen belegen und Aktenrechte bis in die Antwort übernehmen.
10.05.2026
Drei unauthentifizierte API-Calls. Kein Login, kein Exploit-Framework, keine Privilege Escalation. Drei POST-Requests an einen Standard-Port, und der Speicher der Maschine ist auf Reisen — mit...
28.04.2026
Seit Oktober 2025 gibt es den NVIDIA DGX Spark — einen "Personal AI Supercomputer" für $4.699 auf dem Schreibtisch. Die Frage, die uns seitdem erreicht:...
24.11.2025
Mit GPT-OSS 120B hat OpenAI im August 2025 erstmals seit GPT-2 wieder ein Open-Weight-Modell veröffentlicht – und es ist beeindruckend. Das Modell erreicht nahezu die...
09.11.2025
In Zeiten von steigenden Cloud-Kosten, Datenhoheit-Herausforderungen und Vendor-Lock-in wird das Thema Lokale KI-Inferenz für Unternehmen immer zentraler. Mit dem AI Cube von WZ-IT setzen Sie...
08.11.2025
Die Nutzung von Large Language Models (LLMs) wie GPT-4, Claude oder Llama hat sich in den letzten Jahren von experimentellen Anwendungen zu unternehmenskritischen Werkzeugen entwickelt....
Kein Risiko: Im schlechtesten Fall gehen Sie mit mehr Klarheit über Ihr Projekt heraus als vorher.


„Die Beratung von WZ-IT zu unserer Azure-Migration war schon im Erstgespräch fachlich sehr fundiert und völlig unverbindlich - wir haben eine Menge mitgenommen.“
ml&s spricht über die Integration einer lokalen KI-Lösung. Die übrigen Stimmen betreffen Architektur, Datenhoheit und Betrieb - genau die Reife, ohne die ein KI-Projekt nicht produktiv wird.
Ob konkrete IT-Herausforderung oder einfach eine Idee - wir freuen uns auf den Austausch. In einem kurzen Gespräch prüfen wir gemeinsam, ob und wie Ihr Projekt zu WZ-IT passt.
Timo Wevelsiep & Robin Zins
Geschäftsführer



