WZ-IT Logo

LLM-Lizenzen für kommerzielle Nutzung: Apache 2.0, MIT, Llama, Qwen, Mistral

Timo WevelsiepTimo Wevelsiep•Aktualisiert: 30.09.2026

Hinweis zum Inhalt: Versionen, Befehle und Preise können sich ändern. Bitte prüfen Sie kritische Schritte vor dem produktiven Einsatz eigenständig. Dieser Leitfaden ersetzt keine individuelle Beratung.

Modell ausgewählt, Lizenz geklärt, Betrieb offen? WZ-IT betreibt Open-Weight-Modelle auf eigener Infrastruktur und dokumentiert Modellversion, Quantisierung und Lizenzstand als Teil der Modellfreigabe. Modelle laufen auf dem AI Cube im eigenen Haus oder auf Managed GPU-Servern, betrieben über LLM-Hosting. Kennenlernen-Termin buchen · LLM-Hosting ansehen

Offene Sprachmodelle lassen sich herunterladen und auf eigener Hardware betreiben. Ob ein Unternehmen ein bestimmtes Modell auch kommerziell nutzen, anpassen oder Kunden bereitstellen darf, steht nicht im Modellnamen, sondern in der Lizenzdatei der konkreten Version. Innerhalb einer Modellfamilie können sich die Bedingungen unterscheiden, und einige Lizenzen enthalten Umsatzschwellen, Namenspflichten oder regionale Ausschlüsse. Dieser Artikel ordnet die verbreiteten Lizenztypen ein, fasst die Bedingungen wichtiger Modelle zusammen und beantwortet die Fragen, die bei Quantisierung, Fine-Tuning und Hosting für Dritte entstehen. Stand Oktober 2026.

Hinweis: Dieser Artikel ist eine technische Einordnung auf Basis der veröffentlichten Lizenztexte und Model Cards. Er ist keine Rechtsberatung und ersetzt keine rechtliche Prüfung im Einzelfall.

Inhaltsverzeichnis

Open Weight ist nicht gleich Open Source

"Open Weight" beschreibt nur die Verfügbarkeit: Die trainierten Gewichte eines Modells sind öffentlich herunterladbar. Welche Rechte damit verbunden sind, regelt die beigefügte Lizenz. Sie entscheidet über drei Fragen, die für Unternehmen zählen:

Frage Wo die Antwort steht
Darf das Modell kommerziell genutzt werden? Lizenzdatei (LICENSE) im Modell-Repository
Welche Pflichten gelten bei Weitergabe oder Bereitstellung? Lizenzdatei, ggf. NOTICE-Datei
Welche Einsatzzwecke sind ausgeschlossen? Lizenzdatei und, falls vorhanden, Acceptable oder Prohibited Use Policy

Die Lizenzangabe im Hugging-Face-Kopf einer Model Card ist ein guter erster Hinweis, aber nicht verbindlich. Steht dort other, liegt eine eigene Lizenz vor, deren Text gelesen werden muss. Verbindlich ist die Lizenzdatei der genutzten Version, inklusive der Version, aus der eine Quantisierung oder ein Fine-Tune abgeleitet wurde.

Die Lizenz regelt Nutzungsrechte am Modell. Pflichten aus der KI-Verordnung, dem Datenschutz oder Berufsgeheimnissen ergeben sich unabhängig davon. Den regulatorischen Rahmen beschreibt Der EU AI Act für Unternehmen.

Die Lizenztypen im Überblick

Lizenztyp Kommerzielle Nutzung Wesentliche Pflichten Beispiele (Stand Oktober 2026)
Apache 2.0 ja Lizenztext und NOTICE bei Weitergabe, geänderte Dateien kennzeichnen; Patentlizenz; keine Markenrechte gpt-oss, Gemma 4, Qwen3.8-27B, Mistral Small 4, Granite 4.2
MIT ja Copyright- und Lizenzhinweis in Kopien DeepSeek V4, GLM-5.3-Flash, MiMo-V2.6
Modified MIT ja, mit Schwellen zusätzliche Namens- oder Umsatzbedingungen Kimi K2.6, Mistral Medium 3.5
Herstellerlizenz mit Bedingungen ja, mit Bedingungen Hinweis- und Namenspflichten, Nutzungsrichtlinie, Schwellen Llama 4, Qwen Community License, GLM-5.3 License
NVIDIA-Modelllizenzen ja Lizenz beilegen, Attributionshinweis in NOTICE Nemotron 3
Nicht-kommerziell nein Nutzung nur für Forschung oder Evaluation CC BY-NC 4.0 (Jina), Qwen Research License, Mistral Non-Production License

Apache 2.0 ist die verbreitetste permissive Modelllizenz. Abschnitt 4 verlangt bei Weitergabe eine Kopie der Lizenz, Änderungshinweise in geänderten Dateien, den Erhalt von Urheber- und Patenthinweisen und gegebenenfalls die Übernahme der NOTICE-Datei. Abschnitt 3 enthält eine Patentlizenz, die bei einer Patentklage gegen das Werk endet. Abschnitt 6 gewährt ausdrücklich keine Rechte an Marken, Modellnamen dürfen also nicht als eigene Produktmarke verwendet werden (Apache License 2.0).

MIT ist noch knapper: Der Copyright- und Lizenzhinweis muss in allen Kopien enthalten sein, weitere Bedingungen gibt es nicht. "Modified MIT" bedeutet dagegen, dass der Hersteller Bedingungen ergänzt hat, und die sind sehr unterschiedlich (siehe unten).

Lizenzen wichtiger Modelle

Lizenzen konkreter Modellversionen, geprüft an Lizenzdatei und Model Card, Stand Oktober 2026:

Modell Lizenz Kommerziell Besonderheiten
gpt-oss-20b, gpt-oss-120b Apache 2.0 ja Usage Policy: Einhaltung geltenden Rechts
Gemma 4 (E2B, E4B, 12B, 26B-A4B, 31B) Apache 2.0 ja Gemma 1 bis 3: Gemma Terms of Use
Qwen3.8-27B, Qwen3.6-27B, Qwen3.6-35B-A3B Apache 2.0 ja -
Qwen3.8-Flash-Next Qwen Community License 1.0 eingeschränkt gesonderte Lizenz für Model-as-a-Service und KI-Arbeitsassistenten
Qwen3.8-2.4T-A95B Qwen3.8-Max License eingeschränkt gesonderte Lizenz für Model-as-a-Service und KI-Arbeitsassistenten ab 50 Mio. USD Umsatz in 12 Monaten
Mistral Small 4, Mistral Large 3, Ministral 3, Devstral Small 2 Apache 2.0 ja -
Mistral Medium 3.5, Devstral 2 (123B) Modified MIT bis 20 Mio. USD Monatsumsatz darüber kommerzielle Lizenz von Mistral AI nötig
DeepSeek V4 Pro und Flash MIT ja -
GLM-5.3-Flash, GLM-5.2 MIT ja -
GLM-5.3 GLM-5.3 License ja Model-as-a-Service ab 10 Mrd. USD Umsatz: Sicherheitsprüfung durch Z.AI
Kimi K2.6 Modified MIT ja ab 100 Mio. MAU oder 20 Mio. USD Monatsumsatz "Kimi K2.6" in der Oberfläche anzeigen
MiMo-V2.6 MIT ja -
Granite 4.2 (3B, 8B, 30B) Apache 2.0 ja -
Apertus Apache 2.0 ja -
Nemotron 3 Nano und Super NVIDIA Nemotron Open Model License ja Attributionshinweis bei Weitergabe
Llama 4 Scout und Maverick Llama 4 Community License mit Bedingungen "Built with Llama", 700-Mio.-MAU-Schwelle, EU-Ausschluss für multimodale Modelle
Qwen2.5-72B-Instruct Qwen License ja ab 100 Mio. MAU gesonderte Lizenz
Qwen2.5-3B-Instruct Qwen Research License nein nur Forschung und Evaluation
Codestral 22B v0.1 Mistral AI Non-Production License nein kein produktiver Einsatz
jina-embeddings-v3, jina-reranker-v2-base-multilingual CC BY-NC 4.0 nein nur nicht-kommerziell

Welche dieser Modelle auf welche Hardware passen, behandeln Welches LLM selbst hosten? und GPU- und VRAM-Sizing für LLMs.

Llama: Community License mit EU-Ausschluss

Die Llama 4 Community License (gültig ab 5. April 2025) erlaubt Nutzung, Veränderung und Weitergabe, knüpft daran aber Bedingungen:

Regelung Inhalt
Weitergabe oder Bereitstellung (1.b.i) Kopie der Lizenz beilegen; "Built with Llama" sichtbar auf Website, Oberfläche oder Dokumentation anzeigen
Abgeleitete Modelle (1.b.i) Wer Llama oder Llama-Ausgaben nutzt, um ein bereitgestelltes Modell zu trainieren oder zu verbessern, setzt "Llama" an den Anfang des Modellnamens
Attributionshinweis (1.b.iii) NOTICE-Datei mit "Llama 4 is licensed under the Llama 4 Community License, Copyright © Meta Platforms, Inc. All Rights Reserved."
Nutzungsrichtlinie (1.b.iv) Acceptable Use Policy ist Vertragsbestandteil
Nutzerschwelle (2) über 700 Mio. monatlich aktive Nutzer am Veröffentlichungsdatum: gesonderte Lizenz von Meta
Rechtswahl (7) Recht des Bundesstaats Kalifornien, Gerichtsstand Kalifornien

Für Unternehmen in der EU ist eine Regel entscheidender als die Nutzerschwelle. Die Acceptable Use Policy von Llama 4 gewährt für multimodale Modelle aus Llama 4 die Rechte aus Abschnitt 1(a) nicht an Personen mit Wohnsitz und Unternehmen mit Hauptniederlassung in der EU. Ausgenommen sind Endnutzer eines Produkts oder Dienstes, das ein solches Modell enthält. Laut Model Card sind die Llama-4-Modelle nativ multimodal. Dieselbe Regel enthält bereits die Nutzungsrichtlinie von Llama 3.2 für dessen multimodale Modelle.

Für ein Unternehmen mit Sitz in Deutschland, das Llama 4 selbst betreiben will, ist das ein Ausschlussgrund, der vor dem Einsatz rechtlich bewertet werden muss. Gleichwertige Modelle unter Apache 2.0 oder MIT vermeiden diese Frage.

Qwen, Mistral und GLM: eine Familie, mehrere Lizenzen

Bei mehreren Herstellern hängt die Lizenz von der Modellgröße oder vom Release ab. Eine Freigabe "Qwen ist Apache 2.0" oder "Mistral ist Apache 2.0" ist deshalb nicht belastbar.

Qwen. Die mittelgroßen Modelle Qwen3.8-27B und Qwen3.6 stehen unter Apache 2.0. Für Qwen3.8-Flash-Next gilt die Qwen Community License 1.0: Betreibt der Lizenznehmer oder ein verbundenes Unternehmen ein Model-as-a-Service- oder KI-Arbeitsassistenten-Geschäft, braucht er vor jeder kommerziellen Nutzung eine gesonderte Lizenz. Interne Nutzung ist davon ausgenommen, solange weder Modell noch Ausgaben oder Fähigkeiten Dritten zugänglich gemacht werden. Model-as-a-Service meint dabei Zugriff Dritter auf Inferenz oder Fine-Tuning mit wesentlicher Kontrolle über Eingaben, Parameter oder Trainingsdaten. Die Qwen3.8-Max License für das Modell mit 2,4 Billionen Parametern setzt dieselbe Pflicht erst ab 50 Mio. US-Dollar Umsatz in zwölf Monaten an. Beide Lizenzen verlangen zusätzlich die sichtbare Nennung des Modellnamens, wenn das Produkt mehr als 100 Mio. monatlich aktive Nutzer oder 20 Mio. US-Dollar Monatsumsatz hat.

Mistral. Mistral Small 4, Mistral Large 3, Ministral 3 und Devstral Small 2 stehen unter Apache 2.0. Mistral Medium 3.5 und Devstral 2 (123B) stehen unter einer Modified MIT License mit einer harten Grenze: Übersteigt der weltweite konsolidierte Monatsumsatz des Unternehmens im Vormonat 20 Mio. US-Dollar, dürfen keine Rechte aus der Lizenz ausgeübt werden. Das gilt für das Modell und alle Ableitungen, auch für die interne Nutzung. Ältere Modelle wie Codestral 22B v0.1 stehen unter der Mistral AI Non-Production License und sind für den produktiven Einsatz nicht freigegeben.

GLM. GLM-5.3-Flash und GLM-5.2 stehen unter MIT. Das größere GLM-5.3 hat eine eigene Lizenz: Betreibt der Lizenznehmer ein Model-as-a-Service-Geschäft und übersteigt der Umsatz 10 Mrd. US-Dollar in zwölf Monaten, ist vor kommerzieller Nutzung eine Sicherheitsprüfung durch Z.AI erforderlich. Für mittelständische Unternehmen hat das praktisch keine Auswirkung, ändert aber die Lizenzkategorie.

NVIDIA-Lizenzen und nicht-kommerzielle Modelle

NVIDIA verwendet mehrere Modelllizenzen, die sich in einem Punkt unterscheiden:

Lizenz Kommerziell Weitergabe Guardrail-Klausel
NVIDIA Nemotron Open Model License ja Lizenz beilegen, Hinweis "Licensed by NVIDIA Corporation under the NVIDIA Nemotron Model License" nein
NVIDIA Open Model Agreement ja Hinweis "Licensed by NVIDIA Corporation under the NVIDIA Open Model Agreement" nein
NVIDIA Open Model License ja Hinweis "Licensed by NVIDIA Corporation under the NVIDIA Open Model License" ja
OpenMDW 1.1 (z. B. Nemotron 3.5 Lightning) ja Lizenz und Herkunftshinweise beibehalten nein

Die ältere NVIDIA Open Model License beendet die Rechte automatisch, wenn technische Schutzmechanismen oder Sicherheits-Guardrails des Modells umgangen oder abgeschwächt werden, ohne einen gleichwertigen Ersatz vorzusehen. Bei Fine-Tuning, das Sicherheitsverhalten verändert, ist das zu beachten. Alle drei NVIDIA-Lizenzen erheben keinen Anspruch auf die Ausgaben der Modelle und enden bei einer Patent- oder Urheberrechtsklage gegen das Werk.

Nicht-kommerzielle Lizenzen schließen den Unternehmenseinsatz ohne gesonderte Vereinbarung aus. Das betrifft vor allem Hilfsmodelle in RAG-Systemen: jina-embeddings-v3 und jina-reranker-v2-base-multilingual stehen unter CC BY-NC 4.0. Embedding- und Reranker-Modelle werden deshalb genauso geprüft wie das Sprachmodell. Lizenzfreie Alternativen nennt Hybrid Search und Reranking.

Praxisfragen: Quantisierung, Fine-Tuning, Hosting, Ausgaben

Szenario Apache 2.0 / MIT Llama 4 Community License Weitere Herstellerlizenzen
Interne Nutzung, unverändert erlaubt erlaubt, AUP beachten; EU-Ausschluss multimodal Umsatzgrenze Mistral Modified MIT beachten
Quantisierte Version intern erlaubt erlaubt wie Ursprungsmodell
Quantisierte Version weitergeben Lizenz und NOTICE beilegen, Änderungen kennzeichnen Lizenz beilegen, "Built with Llama", NOTICE Lizenz- und Hinweispflichten der jeweiligen Lizenz
Fine-Tune intern erlaubt erlaubt wie Ursprungsmodell
Fine-Tune veröffentlichen Lizenz und NOTICE, Änderungen kennzeichnen Name beginnt mit "Llama" z. B. NVIDIA: Attributionshinweis
Modell als Dienst für Kunden erlaubt "Built with Llama" anzeigen Qwen Community License: gesonderte Lizenz; GLM-5.3: Prüfung ab 10 Mrd. USD
Ausgaben zum Training anderer Modelle nicht gesondert geregelt bereitgestelltes Modell trägt "Llama" im Namen Gemma Terms of Use (bis Gemma 3): Destillat ist Model Derivative

Quantisierung. Ein Modell in FP8, AWQ, GPTQ oder GGUF ist eine veränderte Fassung der Gewichte. Die Lizenz bleibt dieselbe, eine Quantisierung "löst" keine Bedingungen. Bei Community-Quantisierungen auf Hugging Face wird deshalb das Basismodell geprüft, nicht nur die Angabe auf der Seite des Quantisierers. Die technischen Formate erklärt LLM-Quantisierung.

Fine-Tuning. Ein Fine-Tune, etwa ein LoRA-Adapter, ist ein abgeleitetes Werk des Basismodells. Solange er im Unternehmen bleibt, entstehen unter Apache 2.0 und MIT keine zusätzlichen Pflichten. Wird er veröffentlicht oder an Kunden weitergegeben, greifen die Weitergabepflichten, bei Llama zusätzlich die Namensregel.

Hosting für Dritte. Apache 2.0 und MIT knüpfen ihre Pflichten an die Weitergabe von Kopien. Wer ein Modell nur über eine API bereitstellt, gibt keine Gewichte weiter. Herstellerlizenzen regeln diesen Fall dagegen teilweise ausdrücklich: Llama verlangt "Built with Llama" auch bei bereitgestellten Diensten, die Qwen Community License und die GLM-5.3 License adressieren Model-as-a-Service direkt.

Ausgaben. Keine der geprüften Lizenzen beansprucht Rechte an den erzeugten Texten. Google erklärt in den Gemma Terms of Use ausdrücklich, keine Rechte an Ausgaben zu beanspruchen, NVIDIA ebenso in seinen Modelllizenzen. Einschränkungen betreffen die Nutzung von Ausgaben zum Training anderer Modelle. Ob an den Ausgaben selbst Urheberrechte entstehen, ist keine Frage der Modelllizenz.

Lizenzprüfung als Teil der Modellfreigabe

Eine Lizenzprüfung ist kein einmaliger Schritt, sondern Teil der Modellfreigabe. Bewährt hat sich ein festes Schema:

  1. Konkrete Version festhalten: Repository, Modell-ID und Revision (Commit-Hash) des Basismodells, nicht nur den Familiennamen.
  2. Lizenzdatei lesen: LICENSE und gegebenenfalls NOTICE, USAGE_POLICY oder Acceptable Use Policy. Die Angabe im Model-Card-Kopf reicht nicht.
  3. Ableitungskette prüfen: Bei Quantisierungen, Fine-Tunes und Destillaten das Ursprungsmodell ermitteln und dessen Lizenz anwenden.
  4. Einsatzszenario zuordnen: intern, Kundenprodukt, Dienst für Dritte, Weitergabe von Gewichten. Je Szenario die Pflichten aus der Tabelle oben prüfen.
  5. Schwellen prüfen: Umsatz- und Nutzerschwellen (Mistral Modified MIT, Qwen, Kimi, Llama) gegen die eigenen Kennzahlen inklusive verbundener Unternehmen.
  6. Hilfsmodelle einbeziehen: Embedding-, Reranker-, Vision- und Spracherkennungsmodelle gleich behandeln.
  7. Ergebnis dokumentieren: Lizenzstand mit Datum, Prüfer und Einsatzszenario im Modellregister ablegen; bei Modellwechsel neu prüfen.

Dasselbe Modellregister dient im Betrieb als Grundlage für Updates und Rollbacks, weil es festhält, welche Version mit welchem Lizenzstand freigegeben wurde.

Einordnung für Ihr Projekt

Für die meisten Anwendungen im Unternehmen stehen leistungsfähige Modelle unter Apache 2.0 oder MIT zur Verfügung, etwa gpt-oss, Gemma 4, Qwen3.8-27B, Mistral Small 4, DeepSeek V4 oder Granite 4.2. Mit diesen Lizenzen bleiben interne Nutzung, Quantisierung und Fine-Tuning frei von zusätzlichen Pflichten. Herstellerlizenzen mit Umsatzschwellen, Namensregeln oder regionalen Ausschlüssen erfordern dagegen eine rechtliche Bewertung vor dem Einsatz.

WZ-IT betreibt Open-Weight-Modelle mit vLLM oder Ollama auf dem AI Cube oder auf Managed GPU-Servern mit NVIDIA RTX PRO 4000 Blackwell (24 GB) oder RTX PRO 6000 Blackwell Max-Q (96 GB). Im Managed-AI-Betrieb werden Modellversion, Quantisierung und Lizenzstand je Modell dokumentiert und bei Updates mitgeführt. Die rechtliche Bewertung bleibt Aufgabe des Unternehmens und seiner Rechtsberatung. Support, Beratung und Implementierung durch WZ-IT.

Welche Modelle für welche Aufgabe in Frage kommen, beschreibt Welches LLM selbst hosten?, einen Vergleich aktueller Modellfamilien bietet der Beitrag Llama 4 vs. Qwen 3.5 vs. DeepSeek V4. Wer Modelle nicht selbst betreiben, sondern über europäische Anbieter nutzen will, findet einen Überblick in Europäische LLM-APIs im Vergleich.

Quellen

Lieber betreiben lassen?

Sie möchten Lokale KI für Unternehmen nicht selbst betreiben? WZ-IT übernimmt Einrichtung, Betrieb und Wartung - datenschutzorientiert aus Deutschland.

Anfrage

Lokale KI für Ihren Einsatz einordnen

Starten Sie mit dem AI Cube oder lassen Sie eine individuelle KI-Plattform, Wissensanbindung oder Integration einordnen.

Wie sollen wir antworten?

Häufig gestellte Fragen

Antworten auf die wichtigsten Fragen

In vielen Fällen ja, aber nicht pauschal. Modelle unter Apache 2.0 oder MIT, etwa gpt-oss, Gemma 4, Qwen3.8-27B, DeepSeek V4 oder Granite 4.2, erlauben kommerzielle Nutzung mit wenigen Pflichten. Andere Modelle stehen unter eigenen Lizenzen mit Umsatz- oder Nutzerschwellen, Namenspflichten oder Ausschlüssen. Maßgeblich ist immer die Lizenzdatei der konkreten Modellversion.

Nein. Open Weight heißt nur, dass die Gewichte herunterladbar sind. Die Nutzungsrechte regelt die beigefügte Lizenz, und die reicht von Apache 2.0 bis zu Lizenzen, die kommerzielle Nutzung ausschließen, etwa die Qwen Research License oder CC BY-NC 4.0. Auch die Llama Community License ist keine Open-Source-Lizenz im klassischen Sinn, weil sie Nutzungsbedingungen und Ausschlüsse enthält.

Praktisch nicht. Nach Abschnitt 2 der Llama 4 Community License brauchen nur Lizenznehmer eine gesonderte Lizenz von Meta, deren Produkte am Veröffentlichungsdatum von Llama 4 im Vormonat mehr als 700 Millionen monatlich aktive Nutzer hatten. Relevanter für den Mittelstand sind die Hinweispflicht 'Built with Llama', die Namensregel für abgeleitete Modelle und die Acceptable Use Policy.

Nur eingeschränkt. Die Acceptable Use Policy von Llama 4 gewährt für multimodale Modelle aus Llama 4 keine Rechte an Personen mit Wohnsitz oder Unternehmen mit Hauptniederlassung in der EU. Llama 4 Scout und Maverick sind laut Model Card nativ multimodal. Ausgenommen sind Endnutzer eines Produkts, das ein solches Modell enthält. Für den Eigenbetrieb durch ein EU-Unternehmen ist das ein Ausschlussgrund, den die Rechtsabteilung bewerten sollte.

Nein. Qwen3.8-27B und die Qwen3.6-Modelle stehen unter Apache 2.0. Qwen3.8-Flash-Next steht unter der Qwen Community License 1.0, die für Model-as-a-Service- und KI-Arbeitsassistenten-Angebote eine gesonderte Lizenz verlangt. Ältere Modelle wie Qwen2.5-72B-Instruct (Qwen License) oder Qwen2.5-3B-Instruct (nur nicht-kommerziell) haben wieder andere Bedingungen. Die Lizenz wird je Modell geprüft, nicht je Familie.

Gemma 4 ja. Google hat Gemma 4 am 2. April 2026 unter Apache 2.0 veröffentlicht. Gemma 1 bis 3, Gemma 3n und Varianten wie EmbeddingGemma oder PaliGemma stehen weiter unter den Gemma Terms of Use mit Prohibited Use Policy und Weitergabepflichten. Wer Gemma 3 im Einsatz hat, prüft deshalb andere Bedingungen als bei Gemma 4.

Bei den Apache-2.0-Modellen wie Mistral Small 4, Mistral Large 3, Ministral 3 oder Devstral Small 2 ja. Mistral Medium 3.5 und Devstral 2 (123B) stehen unter einer Modified MIT License: Unternehmen mit mehr als 20 Millionen US-Dollar konsolidiertem Monatsumsatz im Vormonat dürfen keine Rechte daraus ausüben und benötigen eine kommerzielle Lizenz von Mistral AI. Das betrifft auch die interne Nutzung.

Eine Quantisierung ist eine Veränderung des Modells und damit ein abgeleitetes Werk. Für die interne Nutzung ergeben sich unter Apache 2.0 und MIT keine zusätzlichen Pflichten. Wer quantisierte Gewichte weitergibt, muss die Pflichten der Ursprungslizenz erfüllen, bei Apache 2.0 etwa Lizenztext beilegen, NOTICE-Datei übernehmen und geänderte Dateien kennzeichnen. Eine Quantisierung ändert die Lizenz nicht.

Unter Apache 2.0 und MIT ja. Einige Lizenzen regeln genau diesen Fall: Die Qwen Community License 1.0 verlangt für Model-as-a-Service eine gesonderte Lizenz, die GLM-5.3 License sieht ab 10 Milliarden US-Dollar Jahresumsatz eine Sicherheitsprüfung durch Z.AI vor, und die Llama-Lizenz verlangt bei bereitgestellten Diensten den Hinweis 'Built with Llama'.

Das hängt von der Lizenz ab. Apache 2.0 und MIT regeln Ausgaben nicht gesondert. Die Llama 4 Community License verlangt, dass ein mit Llama-Ausgaben trainiertes und bereitgestelltes Modell 'Llama' am Anfang des Namens trägt. Die Gemma Terms of Use (bis Gemma 3) zählen per Destillation erzeugte Modelle zu den Model Derivatives, die Ausgaben selbst aber nicht.

Nicht ohne gesonderte Vereinbarung. jina-embeddings-v3 und jina-reranker-v2-base-multilingual stehen laut Model Card unter CC BY-NC 4.0, also nur für nicht-kommerzielle Zwecke. Für RAG-Systeme im Unternehmen kommen stattdessen Modelle unter Apache 2.0 oder MIT in Frage, etwa BGE-M3 oder die Qwen3-Embedding- und Reranker-Modelle.

Nein. Der Artikel ist eine technische Einordnung auf Basis der veröffentlichten Lizenztexte und Model Cards, Stand Oktober 2026, und keine Rechtsberatung. Lizenzen können sich mit neuen Modellversionen ändern. Für eine verbindliche Bewertung, etwa bei Weitergabe an Kunden oder eigenen Produkten, ist eine rechtliche Prüfung erforderlich.

Mehr zu Lokale KI für Unternehmen

Kontakt

Lassen Sie uns über Ihre Idee sprechen

Ob konkrete IT-Herausforderung oder einfach eine Idee - wir freuen uns auf den Austausch. In einem kurzen Gespräch prüfen wir gemeinsam, ob und wie Ihr Projekt zu WZ-IT passt.

Rückruf vereinbaren

Rückruf

Rückruf vereinbaren

Nummer hinterlassen, wir rufen zurück — spätestens am nächsten Werktag.

Für ein ausführliches Gespräch können Sie alternativ einen Termin buchen.

Unternehmen weltweit vertrauen WZ-IT

  • ml&s
  • Rekorder
  • Keymate
  • Führerscheinmacher
  • SolidProof
  • ARGE
  • Boese VA
  • nextGYM
  • SweetConnect GmbH
  • Golem.de
  • Millenium
  • Paritel
  • Yonju
  • EVADXB
  • Mr. Clipart
  • Aphy AG
  • Negosh
  • ABCO Water Systems
1/3 - Themenauswahl33%

Worum geht es bei Ihrer Anfrage?

Wählen Sie zuerst den Leistungsbereich, der am besten zu Ihrem Vorhaben passt.