Die kostenlose Bereitstellung eines fortschrittlichen KI-Modells bedeutet nicht, dass seine Entwicklung kostengünstig war. Modelle mit offenen Gewichten erfordern erhebliche Investitionen in Daten, Hardware und Rechenkapazität, doch ihre Veröffentlichung kann kommerziellen und strategischen Zielen dienen, die über den Verkauf des Modells selbst hinausgehen. Dies ist die zentrale Schlussfolgerung einer Analyse, die ITmedia AI Plus am 10. September 2026 im Rahmen einer Serie über den Boom lokaler Sprachmodelle veröffentlichte.
Die Analyse bringt die Verbreitung lokaler Modelle mit drei miteinander verbundenen Faktoren in Zusammenhang: der Reife von Modellen, Hardware und Software, der zunehmenden Sorge über eine vollständige Abhängigkeit von cloudbasierten KI-Diensten sowie dem Wettbewerb zwischen Unternehmen und Staaten um die Gestaltung des Ökosystems offener Modelle.
Das offene Modell als Mittel zum Hardwareverkauf
Dem Artikel zufolge setzt NVIDIA darauf, dass die Verfügbarkeit leistungsfähiger Modelle, die innerhalb eines Unternehmens betrieben werden können, eine wesentliche Voraussetzung dafür ist, den Markt für Grafikprozessoren über eine begrenzte Gruppe großer Cloud-Computing-Unternehmen wie Microsoft, Google, Amazon und Meta hinaus auszuweiten.
Das Unternehmen propagiert das Konzept der AI Factory, bei dem Unternehmen eigene GPU-Server besitzen und ihre Daten zur Erzeugung von KI-Ausgaben für ihre Geschäftsaktivitäten verwenden. Dieses Modell wird jedoch weniger attraktiv, wenn die besten Modelle ausschließlich über geschlossene APIs verfügbar sind; dann würden Unternehmen für den Zugang zum Dienst bezahlen, während der Hardwarekauf weitgehend auf Cloud-Anbieter beschränkt bliebe.
Daher entwickelt NVIDIA die Nemotron-Reihe und veröffentlicht Gewichte, Datensätze und Trainingsrezepte in offener Form. Außerdem kündigte das Unternehmen auf der GTC-Konferenz im März 2026 die Gründung der Nemotron Coalition unter Beteiligung von acht Unternehmen an, darunter Mistral AI, Perplexity, Cursor und Thinking Machines Lab. Laut Quelle wird das erste Projekt der Koalition ein Basismodell sein, das NVIDIA gemeinsam mit Mistral AI entwickelt.
Kostenlose Modelle als Zugang zu Cloud-Diensten
Die Analyse stellt die Strategie von Alibaba Cloud als ein Beispiel für eine andere Umsetzung mit einem ähnlichen Ziel dar. Das Unternehmen hält die höher eingestuften Modelle Qwen Max geschlossen, um über APIs und die Cloud Einnahmen zu erzielen, während es andere Modelle kostenlos und unter einer Lizenz bereitstellt, die eine kommerzielle Nutzung erlaubt.
Die Wette besteht darin, das kostenlose Modell in einen Vertriebskanal für das Ökosystem von Alibaba Cloud zu verwandeln. Ein Unternehmen kann die Feinabstimmung innerhalb seiner eigenen Umgebung vornehmen, später jedoch eine externe Infrastruktur benötigen, um Inferenz in großem Maßstab bereitzustellen. Dann werden IaaS- und PaaS-Dienste sowie Model as a Service zu möglichen Einnahmequellen.
Der Artikel erwähnt, dass die Gesamtzahl der Downloads von Qwen-Modellen bis April 2026 eine Milliarde überschritten hat. In der Praxis bedeutet dies, dass der Wert eines Modells nicht nur an seinem unmittelbaren Preis gemessen wird, sondern auch an seiner Fähigkeit, eine Nutzerbasis aufzubauen, die später den Verbrauch von Rechenleistung und Cloud-Diensten fördert.
Vom kommerziellen Wettbewerb zur nationalen Strategie
Die Analyse vertritt die Ansicht, dass die Öffnung von Modellen auch mit geopolitischem Wettbewerb verbunden ist. US-Exportbeschränkungen begrenzen den Zugang chinesischer Unternehmen zu den neuesten GPU-Einheiten, wodurch es schwieriger wird, geschlossene US-Unternehmen allein anhand des Umfangs der Rechenressourcen zu konkurrieren. Gleichzeitig ermöglicht die weitreichende Veröffentlichung der Gewichte den Aufbau eines Entwicklerökosystems und eine globale Verbreitung, die nach ihrer Freigabe nur schwer rückgängig zu machen ist.
Die Quelle weist darauf hin, dass die US-Regierung im Juli 2025 einen Aktionsplan für künstliche Intelligenz ankündigte, in dem Open-Source- oder Modelle mit offenen Gewichten als geopolitisch wertvoll eingestuft wurden. Außerdem unterzeichneten Unternehmen wie NVIDIA, Microsoft, Meta, IBM, Hugging Face, Mistral AI und Palantir im Juli 2026 einen Brief, in dem sie dazu aufriefen, Modelle mit offenen Gewichten zu veröffentlichen, anstatt sie durch Regelungen in ihrer Verbreitung einzuschränken. OpenAI und Google schlossen sich laut Artikel später an. Im August wurden die Unternehmen darüber informiert, dass US-amerikanische Modelle mit offenen Gewichten von einer vorherigen staatlichen Sicherheitsprüfung ausgenommen werden.
Was ändert sich praktisch für Unternehmen?
Die Analyse kommt nicht zu dem Schluss, dass Unternehmen auf Cloud-Modelle verzichten werden. Vielmehr schlägt sie vor, die Nutzung je nach Art der Aufgabe zu verteilen: fortschrittliche Cloud-Modelle für Aufgaben, die ein Höchstmaß an Fähigkeiten erfordern, lokale Modelle für Daten, die nicht nach außen gelangen dürfen, oder für Prozesse, die keinen Ausfall tolerieren, sowie Cloud-Dienste, die offene Modelle für Aufgaben hosten, die bei geringeren Kosten als bei Spitzenmodellen eine gute Leistung benötigen.
Aus dieser Perspektive ist der Betrieb eines lokalen Modells nicht nur eine technische Option, sondern auch ein Instrument für Verhandlungen und die Geschäftskontinuität. Dennoch bleiben Einschränkungen und offene Fragen bestehen: Die Verfügbarkeit oder die Bedingungen von Modellen können sich ändern, der Zugang zu geschlossenen Modellen kann wegfallen, und der Besitz der Gewichte beseitigt weder die Betriebs- noch die Verwaltungskosten. Der Wert offener Modelle liegt daher, wie der Autor darstellt, in der Erweiterung des Spielraums für Kontrolle und Flexibilität – nicht darin, stets eine überlegene Alternative zu geschlossenen Cloud-Diensten zu bieten.