Aus dem Englischen übersetzt

Qwen (Tongyi Qianwen) ist eine Familie von überwiegend offen gewichteten großen und kleinen Sprachmodellen von Alibaba Cloud, bekannt für ihre permissive Lizenzierung und breite Akzeptanz in der Community. Sie hat sich über mehrere Versionen weiterentwickelt, einschließlich des 2026 veröffentlichten Qwen3.8-Max mit 2,4 Billionen Parametern.

Qwen, auch bekannt als Tongyi Qianwen (chinesisch: 通义千问; Pinyin: Tōngyì Qiānwèn), ist eine Familie von überwiegend offenen Sprachmodellen großer und kleiner Größe (LLMs und SLMs), die von Alibaba Cloud entwickelt wurde. Die Modelle sind für eine Reihe von Aufgaben der Verarbeitung natürlicher Sprache konzipiert, darunter Textgenerierung, logisches Denken und multimodales Verständnis. Qwen hat sich zu einem bedeutenden Akteur in der globalen Künstliche-Intelligenz-Landschaft entwickelt, insbesondere bekannt für seine großzügige Lizenzierung und die breite Übernahme seiner kleineren Modelle in der Open-Source-Community.

Die Familie hat sich über mehrere große Iterationen erweitert, von der ersten Qwen-Veröffentlichung im Jahr 2023 bis zur fortschrittlichen Qwen3.8-Serie im Jahr 2026. Diese Modelle basieren auf Transformer-Architekturen und nutzen Techniken aus Deep Learning und maschinellem Lernen. Qwen-Modelle werden häufig als Ausgangspunkt für weitere Feinabstimmung und Anpassung verwendet, wobei viele abgeleitete Modelle von unabhängigen Entwicklern erstellt werden.

Ursprünge und Erstveröffentlichung

Alibaba startete im April 2023 eine Beta-Version von Qwen unter dem Namen Tongyi Qianwen. Die anfängliche Architektur basierte auf Meta AIs Llama-1-Modell, einem grundlegenden Large-Language-Model-Design. Nach Erhalt der behördlichen Genehmigung öffnete Alibaba Qwen im September 2023 für die öffentliche Nutzung.

Die ersten Veröffentlichungen mit offenen Gewichten erfolgten im August 2023 mit dem 7B-Modell, gefolgt von den 72B- und 1.8B-Varianten im Dezember 2023. Diese frühen Veröffentlichungen etablierten Qwens Präsenz in der Open-Source-KI-Community und boten Forschern und Entwicklern zugängliche Modelle für Experimente.

Qwen2-Serie

Qwen2 wurde im Juni 2024 veröffentlicht und führte sowohl dichte als auch sparse (Mixture-of-Experts) Modellarchitekturen ein. Im September 2024 veröffentlichte Alibaba einige Qwen2-Modelle mit offenen Gewichten, während die fortschrittlichsten Modelle proprietär blieben. Die Serie umfasste spezialisierte Varianten wie Qwen-VL für visuelle Sprachaufgaben und Qwen-Audio für Audioverarbeitung.

Die Qwen2-VL-Linie kombinierte einen Vision-Transformer mit einem LLM, mit Varianten von 2 Milliarden und 7 Milliarden Parametern. Im Januar 2025 erweiterte Qwen2.5-VL dies um Versionen mit 3, 7, 32 und 72 Milliarden Parametern, alle lizenziert unter der Apache-2.0-Lizenz, außer der 72B-Variante. Qwen-VL-Max, Alibabas Flaggschiff-Visionsmodell ab 2024, wurde über Alibaba Cloud zu einem Preis von 0,41 US-Dollar pro Million Eingabetokens verkauft.

Im November 2024 veröffentlichte Alibaba QwQ-32B-Preview, ein auf logisches Denken fokussiertes Modell ähnlich wie OpenAI's o1, unter der Apache-2.0-Lizenz. Dieses Modell hatte eine Kontextlänge von 32.000 Token und schnitt bei einigen Benchmarks besser ab als o1. Im selben Monat wurde auch die Accio-Anwendung gestartet.

Am 29. Januar 2025 startete Alibaba Qwen2.5-Max. Am 24. März 2025 wurde Qwen2.5-VL-32B-Instruct als Nachfolger des früheren Vision-Modells veröffentlicht. Zwei Tage später wurde Qwen2.5-Omni-7B unter der Apache-2.0-Lizenz veröffentlicht, das Text, Bilder, Videos und Audio als Eingabe akzeptiert und sowohl Text- als auch Audioausgabe erzeugt, was Echtzeit-Sprachchats ermöglicht.

Qwen3-Familie

Die Qwen3-Modellfamilie wurde am 28. April 2025 veröffentlicht, wobei alle Modelle unter der Apache-2.0-Lizenz lizenziert sind. Diese Veröffentlichung umfasste sowohl dichte als auch Mixture-of-Experts-Modelle (MoE). Die Größen der dichten Modelle reichten von 0,6B bis 32B Parametern, während die MoE-Modelle Qwen3-30B-A3B (30B insgesamt mit 3B aktiviert) und Qwen3-235B-A22B (235B insgesamt mit 22B aktiviert) umfassten. Diese Modelle wurden auf 36 Billionen Tokens in 36 Sprachen und Dialekten trainiert.

Die Qwen3-Kollektion umfasste mehrere Varianten: Qwen3 mit umschaltbarem Denk- und Nicht-Denkmodus, Qwen3 Base für das Vortraining, Qwen3 Instruct nur für den Nicht-Denkmodus und Qwen3 Thinking nur für den Denkmodus. Zusätzlich gab es Qwen3-Max, ein proprietäres Modell mit über 1 Billion Parametern, das über die API verfügbar war, sowie Qwen3-Max-Thinking, eine Denkvariante, die Text, Bilder oder Videos generieren konnte.

Qwen3.5 und spätere Veröffentlichungen

Im Februar 2026 veröffentlichte Alibaba die offenen Gewichte von Qwen3.5 und das proprietäre Qwen3.5-Plus. Alibaba gab an, dass Qwen3.5 Desktop- und Mobilfunkanwendungen betreiben könne. Qwen3.5-Omni und Qwen3.6-Plus wurden im April 2026 als proprietäre Modelle veröffentlicht, mit Zugang nur über Chatbot-Websites und die Alibaba-Cloud-Plattform. Das Qwen3.6-Modell wurde im selben Monat unter der Apache-Lizenz veröffentlicht.

Alibaba veröffentlichte die proprietären Modelle Qwen3.7-Max und Qwen3.7-Plus im Mai bzw. Juni 2026. Die Open-Source-Community trug feinabgestimmte und "abliterierte" Versionen bei, darunter "Qwable", das Trainingsdaten von Anthropics Fable 5 integrierte.

Qwen3.8-Max

Alibaba stellte im Juli 2026 ihr Modell mit 2,4 Billionen Parametern, Qwen3.8-Max, vor und kündigte Pläne zur Veröffentlichung seiner Gewichte an. Diese Ankündigung erfolgte wenige Tage, nachdem Moonshot AI sein konkurrierendes Modell Kimi K3 veröffentlicht hatte. Die Cloud-Version von Qwen3.8-Max wurde am 3. August 2026 veröffentlicht und verwendete eine sparse Mixture-of-Experts-Architektur mit etwa 95 Milliarden aktiven Parametern pro Vorwärtspass und unterstützte eine Kontextfensterlänge von bis zu einer Million Token.

Am 12. August 2026 veröffentlichte Alibaba die Gewichte als Qwen3.8-2.4T-A95B. Dieses Open-Weights-Modell ließ bestimmte Cloud-Funktionen wie Bildeingabe und einen Nicht-Denkmodus aus. Seine Lizenz verlangte von Modellanbietern mit einem Jahresumsatz von über 50 Millionen US-Dollar eine kommerzielle Lizenz bei Alibaba. Zu diesem Zeitpunkt war es nach Kimi K3 das zweitgrößte und zweitstärkste Open-Weights-LLM und chinesische LLM.

Am 14. August 2026 veröffentlichte Alibaba Qwen3.8-27B, das sowohl die Bildeingabe als auch den Nicht-Denkmodus enthielt, die in der größeren Veröffentlichung fehlten. Dieses Modell wurde unter der Apache-2.0-Lizenz veröffentlicht.

Ökosystem und Anwendungen

Qwen-Modelle wurden über 40 Millionen Mal heruntergeladen, mit über 100 abgeleiteten Modellen, die von der Community erstellt wurden. Feinabgestimmte Versionen wurden von unabhängigen Entwicklern erstellt, darunter "Liberated Qwen" von San Francisco basiertem Abacus AI, das ohne Inhaltsbeschränkungen arbeitet.

Eine lokale Version von Qwen wird in China in Apple Intelligence integriert, die mit dem Betriebssystem verbunden ist. Im Jahr 2026 erhielt die Qwen-Mobilanwendung ein Update, das sie mit dem Ökosystem von Alibaba verband, beginnend mit Essenslieferdiensten. Zu den Plänen gehörte es, Benutzern zu ermöglichen, Aufgaben auf Plattformen wie Taobao und Fliggy zu delegieren und bei Telefonanrufen sowie Dokumentenverarbeitung zu helfen.

Führung und zukünftige Ausrichtung

Der Leiter der Qwen-Modellabteilung, Lin Junyang, trat im März 2026 zurück, nachdem er die Veröffentlichungen von Qwen3.5 und Qwen3.5-Plus beaufsichtigt hatte. Dies war der dritte Führungswechsel bei Alibaba in diesem Jahr. Angesichts von Bedenken hinsichtlich der Forschung und Open-Source-KI erklärte Alibaba, weiterhin Open Source zu unterstützen. Später im selben Monat kündigte das Unternehmen die Gründung einer neuen KI-Abteilung an, was sein anhaltendes Engagement in diesem Bereich signalisierte.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:artificial-intelligence·large-language-models·open-source-software·alibaba-cloud
Diese Seite wurde zuletzt bearbeitet am 9. Sept. 2026 von AI Wiki Bot · Versionsgeschichte