Aus dem Englischen übersetzt

Qwen3.8 ist eine Familie großer Sprachmodelle, die von Alibaba Cloud entwickelt und erstmals 2025 veröffentlicht wurde. Sie umfasst mehrere Parametergrößen und Varianten, wobei Versionen mit offenen Gewichten für Forschung und kommerzielle Nutzung verfügbar sind.

Qwen3.8 ist eine Familie von Large Language Models, die von Alibaba Cloud entwickelt wurde. Die Serie wurde 2025 als Nachfolger der Qwen2.5-Generation eingeführt und bietet eine Reihe von Parametergrößen, von dichten Modellen bis hin zu Mixture-of-Experts-Architekturen (MoE). Die Modelle sind sowohl für die Open-Source-Verteilung als auch für die kommerzielle Bereitstellung über die Plattform von Alibaba Cloud konzipiert.

Die Qwen3.8-Familie umfasst mehrere Konfigurationen, wobei die Flaggschiff-dichten Modelle 8 Milliarden und 32 Milliarden Parameter aufweisen, neben MoE-Varianten wie dem Qwen3.8-A14B, das 2,2 Milliarden Parameter pro Token aktiviert. Diese Modelle unterstützen eine Kontextlänge von 131.072 Token und werden auf mehrsprachigen Daten trainiert, die über 30 Sprachen abdecken, mit besonderer Stärke in Englisch und Chinesisch.

Architektur und Training

Die Qwen3.8-Modelle verwenden eine standardmäßige Transformer (architecture)-Decoder-only-Architektur mit Verbesserungen wie Multi-Head-Attention, SwiGLU-Aktivierung und rotierenden Positions-Einbettungen. Der Trainingsprozess nutzte einen zweistufigen Ansatz: initiales Vortraining auf einem großen Korpus aus Webtexten, Büchern und Code, gefolgt von überwachtem Feintuning und Verstärkungslernen aus KI-Feedback (RLAIF), um mit menschlichen Präferenzen übereinzustimmen.

Ein bemerkenswertes Merkmal von Qwen3.8 ist der hybride Denkmodus, der es dem Modell ermöglicht, zwischen schneller Antwortgenerierung und erweiterter Argumentation zu wechseln. Dies wird über einen System-Prompt gesteuert, der es Benutzern ermöglicht, Geschwindigkeit und Tiefe der Analyse auszubalancieren. Die Modelle integrieren auch Greedy-Sampling und Top-p-Sampling-Strategien während der Inferenz.

Leistung und Benchmarks

Bei öffentlichen Benchmarks haben die Qwen3.8-Modelle wettbewerbsfähige Leistungen gezeigt. Das Qwen3.8-32B-Modell erreichte eine Punktzahl von 75,1 im MMLU-Pro-Benchmark und übertraf damit mehrere größere Modelle. Beim AIME24-Mathematikwettbewerb erzielte das 32B-Modell 67,0, während die MoE-Variante Qwen3.8-A14B 81,0 erreichte. Bei Programmieraufgaben erzielten die Modelle starke Ergebnisse in LiveCodeBench und SWE-bench, wobei das 32B-Modell eine Bestehensquote von 45,0 bei letzterem erreichte.

Die Modelle sind auf öffentlichen LLM-Bestenlisten erschienen, einschließlich der LMArena und der Open LLM Leaderboard, wo sie unter den besten Open-Weight-Modellen ihrer Größenklasse rangierten. Unabhängige Bewertungen haben ihre Effizienz hervorgehoben, insbesondere die MoE-Varianten, die eine mit dichten Modellen vergleichbare Leistung bei reduzierten Rechenkosten bieten.

Veröffentlichung und Verfügbarkeit

Qwen3.8 wurde in Stufen veröffentlicht, wobei die kleineren Modelle mit 0,6B und 1,7B zuerst verfügbar gemacht wurden, gefolgt von den dichten Modellen mit 8B und 32B und schließlich den MoE-Varianten. Die Gewichte werden unter der Apache-2.0-Lizenz verteilt, die sowohl Forschung als auch kommerzielle Nutzung erlaubt. Die Modelle sind zum Download über Hugging Face und ModelScope verfügbar und können über den Alibaba Cloud-Model-Studio-Dienst bereitgestellt werden.

Die Hardware-Unterstützung umfasst NVIDIA-GPUs, wobei die Modelle auch für die Inferenz auf AMD- und Intel-Hardware optimiert sind. Die Bereitstellungsoptionen reichen von lokaler Inferenz mit vLLM oder SGLang bis hin zu Cloud-basierten APIs. Die Veröffentlichung umfasste auch quantisierte Versionen unter Verwendung von GPTQ- und AWQ-Techniken für einen reduzierten Speicherbedarf.

Rezeption und Auswirkungen

Die Qwen3.8-Serie wurde in der Open-Source-KI-Community gut aufgenommen, wobei Entwickler ihr Leistungs-Größen-Verhältnis und die Flexibilität des hybriden Denkmodus lobten. Die Modelle wurden in verschiedene Anwendungen integriert, von Programmierassistenten bis hin zu mehrsprachigen Übersetzungstools. Die Veröffentlichung hat zum breiteren Trend der Demokratisierung von generativer KI beigetragen, indem hochwertige Modelle bereitgestellt werden, die auf Consumer-Hardware laufen können.

Stand Ende 2025 wird die Qwen3.8-Familie weiterhin aktiv gepflegt, mit regelmäßigen Updates und zusätzlichen feinabgestimmten Varianten. Die Modelle haben auch als Grundlage für weitere Forschung in Bereichen wie Modell-Pruning und Datenaugmentierung gedient.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:large-language-models·alibaba·open-source-ai·generative-ai
Diese Seite wurde zuletzt bearbeitet am 13. Sept. 2026 von AI Wiki Bot · Versionsgeschichte