Qwen은 통이치안원(중국어: 通义千问; 병음: Tōngyì Qiānwèn)으로도 알려져 있으며, 알리바바 클라우드가 개발한 주로 오픈 가중치를 가진 대형 및 소형 언어 모델(LLM 및 SLM) 계열이다. 이 모델들은 텍스트 생성, 추론, 다중 모드 이해를 포함한 다양한 자연어 처리 작업을 위해 설계되었다. Qwen은 특히 허용적인 라이선스와 오픈소스 커뮤니티 내에서 소형 모델의 광범위한 채택으로 주목받으며, 글로벌 인공지능 환경에서 중요한 플레이어가 되었다.
이 계열은 2023년 초기 Qwen 출시부터 2026년 고급 Qwen3.8 시리즈까지 여러 주요 반복을 통해 확장되었다. 이 모델들은 트랜스포머 아키텍처를 기반으로 하며 딥러닝 및 머신러닝의 기술을 활용한다. Qwen 모델은 추가 미세 조정 및 사용자 지정의 출발점으로 자주 사용되며, 독립 개발자들이 만든 많은 파생 모델이 있다.
기원 및 초기 출시
알리바바는 2023년 4월 통이치안원이라는 이름으로 Qwen의 베타 버전을 출시했다. 초기 아키텍처는 메타 AI의 Llama 1 모델을 기반으로 했으며, 이는 기초적인 대형 언어 모델 설계였다. 규제 승인을 받은 후, 알리바바는 2023년 9월 Qwen을 공개 사용에 개방했다.
첫 번째 오픈 가중치 출시는 2023년 8월 7B 파라미터 모델로 이루어졌으며, 2023년 12월에는 72B 및 1.8B 변형이 뒤따랐다. 이러한 초기 출시는 오픈소스 AI 커뮤니티에서 Qwen의 입지를 확립하여 연구자와 개발자에게 실험을 위한 접근 가능한 모델을 제공했다.
Qwen2 시리즈
Qwen2는 2024년 6월에 출시되었으며, 밀집 및 희소(혼합 전문가) 모델 아키텍처를 모두 도입했다. 2024년 9월, 알리바바는 일부 Qwen2 모델을 오픈 가중치로 출시하면서 가장 고급 모델은 독점으로 유지했다. 이 시리즈에는 시각 언어 작업을 위한 Qwen-VL 및 오디오 처리를 위한 Qwen-Audio와 같은 특수 변형이 포함되었다.
Qwen2-VL 라인은 비전 트랜스포머와 LLM을 결합했으며, 20억 및 70억 파라미터 변형이 있었다. 2025년 1월, Qwen2.5-VL은 30억, 70억, 320억, 720억 파라미터 버전으로 확장되었으며, 72B 변형을 제외한 모든 버전이 Apache 2.0 라이선스로 허가되었다. 2024년 기준 알리바바의 플래그십 비전 모델인 Qwen-VL-Max는 알리바바 클라우드를 통해 백만 입력 토큰당 미화 0.41달러에 판매되었다.
2024년 11월, 알리바바는 OpenAI의 o1과 유사한 추론 중심 모델인 QwQ-32B-Preview를 Apache 2.0 라이선스로 출시했다. 이 모델은 32K 토큰 컨텍스트 길이를 가졌으며 일부 벤치마크에서 o1보다 더 나은 성능을 보였다. Accio 애플리케이션도 그 달에 출시되었다.
2025년 1월 29일, 알리바바는 Qwen2.5-Max를 출시했다. 2025년 3월 24일, Qwen2.5-VL-32B-Instruct가 이전 비전 모델의 후속작으로 출시되었다. 이틀 후, Qwen2.5-Omni-7B가 Apache 2.0 라이선스로 출시되어 텍스트, 이미지, 비디오, 오디오를 입력으로 받아들이고 텍스트 및 오디오 출력을 모두 생성하여 실시간 음성 채팅을 가능하게 했다.
Qwen3 계열
Qwen3 모델 계열은 2025년 4월 28일에 출시되었으며, 모든 모델이 Apache 2.0 라이선스로 허가되었다. 이 출시에는 밀집 및 혼합 전문가(MoE) 모델이 모두 포함되었다. 밀집 모델 크기는 0.6B에서 32B 파라미터까지 다양했으며, MoE 모델에는 30B-A3B(총 30B, 활성 3B) 및 235B-A22B(총 235B, 활성 22B)가 포함되었다. 이 모델들은 119개 언어 및 방언에 걸쳐 36조 토큰으로 훈련되었다.
Qwen3 컬렉션에는 여러 변형이 포함되었다: 전환 가능한 사고 및 비사고 모드를 갖춘 Qwen3, 사전 훈련용 Qwen3 Base, 비사고 모드 전용 Qwen3 Instruct, 사고 모드 전용 Qwen3 Thinking이 있다. 또한, 1조 개 이상의 파라미터를 가진 독점 모델인 Qwen3-Max가 API를 통해 제공되었으며, 텍스트, 그림 또는 비디오를 생성할 수 있는 추론 변형인 Qwen3-Max-Thinking도 함께 제공되었다.
Qwen3.5 및 이후 출시
2026년 2월, 알리바바는 오픈 가중치 Qwen3.5와 독점 Qwen3.5-Plus를 출시했다. 알리바바는 Qwen3.5가 데스크톱 및 모바일 애플리케이션을 작동할 수 있다고 밝혔다. Qwen3.5-Omni와 Qwen3.6-Plus는 2026년 4월 독점 모델로 출시되었으며, 접근은 챗봇 웹사이트와 알리바바 클라우드 플랫폼으로 제한되었다. Qwen3.6 모델은 같은 달 Apache 라이선스로 출시되었다.
알리바바는 2026년 5월과 6월에 각각 Max 및 Plus 변형으로 독점 Qwen3.7 모델을 출시했다. 오픈소스 커뮤니티는 Anthropic의 Fable 5에서 튜닝 데이터를 통합한 "Qwable"을 포함한 미세 조정 및 abliterated 버전을 기여했다.
Qwen3.8-Max
알리바바는 2026년 7월에 2.4조 파라미터 모델인 Qwen3.8-Max를 미리 선보이며 가중치 공개 계획을 발표했다. 이 발표는 Moonshot AI가 경쟁 모델인 Kimi K3를 출시한 지 며칠 후에 이루어졌다. Qwen3.8-Max의 클라우드 버전은 2026년 8월 3일에 출시되었으며, 순방향 패스당 약 950억 개의 활성 파라미터를 가진 희소 혼합 전문가 아키텍처를 사용하고 최대 백만 토큰의 컨텍스트 창을 지원했다.
2026년 8월 12일, 알리바바는 가중치를 Qwen3.8-2.4T-A95B로 출시했다. 이 오픈 가중치 모델은 이미지 입력 및 비사고 모드와 같은 일부 클라우드 기능을 생략했다. 해당 라이선스는 연간 수익이 미화 5천만 달러를 초과하는 모델 제공업체가 알리바바와 상업 라이선스를 취득하도록 요구했다. 당시 이는 Kimi K3 다음으로 두 번째로 크고 두 번째로 강력한 오픈 가중치 LLM 및 중국어 LLM이었다.
2026년 8월 14일, 알리바바는 더 큰 출시에서 생략된 이미지 입력 및 비사고 모드를 모두 포함한 Qwen3.8-27B를 출시했다. 이 모델은 더 허용적인 Apache 2.0 라이선스로 출시되었다.
생태계 및 응용
Qwen 모델은 4천만 회 이상 다운로드되었으며, 계열 전반에 걸쳐 100개 이상의 오픈 가중치 모델이 출시되었다. 샌프란시스코 기반 Abacus AI의 "Liberated Qwen"과 같은 애호가들이 개발한 미세 조정 버전은 콘텐츠 제한 없이 사용자 요청에 응답한다.
Qwen의 로컬 버전은 중국에서 Apple Intelligence에 사용되며 운영 체제에 통합되어 있다. 2026년 1월, Qwen 모바일 애플리케이션 업데이트는 챗봇을 알리바바 그룹 생태계에 연결했으며, 음식 배달 서비스로 시작했다. 계획에는 사용자가 Taobao 및 Fliggy와 같은 플랫폼에 작업을 할당하고 전화 통화 및 문서 처리와 같은 심부름을 돕는 것이 포함되었다.
리더십 및 향후 방향
전 Qwen AI 모델 부문 책임자 Lin Junyang은 Qwen3.5 및 Qwen3.5-Plus 출시 후 2026년 3월에 사임하여 그 해 알리바바를 떠난 세 번째 임원이 되었다. 연구 및 오픈소스 AI에서 잠재적인 전환에 대한 우려 속에서, 알리바바는 오픈소스에 대한 초점을 계속할 것이라고 밝혔다. 그 달 말, 회사 발표는 새로운 AI 부서의 구성을 공개하여 해당 분야에 대한 지속적인 헌신을 시사했다.