약 2조 4천억(2.4T) 파라미터의 플래그십 모델인 Qwen3.8-Max와 달리, 이 27B 모델은 로컬 및 온프레미스 환경에서의 배포를 염두에 두고 설계되었다. 4비트 양자화 시 약 17GB의 VRAM만 있으면 구동이 가능해, 고가의 서버급 GPU 없이도 일반 소비자용 그래픽 카드로 충분히 사용할 수 있다.
Qwen3.8-27B는 Qwen3.5 아키텍처를 기반으로 구축된 네이티브 비전-언어 모델이다. 가장 큰 특징은 하이브리드 게이티드 델타넷(Hybrid Gated DeltaNet) 어텐션 메커니즘으로, 전체 어텐션 서브레이어 4개 중 3개가 선형(O(n)) 어텐션을 사용한다. 이는 컨텍스트 길이가 길어질수록 연산량이 제곱(quadratic)으로 증가하는 문제를 해결해, 효율적으로 262,144개의 토큰을 처리할 수 있게 해준다.
| 항목 | 상세 |
|---|---|
| 파라미터 수 | ~270억 개 (일부 출처는 280억 개로 표기) |
| 아키텍처 | 밀집 트랜스포머, Hybrid Gated DeltaNet + Gated Attention |
| 컨텍스트 길이 | 기본 262,144 토큰, YaRN 방식으로 약 100만 토큰까지 확장 가능 |
| 입력 방식 | 텍스트, 이미지, 비디오; 전환 가능한 사고(thinking) 모드 지원 |
| 라이선스 | Apache 2.0 (완전 오픈 웨이트) |
| 양자화 시 용량 | 약 17GB (4비트, 일반 GPU 구동 가능) |
이번 출시는 출시 전 몇 가지 궁금증을 해소해 주었다. 특히 깜짝 공개된 비전 인코더는 Qwen3.8-27B가 멀티모달 모델임을 확정지었고, Apache 2.0 라이선스 선택은 그간 중국 AI 모델의 기업 도입을 가로막았던 법적 걸림돌을 제거했다는 평가를 받는다.
알리바바는 허깅페이스 모델 카드를 통해 Qwen3.8-27B의 공식 벤치마크 성능을 공개했다. 아래 표는 27B 오픈 모델을 Meta의 Muse Glimmer-30B, 알리바바의 API 전용 모델 Qwen3.7-Plus, Anthropic의 Opus4.6 Max, 그리고 전 세대 모델인 Qwen3.6-27B와 비교한 결과다.
| 벤치마크 | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1 (터미널 코딩 에이전트) | 73.0 | 51.7 | 64.0 | 78.2 | 63.4 |
| SWE-bench Pro (소프트웨어 엔지니어링 에이전트) | 61.7 | — | 57.6 | — | 53.5 |
| CoWorkBench (사무/협업 에이전트) | 70.7 | — | 65.1 | — | — |
| LiveCodeBench v6 (경쟁 코딩) | 90.3 | — | 89.6 | 88.8 | 83.9 |
| IFBench (명령 수행) | 79.5 | 77.0 | 79.1 | 62.5 | 69.1 |
눈에 띄는 세 가지 결과:
전 세대 모델인 Qwen3.6-27B와 비교해서는 Terminal-Bench에서 약 15% 향상된 성능(73.0 vs 63.4)을 보여주며, SWE-bench Pro에서도 8점 가까이 점수가 올랐다.
Qwen3.8-27B의 출시는 알리바바의 전략적 변화를 시사한다. Qwen 패밀리는 자체 최고 성능 모델을 API 뒤에 숨기는 추세였으나, 4월 22일에 출시된 Qwen3.6-27B 이후 약 3개월 만에 다시 오픈 웨이트 모델을 내놓은 것이다. Apache 2.0 라이선스와 일반 소비자 하드웨어에서의 구동 가능성은 Qwen이 글로벌 명성을 쌓는 데 기여했던 오픈 웨이트 전략으로의 회귀를 의미한다.
이러한 움직임은 중국 AI 모델의 폭발적인 성장과 맞물려 있다. 2026년 중반 기준, 중국산 모델은 OpenRouter 플랫폼 토큰 사용량의 약 61%를 차지하며, 미국 모델의 점유율은 1년 만에 약 70%에서 30%로 급감했다. 또 다른 추정에 따르면, 2026년 7월까지 중국 오픈 웨이트 모델이 엔터프라이즈 API 토큰의 46%를 처리한 반면, 미국 모델은 35.7%에 그쳤다. 가트너(Gartner)는 오픈 웨이트의 가용성, 관대한 라이선스, 그리고 획기적으로 낮은 가격을 바탕으로 2년 내 전 세계 기업의 절반이 중국 AI 모델을 채택할 것이라고 예측했다.
실제로 미중 경제안보검토위원회(USCC)의 2026년 3월 보고서는 중국 AI의 광범위한 채택이 모델의 반복적 개선을 이끌고, 이는 다시 더 많은 채택을 낳는 '피드백 루프' 현상을 지적하며, 이러한 흐름이 미국 기업들 사이에서도 일어나고 있다고 분석했다. Qwen3.8-27B의 Apache 2.0 라이선스는 법적 부담을 없애 어떤 조직이든 추가 API 비용 없이 자체 서버에서 최첨단 멀티모달 AI 모델을 운영할 수 있게 해주어, 이 피드백 루프를 더욱 가속화할 전망이다.