| 딥시크 (DeepSeek) | V4-Flash / V4-Pro | 2026년 6~8월 | V4-Flash: 입력 100만 토큰당 $0.14; V4-Pro: 6월 가격 인하 후 $0.435 |
| 알리바바 (Alibaba) | Qwen 3.7 Max / Plus / Flash | 2026년 5~6월 | 2.8T(2조 8000억) 파라미터 MoE 플래그십; Qwen3.7 Max: 입력/출력 100만 토큰당 $1.25/$3.75; Qwen3.6 Flash: $0.19/$1.13 |
| 문샷 AI (Moonshot AI) | Kimi K3 | 2026년 7월 16일 | 2.8T(2조 8000억) 총 파라미터, 약 50B 활성 파라미터, 100만 컨텍스트; 7월 27일 전체 오픈소스 공개 약속 |
| Z.ai | Fable 5 경쟁 모델 | 2026년 6월 말 | 앤트로픽이 미국 정부 요청으로 두 개의 고급 모델을 중단한 직후 출시 |
비용 차이는 극심합니다. 딥시크의 V4-Flash는 입력 토큰 100만 개당 0.14달러를 청구하는데, 이는 앤트로픽(Anthropic)의 클로드 페이블 5(Claude Fable 5)를 실행하는 것보다 100배 이상 저렴합니다 . 알리바바의 Qwen3.6 Flash는 입력 100만 개당 0.19달러인 반면, GPT-5.5 및 클로드 오푸스 4.8(Claude Opus 4.8)과 같은 미국 최첨단 모델은 비슷한 성능 수준에서 약 7~12배 더 비쌉니다 . 문샷의 K3는 프론티어급 모델로, API 가격이 입력 100만 개당 3달러, 출력 100만 개당 15달러이며, 자체 호스팅을 위한 오픈 가중치(open weights)는 무료로 제공될 예정입니다 .