2026년 8월 초, 엔터프라이즈 AI 추론 비용이 백만 토큰당 평균 1.16 1.18달러로 2026년 최저치를 기록했습니다. 이는 5월 31일 2.04달러 대비 43% 하락한 수치입니다. 이 같은 급락은 OpenAI의 최대 80% 가격 인하, 딥시크 V4 Flash(백만 토큰당 입력 0.14달러/출력 0.28달러) 출시, 앤트로픽 클로드 오퍼스 5 출시 등 글로벌 AI 기업들의 치열한 가격 경쟁이 주도했습니다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: What caused enterprise AI inference costs to hit their lowest level in 2026 in early August, and what specific price data, trends, and compe. Article summary: Enterprise AI inference costs hit a 2026 low in early August, averaging **$1.16–$1.18 per million tokens** — a ~43% drop from $2.04 on May 31 — driven by an intensifying global price war, OpenAI's steep cuts, and the sur. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
2026년 8월 초, 글로벌 엔터프라이즈 AI 시장에 큰 변화가 일어났습니다. 기업이 AI 모델을 운영하는 데 드는 추론(inference) 비용이 2026년 들어 최저 수준으로 떨어진 것입니다. 투자은행 제프리스(Jefferies)와 시장 조사 업체 실리콘데이터(Silicon Data)의 지수에 따르면, 지난 5월 31일 백만 토큰당 2.04달러였던 평균 비용이 8월 6일부터 8일 사이에는 1.16~1.18달러로 약 43% 폭락했습니다 .
이번 가격 하락의 배경에는 OpenAI, 딥시크, 앤트로픽 등 주요 AI 기업들이 벌이고 있는 치열한 'AI 가격 전쟁' 과 중국발 저가 오픈소스(open-weight) 모델의 급부상이 자리 잡고 있습니다 .
제프리스(Jefferies) 리서치 — 이 투자은행은 2026년 8월 10일 보고서를 통해 엔터프라이즈 AI 추론 가격이 연중 최저치를 기록했다고 밝혔습니다. SCMP가 인용한 데이터에 따르면, 8월 6일부터 8일까지의 평균 가격은 백만 토큰당 1.16~1.18달러였습니다 . 이는 5월 31일 기록된 2.04달러 대비 약 43% 하락한 수치입니다
.
실리콘데이터의 LLM 토큰 지출 지수 — 이 지수는 6월 초 백만 토큰당 2달러 이상에서 8월 첫째 주 1.20달러로 약 40% 하락한 것으로 나타났습니다 . 7월 27일 스냅샷은 1.43달러였으며, 이는 지속적인 하락세를 확인시켜 줍니다
. 실리콘데이터는 중국의 오픈소스(open-weight) 모델이 지수 평균을 끌어내리는 주요 요인이라고 직접 지목했습니다
.
OpenAI는 인프라 효율성 개선을 이유로 API 가격을 최대 80% 인하했습니다. CNBC와 포브스는 이 조치가 AI 가격 전쟁을 격화시킨다고 평가했습니다 .
OpenAI는 커널 재작성 및 추측 디코딩(speculative decoding)과 같은 내부 최적화를 통해 추론 작업에서 20-35%의 효율성 개선을 달성했다고 밝혔습니다 .
2026년 7월 31일, 딥시크는 퍼블릭 베타 버전인 V4-Flash-0731을 출시했습니다. 가격은 다음과 같습니다:
프리미엄 모델의 약 10분의 1 가격인 딥시크 V4 Flash는 시장의 최저 가격 기준을 설정하며 전반적인 시장 압축을 강제했습니다. 벤치마킹 업체 아티피셜 애널리시스(Artificial Analysis)에 따르면 V4 Flash의 작업당 추정 비용은 약 3센트에 불과합니다 . 특히 이 모델은 딥시크 자체의 V4 Pro 프리뷰보다 모든 에이전트 벤치마크에서 더 뛰어난 성능을 보이면서도 출력 가격은 3분의 1에 불과합니다
.
오퍼스 5는 입력 백만 토큰당 5달러 / 출력 25달러로 이전 모델 오퍼스 4.8과 동일한 가격에 출시되었습니다. 고속 모드는 기본 가격의 2배(입력 10달러/출력 50달러)입니다 . 오퍼스 5는 자체적으로 가격을 인하하지는 않았지만, 플래그십 모델인 페이블 5(Fable 5)에 가까운 성능을 절반 가격에 제공하면서 경쟁사에 압력을 가하고 기업들의 저비용 선택지를 확대했습니다
.
오픈AI의 80% 할인(7월 30일), 딥시크의 0.30달러 미만 플래시 가격(7월 31일), 앤트로픽의 경쟁력 있는 오퍼스 5 출시(7월 24일), 그리고 중국발 저비용 오픈소스 모델의 광범위한 기업 채택이 결합되어 시장 지수는 5월 말 2.04달러에서 8월 초 1.16~1.18달러로 10주 만에 43% 하락했습니다 .
토마스 총(Thomas Chong)이 이끄는 제프리스 애널리스트들은 이러한 하락의 원인을 '치열해진 글로벌 가격 전쟁' 과 '저렴한 중국 오픈소스 모델의 채택 급증' 이라고 분석했습니다 . 시장 반응은 가격에만 국한되지 않았습니다. 제프리스는 토큰 비용 하락이 AI 수요와 인프라 투자를 오히려 촉진할 수 있다고 주장했습니다
.
실리콘데이터의 공개 지수는 7월 27일에 1.43달러를 기록한 반면, 8월 초에는 1.20달러로 보고되어 7월 말/8월 초에 오픈AI와 딥시크 발표로 인한 급격한 가속이 있었음을 시사합니다 . 다만 이 지수는 가격과 사용량을 혼합한 블렌드(blended) 지표이기 때문에, 하락이 단순히 정가 인하를 반영하는 것인지, 아니면 수요가 더 저렴한 모델로 이동했기 때문인지 구분하기 어렵습니다. 실리콘데이터 자체적으로도 이 지수를 순수 가격표로 읽지 말라고 경고한 바 있습니다
.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
2026년 8월 초, 엔터프라이즈 AI 추론 비용이 백만 토큰당 평균 1.16 1.18달러로 2026년 최저치를 기록했습니다. 이는 5월 31일 2.04달러 대비 43% 하락한 수치입니다.
2026년 8월 초, 엔터프라이즈 AI 추론 비용이 백만 토큰당 평균 1.16 1.18달러로 2026년 최저치를 기록했습니다. 이는 5월 31일 2.04달러 대비 43% 하락한 수치입니다. 이 같은 급락은 OpenAI의 최대 80% 가격 인하, 딥시크 V4 Flash(백만 토큰당 입력 0.14달러/출력 0.28달러) 출시, 앤트로픽 클로드 오퍼스 5 출시 등 글로벌 AI 기업들의 치열한 가격 경쟁이 주도했습니다.
투자은행 제프리스와 실리콘데이터의 지수는 중국발 저가 오픈소스 모델의 확산이 시장 평균 가격을 끌어내리는 주요 요인이라고 분석했습니다.