Gemini 3.8 Flash는 소프트웨어 엔지니어링, 에이전트 작업, 다단계 추론을 겨냥한 구글의 새 범용 모델이다. 도입 가격은 2026년 12월 31일까지 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did Google announce with the release of Gemini 3.8 Flash—its rapid recent cadence of Flash-model launches, agentic/software-development. Article summary: Google positioned Gemini 3.8 Flash as a low-priced “workhorse” that is much more capable at long-horizon software engineering, agentic workflows, and multi-step reasoning—not merely a faster lightweight model. It paired . Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
구글이 공개한 Gemini 3.8 Flash는 단순히 빠르고 저렴한 경량 모델을 표방하는 제품이 아니다. 소프트웨어 개발, 에이전트형 작업, 전문 영역의 복잡한 다단계 추론처럼 계획하고, 실행하고, 도구를 호출하며, 결과를 점검하는 긴 작업 흐름을 겨냥한 범용 모델이다. 동시에 구글은 취약점 탐지·자동 패치에 특화한 별도 모델을 일반 공개하지 않고, 제한 접근 프로그램인 Fairwind를 통해 신뢰받는 방어 조직에만 제공한다. 8
Gemini 3.8 Flash는 Gemini 3.7 Flash 공개 3주 뒤에 나왔다. 6주 사이 세 번째 Flash 계열 출시다. 구글은 3.8 Flash를 자사의 가장 지능적인 ‘워크호스(workhorse)’ 모델로 부르며, 3.7 Flash보다 소프트웨어 엔지니어링, 에이전트 작업, 핵심 다단계 추론 성능을 높였다고 설명했다. 3
8
개발팀 관점에서 핵심은 이 모델이 짧은 질의에 빠르게 답하는 용도에만 맞춰진 것이 아니라는 점이다. 코드베이스를 살피고, 작업을 계획하고, 도구를 반복 호출해 수정·검증하는 워크플로에 투입하려는 설계다. 코딩 보조 도구나 자율형 개발 에이전트의 기본 모델 후보가 될 수 있지만, 그만큼 실제 사용량과 총비용을 별도로 점검해야 한다.
API 도입 가격은 Gemini 3.7 Flash와 같다. 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러이며, 이 가격은 2026년 12월 31일까지 적용된다. 보도된 표준 가격은 2027년 1월 1일부터 입력 100만 토큰당 1.50달러, 출력 100만 토큰당 7.50달러다. 3
8
즉, 출시 초기 가격으로 진행한 평가 결과를 2027년 이후의 상시 운영 예산으로 그대로 환산해서는 안 된다.
더 오래 추론하고, 자신의 결과를 재검토하고, 도구를 여러 차례 호출하는 모델은 완료 작업 하나당 출력 토큰과 도구 사용량이 늘어날 수 있다. Artificial Analysis의 측정에 따르면 Gemini 3.8 Flash의 Intelligence Index 작업당 비용은 약 0.58달러로, Gemini 3.7 Flash의 0.40달러보다 높았다. 평균 출력 토큰 수도 증가했다. 25
32
따라서 복잡한 에이전트 루프에서는 낮은 토큰 단가만 보고 비용이 낮다고 판단하기 어렵다. 팀은 입력·출력 토큰 가격이 아니라 자체 저장소와 실제 업무 흐름에서의 작업 완료당 비용과 성공률을 함께 측정하는 편이 낫다. 품질 요건이 높지 않아 3.7 Flash로도 충분한 작업이라면, 두 모델의 도입 가격이 같은 기간에는 3.7 Flash를 라우팅 대상에 남겨 비용을 관리하는 선택지도 있다. 3
Artificial Analysis의 종합 Intelligence Index에서 Gemini 3.8 Flash는 고추론 설정 시 59점을 받았다. 이는 Gemini 3.7 Flash보다 3점 높은 수치이며, GPT-5.6 Sol의 엑스트라 하이 추론 설정 및 Grok 4.6의 미디엄 추론 설정과 같다. 같은 보도에서 GPT-5.6 Sol과 Grok 4.6은 더 높은 설정에서 61점, Claude Fable 5.1은 최고 설정에서 66점을 기록했다. 21
다만 이 수치를 모든 업무에 적용되는 절대 순위로 볼 수는 없다. 추론 강도 설정, 과제 구성, 지연 시간 제한, 도구 사용 정책, 토큰 예산에 따라 결과가 달라질 수 있기 때문이다.
| 모델 | 보도된 Intelligence Index 결과 | 주요 API 가격(입력/출력 100만 토큰당) |
|---|---|---|
| Gemini 3.8 Flash | 고추론 59 | 도입가 0.75달러 / 3.75달러, 표준가 1.50달러 / 7.50달러 |
| GPT-5.6 Sol | 엑스트라 하이 59, 최고 61 | 5달러 / 30달러 |
| Grok 4.6 | 미디엄 59, 고추론 61 | 2달러 / 6달러 |
| Claude Fable 5.1 | 최고 66 | 10달러 / 50달러 |
출시 시점의 Gemini 토큰 가격은 표에 제시된 경쟁 모델의 가격보다 상당히 낮다. 그러나 이것이 모든 워크로드에서 가장 싼 선택이라는 뜻은 아니다. 예를 들어 CursorBench에서는 Fable 5.1 Max가 Gemini 3.8 Flash High보다 높은 성공률을 기록한 반면, Gemini의 해당 벤치마크 실행 비용은 더 낮게 측정됐다. 30
결론적으로 모델 선택은 서비스 환경에 맞춰야 한다. 실제 운영에 필요한 추론 강도, 컨텍스트 길이, 도구 권한을 동일하게 맞춘 뒤 성공률·지연 시간·작업당 총비용을 비교하는 것이 적절하다.
구글은 범용 모델과 함께 Fairwind Program도 발표했다. 이는 정부, 신뢰할 수 있는 파트너, 우선순위가 높은 방어 조직을 위한 제한 접근 프로그램이다. 구글은 의료 서비스 제공자와 통신 서비스 등을 대상 사례로 제시했다. 5
14
Fairwind 참여자는 보안 특화 모델인 Gemini 3.8 Flash Cyber를 조기에 이용할 수 있다. 구글은 이 모델을 취약점 탐지와 자동 패치를 위한 모델이라고 설명한다. 여기에 코드 보안 에이전트인 CodeMender를 결합해 취약점 연구와 소프트웨어 수정 작업을 지원한다. 8
14
중요한 점은 Flash Cyber가 모든 API 고객에게 널리 공개된 모델이 아니라는 사실이다. 취약점 탐지와 수정 능력은 방어 역량을 높일 수 있지만 악용될 소지도 있는 이중용도 기능이다. 신뢰받는 방어 조직으로 접근을 제한한 것은 단순한 공급 일정이 아니라 제품의 안전 설계 일부로 볼 수 있다. 5
14
이번 출시는 구글의 두 갈래 전략을 드러낸다.
한편 구글의 차기 플래그십 모델 로드맵에는 불확실성도 남아 있다. 데미스 허사비스는 알파벳을 떠난 것이 아니라 Google DeepMind의 일상 운영 리더십에서 물러나 DeepMind 회장과 알파벳 최고과학자 역할을 맡았다. 별도로 Gemini 3.5 Pro가 6월 출시 예정이었다가 지연됐다는 보도도 나왔다. 33
이런 배경만으로 구글이 Flash 출시 주기를 빠르게 가져가는 이유를 단정할 수는 없다. 다만 현재 이용 가능한 제품 전략은 분명하다. Gemini 3.8 Flash는 성능과 비용을 함께 겨냥한 에이전트 모델을 전면에 내세우고, 더 민감한 사이버 기능은 제한된 프로그램으로 관리하는 방식이다.
Gemini 3.8 Flash는 저렴한 출시 토큰 가격으로 기존 경량 모델보다 강한 코딩·에이전트 추론을 원하는 팀에 매력적인 선택지다. 다만 GPT-5.6 Sol, Grok 4.6, Claude Fable 5.1을 일률적으로 앞선다는 의미는 아니다. 벤치마크 결과는 특정 추론 설정과 과제 조건의 결과다. 21
구매·도입 판단의 핵심은 긴 추론 과정과 반복 도구 호출을 포함한 실제 업무에서의 신뢰성과 작업당 총비용이다. Fairwind 대상 조직이라면 취약점 탐지와 수정에 쓰이는 Flash Cyber 및 CodeMender의 제한 제공이 이번 발표에서 더 중요한 변화일 수 있다. 14
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
Gemini 3.8 Flash는 소프트웨어 엔지니어링, 에이전트 작업, 다단계 추론을 겨냥한 구글의 새 범용 모델이다. 도입 가격은 2026년 12월 31일까지 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러다.
Gemini 3.8 Flash는 소프트웨어 엔지니어링, 에이전트 작업, 다단계 추론을 겨냥한 구글의 새 범용 모델이다. 도입 가격은 2026년 12월 31일까지 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러다. Artificial Analysis Intelligence Index에서 고추론 설정 기준 59점을 기록했다. GPT 5.6 Sol의 엑스트라 하이 설정, Grok 4.6의 미디엄 설정과 같지만 Claude Fable 5.1의 최고 설정 66점에는 못 미쳤다.
Fairwind는 정부·의료·통신 등 우선순위 방어 조직과 신뢰할 수 있는 파트너에 Gemini 3.8 Flash Cyber 및 CodeMender를 조기 제공하는 제한 접근 프로그램이다.