Gemini 3.7 Flash는 2026년 8월 13일 출시된 구글의 코딩·에이전트용 고속 워크호스 모델이다. 2026년 12월 31일까지 API 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러이며, 2027년 1월 1일부터 각각 1.50달러와 7.50달러로 오른다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Gemini 3.7 Flash는 구글이 복잡한 코딩, 웹 개발, 도구 사용, 다단계 에이전트 작업을 겨냥해 내놓은 최신 ‘워크호스(workhorse)’ 모델이다. 2026년 8월 13일 출시됐으며, Gemini API와 Google AI Studio, Google Antigravity, Gemini Enterprise Agent Platform에서 사용할 수 있다.
이 모델의 핵심은 모든 지능 벤치마크에서 1위를 차지하는 데 있지 않다. 최첨단 모델에 가까운 성능을 유지하면서도 매우 빠르게 응답하고, 반복적인 에이전트 호출을 감당할 수 있을 만큼 저렴하게 제공한다는 조합이 더 큰 매력이다.
구글은 Gemini 3.7 Flash를 역대 가장 빠르게 성장하는 모델이라고 설명했다. 하지만 현재 제공된 자료에는 이 주장을 검증하는 데 필요한 수치가 없다. 구체적인 사용량 기준, 측정 기간, 활성 개발자 수, 토큰 처리량, 비교 대상 모델이 공개되지 않았기 때문이다.
따라서 확인 가능한 결론은 더 제한적이다. 구글이 Flash를 개발자들의 빠른 도입을 목표로 포지셔닝하고 있으며, 낮은 초기 가격과 여러 개발자 제품과의 연동이 이 전략을 뒷받침한다는 정도다. ‘가장 빠르게 성장한다’는 표현은 독립적으로 확인된 시장 통계라기보다, 아직 수치가 제시되지 않은 기업 주장으로 보는 편이 타당하다.
Gemini 3.7 Flash의 2026년 12월 31일까지 적용되는 초기 API 가격은 다음과 같다.
2027년 1월 1일부터 표준 가격은 입력 100만 토큰당 1.50달러, 출력 100만 토큰당 7.50달러로 변경된다. 두 가격 모두 초기 가격의 정확히 두 배다. 할인 또는 배치 방식의 요금도 입력·출력 기준 0.375달러·1.875달러에서 0.75달러·3.75달러로 오른다.
이 만료일은 실제 서비스 설계에서 중요하다. 출시 직후에는 매우 저렴해 보이는 작업이라도 장기간 운영할 계획이라면 2027년 요금 기준으로 다시 계산해야 한다.
다만 토큰 단가만으로 에이전트 운영비를 판단할 수는 없다. 실제 비용은 컨텍스트 길이, 도구 호출 횟수, 재시도, 캐시된 입력, 추론 수준, 출력량에 따라 달라진다. 특정 벤치마크에서 산출된 작업당 비용 역시 완성된 운영 환경의 최종 비용을 보장하지 않는다.
Artificial Analysis의 독립 평가에서 Gemini 3.7 Flash는 Intelligence Index 56점을 기록했다. 이는 Claude Sonnet 5의 55점보다 높지만, GPT-5.6 Terra의 57점보다는 1점 낮다.
가장 뚜렷한 차별점은 속도다. Artificial Analysis는 Gemini 3.7 Flash의 출력 속도를 약 초당 340토큰으로 측정했으며, 평균 작업 처리 시간 점수는 1.7로 집계했다. 최대 추론 설정의 GPT-5.6 Terra보다 약 40% 빠르다는 분석도 제시됐다.
물론 이 수치가 모든 애플리케이션에서 동일한 체감 속도를 의미하는 것은 아니다. 네트워크 상태, 제공업체의 라우팅, 프롬프트 크기, 외부 도구의 응답 시간, 추론 설정에 따라 전체 작업 완료 시간은 달라질 수 있다.
구글은 Gemini 3.6 Flash와 비교해 소프트웨어 엔지니어링, 디버깅, 이슈 해결, 웹 개발, 에이전트 워크플로에서 성능이 크게 향상됐다고 보고했다. 주요 코딩 관련 결과는 다음과 같다.
결과는 코딩과 터미널 에이전트 작업에서 충분히 경쟁력 있다는 점을 보여주지만, 모든 평가에서 1위라는 뜻은 아니다. 제공된 Terminal-Bench 결과에서는 GPT-5.6 Terra가 앞선다. Flash의 장점은 최고 점수 자체보다 빠른 응답과 낮은 초기 비용에 있다.
높은 추론 수준에서 ARC Prize가 보고한 Gemini 3.7 Flash의 결과는 다음과 같다.
특히 보고된 작업당 비용까지 고려하면 강한 비용 대비 성능을 보여주는 결과다. 그러나 ARC-AGI 점수는 소프트웨어 에이전트의 실제 신뢰성을 직접 예측하는 지표로 해석해서는 안 된다. 실제 에이전트는 여러 차례 모델을 호출하고, 외부 도구를 사용하며, 실패한 작업을 재시도하고, 벤치마크보다 훨씬 긴 컨텍스트를 처리할 수 있다.
이 표를 전체 모델 순위표로 받아들여서는 안 된다. 각 벤치마크는 서로 다른 평가에서 나온 결과이며, 모든 모델을 대상으로 한 단일 통제 시험은 아니다. 가격 역시 호스팅 방식, 할인, 제공 조건에 따라 달라질 수 있다.
제공된 비교 자료를 종합하면 구글의 포지셔닝은 분명하다. Gemini 3.7 Flash는 Intelligence Index에서 최첨단 수준에 근접하지만 최고 점수는 아니다. GPT-5.6 Terra가 57점으로 근소하게 앞서고, 구글이 제시한 Terminal-Bench 비교에서도 Terra가 더 높은 점수를 기록했다.
구글이 강조하는 것은 지능·지연 시간·비용 사이의 균형이다. 대화형 개발에 충분히 빠르고 반복 호출에도 부담이 적은 모델은, 좁은 벤치마크에서 더 높은 점수를 내지만 느리고 비싼 모델보다 에이전트 플랫폼에서 실용적일 수 있다.
이 차이는 코딩 보조, 자동 이슈 해결, 웹 개발 에이전트처럼 작업이 반복되는 환경에서 특히 중요하다. 에이전트는 컨텍스트를 읽고, 도구를 호출하고, 결과를 확인한 뒤 다시 시도하는 과정을 여러 번 수행하기 때문이다.
2026년 8월의 출시 경쟁도 이런 선택을 부각한다. Qwen3.8-Max는 에이전트와 소프트웨어 엔지니어링 영역에서 강한 경쟁자로 등장했고, GLM-5.3과 Nemotron 3.5 Lightning은 가격과 효율성을 밀어붙이고 있다. 한편 Claude Opus 5와 GPT-5.6은 고성능 영역을 겨냥한다.
Gemini 3.7 Flash는 ‘가장 똑똑한 모델’이라기보다 대량 처리에 적합한 고속 워크호스로 보는 것이 정확하다. Intelligence Index 56점, 초당 약 340토큰의 생성 속도, 준수한 코딩·터미널 에이전트 결과, 낮은 초기 가격의 조합이 이 모델의 가장 강한 근거다.
개발자가 가장 주의해야 할 부분은 기술 사양보다 비용 일정이다. 0.75달러·3.75달러의 초기 요금은 2026년 12월 31일 종료되며, 다음 날인 2027년 1월 1일부터 1.50달러·7.50달러의 표준 요금이 적용된다.
구글의 ‘가장 빠르게 성장하는 모델’이라는 주장이 향후 사실로 입증될 가능성은 열려 있다. 하지만 현재 공개된 자료가 뒷받침하는 결론은 더 좁다. 구글은 최고 지능 점수 경쟁보다 빠르고 저렴한 추론을 개발자용 기본값으로 만들어 반복적인 에이전트 사용을 확대하는 전략을 택하고 있다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
Gemini 3.7 Flash는 2026년 8월 13일 출시된 구글의 코딩·에이전트용 고속 워크호스 모델이다.
Gemini 3.7 Flash는 2026년 8월 13일 출시된 구글의 코딩·에이전트용 고속 워크호스 모델이다. 2026년 12월 31일까지 API 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러이며, 2027년 1월 1일부터 각각 1.50달러와 7.50달러로 오른다.
Artificial Analysis Intelligence Index 점수는 56점으로 GPT 5.6 Terra의 57점에는 못 미치지만, 약 340토큰/초의 출력 속도와 낮은 초기 가격이 핵심 경쟁력이다.