| {{{#!wiki style="margin:-0px -10px -5px" {{{#!folding [ 펼치기 · 접기 ] {{{#!wiki style="margin:-5px -1px -11px; word-break:keep-all" | OpenAI | GPT (1 · 2 · 3 · 4.x · 5.x · 6개발 중) GPT-OSS (20B · 120B) OpenAI (o1 · o3 · o4) |
| 구글 | Gemini (1 · 1.5 · 2 · 2.5 · 3 · 3.1 · 3.5 · 3.6 · 3.7) Gemma · LaMDA · PaLM 2 | |
| Anthropic | Claude (Fable · Opus · Sonnet · Haiku) | |
| xAI | Grok | |
| 메타 | LLaMA · Muse Spark | |
| HyperCLOVA(네이버) · 카나나(카카오) · 삼성 가우스(삼성전자) · 엑사원(LG AI연구원) · 믿:음(KT) · A.X(SK텔레콤) · Solar(업스테이지) · Motif(모티프) | ||
| Hunyuan · DeepSeek(딥시크) · Qwen · MiniMax(미니맥스 그룹) · GLM(Z.ai) · Xiaomi MiMo(샤오미) · Kimi(Moonshot AI) | ||
| NVIDIA Nemotron(NVIDIA) · Phi(Microsoft) · Apple Foundation Models · OpenELM(Apple) | }}}}}}}}} |
| | |||
| {{{#!wiki style="margin:0 -10px -5px; min-height:calc(1.5em + 5px)" {{{#!folding [ 펼치기 · 접기 ] {{{#!wiki style="margin:-5px -1px -11px" | <colbgcolor=#4285F4,#4285F4> 모델 | 1.0 · 1.5 · 2.0 · 2.5 · 3.0 · 3.1 · 3.5 · 3.6 · 3.7 · 나노 바나나 · Veo · Omni | |
| 서비스 | Gemini 앱 · Gemini Live · Gemini Notebook | ||
| 에이전트 | }}}}}}}}} | ||
| <colbgcolor=#4285F4><colcolor=#fff> Gemini 3.7 | |
| 출시일 | 2026년 8월 13일[1] |
| 제작사 | 구글 |
| 기능 | 언어 모델 |
| 링크 | |
1. 개요
구글이 개발한 Gemini 인공지능 모델.3.6 Flash 출시 3주 만에 공개됐으며, 공식 블로그 게시물 한 편으로 조용히 발표됐다. 이번에도 Pro 모델은 포함되지 않았고 Flash 단일 모델만 공개되었다.
==# 공개 전 정보 #==
Gemini 3.6 Flash가 2026년 7월 21일 조용히 출시된 지 3주밖에 지나지 않은 시점이었기 때문에, 후속 Flash 모델을 예상한 사람은 사실상 없었다. 당시 여론의 관심은 Google I/O 2026에서 6월 출시가 예고된 뒤 수개월째 나오지 않고 있는 Pro 모델에 쏠려 있었고, "8월 안에 신모델이 나오지 않으면 중국의 오픈웨이트 모델들에게마저 밀리는 것 아니냐"는 우려까지 나오던 상황이었다.
그런 와중에 2026년 8월 13일(한국시간 14일 새벽) 기습적으로 공개된 것이 Gemini 3.7 Flash다. 다만 기다리던 Pro가 아니라 또 Flash였다는 점에서, 발표 직후 반응은 성능보다는 가격과 Pro는 대체 언제 나오냐는 쪽으로 쏠렸다.
2. 모델
2.1. Gemini 3.7 Flash
2026년 8월 14일에 예고도 없이 공개됐다.구글에 따르면 새로 학습한 모델이 아니라 Gemini 3.6 Flash의 추론 알고리즘을 개선한 버전이다. 구글은 이를 "개발자 피드백과 알고리즘 혁신의 직접적인 결과"라고 설명했다. 즉 아키텍처는 그대로 두고 모델의 행동을 손본 릴리스에 가깝다.
텍스트·이미지·오디오·동영상을 입력으로 받으며 컨텍스트 창은 100만 토큰, 출력은 최대 6.4만 토큰으로 3.6 Flash와 동일하다. 지식 컷오프는 정식으로 2026년 3월로 책정되었다.
구글이 내세우는 개선점은 다음과 같다.
- 막다른 상황에 더 잘 적응하고, 필요할 때 사용자 의도를 되묻는다.
- 지시를 더 충실히 따른다.
- 멀티스텝 계획 수립과 툴 호출에 더 많은 노력을 들인다.
- 결과적으로 수동 감독과 재시도 횟수가 줄어든다.
전반적으로 단발성 대화 품질보다는 에이전트 루프를 실제로 굴리는 개발자를 노린 릴리스다.
2.1.1. 성능
구글이 발표한 3.6 Flash 대비 벤치마크 수치는 다음과 같다.코딩 계열도 올랐지만, 상승폭 자체는 문서 이해(GDP.pdf)와 업무 자동화(AutomationBench) 쪽이 훨씬 크다. 각각 1.5배, 1.8배 수준으로 뛰었다. 웹 개발에서는 스크린샷·이미지·디자인 시스템 등 참조 입력을 줬을 때의 디자인 재현도가 높아졌다는 점을 강조했다.
참고로 어디까지나 구글이 자체 발표한 수치이며, Gemini 3.5 문서에서도 지적됐듯 AI 모델에서 벤치마크는 객관적이고 무조건 신뢰할 만한 통계가 아니라는 점을 감안해야 한다. 일부 평가의 출처는 발표문에서 독립적으로 명시되지 않았다.
2.1.2. 가격
이 모델의 가장 큰 화제는 성능이 아니라 가격이다.| <rowcolor=#fff> 구분(100만 토큰당) | 프로모션가 (~2026.12.31.) | 정가 (2027.1.1.~) |
| 입력 | $0.75 | $1.50 |
| 출력(사고 토큰 포함) | $3.75 | $7.50 |
| 컨텍스트 캐시 | $0.075 | $0.15 |
| 캐시 저장(시간당) | $0.50 | $1.00 |
| Batch·Flex 입력/출력 | $0.375 / $1.875 | $0.75 / $3.75 |
| Priority 입력/출력 | $1.35 / $6.75 | $2.70 / $13.50 |
구글 검색 그라운딩은 Gemini 3.x 전 모델이 공유하는 월 5,000회 무료 한도 이후 1,000건당 $14이며, 무료 등급도 제공된다.
여기서 더 눈에 띄는 것은 '이 인하 요율을 3.6 Flash에도 그대로 적용했다는 점이다. 즉 기존에 $1.50/$7.50이던 3.6 Flash도 2026년 12월 31일까지 $0.75/$3.75로 함께 반값이 되었다. 이미 3.6으로 마이그레이션을 마친 개발자도 코드를 건드리지 않고 원가가 절반이 되는 셈이다.
Gemini 3.5 Flash가 전작 대비 가격을 3배 올려 "Flash라는 이름값을 못 한다"는 혹평을 들었던 것을 생각하면 완전히 정반대의 행보다. 3.5 Flash($1.50/$9.00)와 비교하면 입력은 절반, 출력은 약 2.4분의 1 수준이다. 다만 어디까지나 한시적 프로모션이며, 2027년 1월 1일부터는 정확히 2배로 오른다는 점이 문서화되어 있다.
2.1.3. 사양 및 API 변경점
사고 수준(`thinking_level`)은 LOW / MEDIUM(기본값) / HIGH의 3단계를 지원한다.- Low: 실시간 채팅, 초안 작성, 빠른 데이터 분석, 장애 대응 파이프라인 등 응답 지연이 중요한 작업용.
- Medium(기본): 대부분의 작업에 권장. 복잡한 코드와 에이전트 용도에서 첫 시도 정확도가 높다.
- High: 어려운 수학, 최고 난도 코딩·에이전트 작업용.
주의할 점은 3.7 Flash에서 `MINIMAL`이 삭제되었다. 명시적으로 `thinking_level="MINIMAL"`을 지정하면 API 검증 오류를 반환한다. 3.6 Flash까지는 사용 가능하던 값이므로, 초저지연 용도로 MINIMAL을 쓰던 파이프라인은 모델 문자열만 바꿔서는 그대로 깨진다.
그 외 Gemini 3.x 공통 사항은 3.6 Flash와 동일하게 적용된다.
- `temperature`, `top_p`, `top_k`는 deprecated 상태로 무시되며, 차기 세대부터는 HTTP 400을 반환한다.
- 마지막 턴이 비어있지 않은 `model` 롤인 프리필은 금지(400).
- `candidate_count` 미지원, `thinking_budget`은 `thinking_level`로 대체.
2.1.4. 이용 가능한 곳
- 개발자: Google AI Studio, Gemini API, Antigravity, Android Studio
- 기업: Gemini Enterprise Agent Platform, Gemini Enterprise 앱
- 일반 사용자: Gemini 앱의 Spark. Google I/O 2026에서 공개된 24시간 상시 개인 에이전트로, Google AI Pro 및 Ultra 구독자에게 160개국 이상에서 제공된다.[2] 출시 당일부터 Spark의 구동 모델이 3.7 Flash로 교체됐으며, 구글은 워크스페이스 앱 툴 사용 정확도가 개선됐다고 밝혔다. 현재 Google AI Pro 이상 사용자만 Gemini 앱을 통해 사용이 가능하다.[3]
2.1.5. 안전성
구글의 Frontier Safety 프레임워크에 따라 화학·생물학·방사능·핵(CBRN) 및 사이버 공격 영역의 오용 방지 세이프가드가 갱신된 상태로 출시되었다. 구글은 유익한 사용 사례는 열어두면서 오용만 차단하는 방향이라고 설명했다.3. 평가
가격 인하가 사실상 릴리스의 본체라는 평가가 지배적이다. 3.5 Flash의 3배 인상 → 3.6 Flash의 출력가 소폭 인하 → 3.7 Flash의 반값이라는 흐름은, 구글이 DeepSeek를 비롯한 저비용 모델에게 API 점유율을 잠식당한 상황을 의식했다는 해석으로 이어진다. 이미 나온 3.6 Flash까지 소급해서 같이 내려준 것도 같은 맥락으로 읽힌다.반면 모델 자체에 대해서는 세대교체가 아니라 튜닝판이라는 시각이 많다. 새 사전학습이 없고,[4] 컨텍스트·출력 한도도 동일하다. 3주 만에 소수점 자릿수를 올린 것을 두고 버전 인플레이션이라는 지적도 나온다.
아쉬운 점은 0.1 단위의 업그레이드라 학습이 부족했는지 아니면 Flash 자체의 한계인지 직전 버전이 갖고 있던 문제점(맥락 파악, 외국어 섞임, 서브컬쳐 환각 등)은 여전히 해결되지 않았다. 역시 가장 크게 남는 문제는 Pro의 부재다. 공식 가격표 기준으로 Pro 라인의 최신 모델은 아직도 Gemini 3.1 Pro Preview이며, 2026년 5월 Google I/O 2026에서 6월 출시가 예고되었던 3.5 Pro는 8월 중순까지도 공개되지 않았다. 그 사이 Flash 라인만 3.5 → 3.6 → 3.7로 세 번 올라가면서, 정작 Pro가 나올 때 어떤 번호를 달게 될지조차 불투명해졌다는 넘버링 혼선 지적이 계속되고 있다.
의외의 단점으로는 가격 인하를 위해 서버 연산 비중을 낮췄는지 추론 중 로컬 컨텍스트로 전환되는 순간의 배터리 소모량이 무지막지해졌다. 전작에서는 카메라 구동 시랑 엇비슷한 수준이었다면, 3.7 Flash에서는 로컬 추론 시 카메라의 배터리 소모량을 가볍게 뛰어넘고 4K 녹화 시의 배터리 소모량과 맞먹는다.[5]
4. 여담
- 3.6 Flash 출시 3주 만의 후속 모델이다. Gemini 시리즈 역사상 가장 짧은 간격의 넘버링 갱신이다.
- 프로모션 종료일이 2026년 12월 31일로 못 박혀 있어, 2027년 1월 1일부터는 입력·출력 모두 정확히 2배가 된다. 장기 계약이나 원가 산정 시 주의가 필요하다.
- MINIMAL 사고 수준이 사라지면서, 극단적인 저지연·고처리량 용도는 Gemini 3.5 Flash-Lite 계열로 내려가야 한다.
- 구글은 발표 자료에서 Nano Banana와의 조합으로 텍스트 프롬프트만으로 3D 게임을 생성하거나, Gemini Omni와 함께 서브에이전트를 오케스트레이션해 인터랙티브 랜딩 페이지를 한 번에 만드는 데모를 함께 공개했다.
- 3.6 Flash가 맡고 있던 Gemini Managed Agents의 Antigravity 에이전트 기본 모델 자리도 자연스럽게 승계될 것으로 보인다.