# Gemini 3.6 Flash 출시 — 무엇이 달라졌나

> Google DeepMind가 7월 21일 워크호스 모델 Gemini 3.6 Flash와 3.5 Flash-Lite, 3.5 Flash Cyber를 함께 공개했습니다. 토큰 효율·코딩 정밀도·가격이 어떻게 바뀌었는지 공식 발표와 모델 카드 기준으로 정리했습니다.

- 출처 사이트: AI피셜 (https://aifficial.net/posts/gemini-3-6-flash-launch/)
- 발행: 2026-07-22
- 카테고리: 모델 · 태그: Gemini, Google DeepMind, 모델 출시, 가격, 벤치마크

## 핵심 답변

Google은 2026년 7월 21일 Gemini 3.6 Flash와 3.5 Flash-Lite, 3.5 Flash Cyber를 함께 공개했습니다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 최대 17% 덜 쓰면서 코딩·지식노동 성능이 올라갔고, 가격은 입력 100만 토큰당 $1.50, 출력 $7.50입니다.

## 요약

- Gemini 3.6 Flash는 3.5 Flash 대비 출력 토큰을 최대 17% 덜 쓰면서 코딩·지식노동·멀티모달 성능이 올라간 후속 워크호스 모델입니다.
- 가격은 입력 100만 토큰당 $1.50, 출력 $7.50이고, 컨텍스트 100만 토큰·출력 최대 64K·지식 컷오프 2026년 3월입니다.
- 같은 날 저비용 모델 3.5 Flash-Lite($0.30/$2.50)와 정부·파트너 한정 보안 특화 3.5 Flash Cyber도 나왔습니다.
- 플래그십 3.5 Pro는 아직 파트너 테스트 단계이며, Gemini 4 사전학습이 시작됐다고 Google 측이 밝혔습니다.

## 핵심 사실

| 항목 | 값 |
|---|---|
| 발표일 | 2026-07-21 (Google 공식 블로그) |
| 가격 (3.6 Flash) | $1.50 / $7.50 (입력 / 출력, 100만 토큰당) |
| 가격 (3.5 Flash-Lite) | $0.30 / $2.50 (입력 / 출력, 100만 토큰당) |
| 출력 토큰 절감 | 최대 17% (3.5 Flash 대비, Artificial Analysis Index 기준) |
| 컨텍스트 / 최대 출력 | 100만 / 64K 토큰 (지식 컷오프 2026년 3월) |
| DeepSWE 코딩 정밀도 | 49% (3.5 Flash 37%) |


## 무슨 일인가요

2026년 7월 21일, Google은 Gemini 라인업의 "워크호스" 모델인 **Gemini 3.6 Flash**와 함께 **Gemini 3.5 Flash-Lite**, **Gemini 3.5 Flash Cyber** 세 모델을 동시에 발표했습니다.  발표문은 제품 관리 시니어 디렉터 Tulsee Doshi 명의로 올라왔고, 세 모델 모두 "효율과 품질의 균형점"에서 에이전트 워크플로를 대규모로 돌리는 개발자를 겨냥한다고 설명합니다. 



Google의 7월 월간 AI 업데이트 모음에서도 이 세 모델은 "프로덕션 AI 에이전트를 만드는 개발자와 고객"을 위해 "더 높은 토큰 효율, 더 낮은 지연, 더 안정적인 성능"을 목표로 설계됐다고 소개됩니다.  요약하면 이번 세대의 주인공은 최고 성능이 아니라 운영 비용입니다. 

눈에 띄는 점은 번호 체계입니다. 플래그십인 3.5 Pro가 아직 나오지 않은 상태에서 Flash만 3.6으로 먼저 올라갔습니다. TechCrunch는 Pro 모델의 마지막 업데이트가 2026년 2월이었다고 짚었습니다.  결과적으로 Flash 계열은 3.6, Flash-Lite와 Cyber는 3.5, Pro는 여전히 3.x 이전 세대라는 다소 복잡한 라인업이 됐습니다. 


Gemini 3.6 Flash는 "코딩, 지식노동, 멀티모달 성능을 높이면서 Gemini 3.5 Flash보다 토큰 효율이 좋은 워크호스 모델"입니다. 모델 카드 기준 입력은 텍스트·이미지·오디오·비디오, 컨텍스트 창은 100만 토큰, 출력은 최대 64K 토큰이며 지식 컷오프는 대부분 영역에서 2026년 3월입니다. 


## 숫자로 보는 3.6 Flash








Google이 발표문에서 제시한 3.5 Flash 대비 개선 수치는 아래와 같습니다. 

| 벤치마크 | Gemini 3.6 Flash | Gemini 3.5 Flash |
| --- | --- | --- |
| DeepSWE (코딩 정밀도) | 49% | 37% |
| MLE Bench (ML 연구) | 63.9% | 49.7% |
| OSWorld-Verified (컴퓨터 사용) | 83.0% | 78.4% |
| GDPval-AA v2 (지식노동, Elo) | 1421 | 1349 |

Google은 DeepSWE에서 최대 65%의 효율 개선이 있었다고도 적었는데, 정답률이 아니라 "불필요한 코드 편집과 실행 루프가 줄어 정밀도가 올라갔다"는 설명이 붙어 있습니다.  에이전트가 같은 과제를 풀기 위해 도는 횟수 자체가 줄었다는 의미로, 토큰 절감 수치와 같은 방향의 지표입니다. 

### 경쟁 모델과 비교하면

모델 카드에는 타사 모델과의 비교도 실려 있습니다. SWE-Bench Pro는 58.7%로 Grok 4.5(64.7%)에 뒤지고, MLE-Bench는 63.9%로 Claude Sonnet 5(66.9%)에 못 미치지만, 도구를 쓴 CharXiv는 89.4%로 Sonnet 5(88.3%)를 근소하게 앞섭니다.  즉 "동급 최강"보다는 "가격 대비 균형"이 이 모델의 자리라고 읽는 편이 정확합니다. 

## 함께 나온 두 모델


<div>

**가장 저렴한 등급**

- 가격은 입력 $0.30, 출력 $2.50 (100만 토큰당)
- Artificial Analysis 기준 초당 350 출력 토큰
- Terminal-Bench 2.1 54% (3.1 Flash-Lite 31%), SWE-Bench Pro 54.2% (3 Flash 49.6%)
- Gemini API·AI Studio·Android Studio·Gemini 앱에 제공, Google 검색에도 순차 적용

</div>
<div>

**보안 취약점 탐지·수정 특화**

- 취약점을 찾고 고치는 작업에 맞춰 조정된 모델
- CyberGym에서 프론티어급 경쟁력을 보였다고 발표
- 정부·신뢰 파트너 대상 제한 접근 파일럿으로만 제공 (CodeMender 경유)
- 일반 개발자는 당장 쓸 수 없음

</div>


Flash-Lite와 Flash Cyber의 위 수치와 제공 범위는 모두 Google 발표문 기준입니다. 

## 어디서 쓸 수 있나요

3.6 Flash는 발표 당일부터 Gemini API(Google AI Studio·Android Studio), Google Antigravity, Gemini Enterprise Agent Platform, 그리고 소비자용 Gemini 앱에서 제공됩니다.  9to5Google은 3.6 Flash와 3.5 Flash-Lite가 같은 날 Gemini 앱에 반영됐다고 확인했습니다. 

Flash-Lite는 여기에 더해 Google 검색에도 순차 적용되며, Flash Cyber만 CodeMender를 통한 제한 접근 파일럿으로 정부와 신뢰 파트너에게 제공됩니다.  발표문에는 Figma, Harvey, Hebbia, JetBrains, Palo Alto Networks, Ramp 등 초기 파트너의 평가가 이미지로 실려 있는데, 이 글에서는 본문 텍스트로 확인되지 않아 인용하지 않았습니다.

안전 측면에서는 CBRN(화생방·핵)과 사이버 공격 오용 영역을 겨냥한 "강화된 프론티어 안전장치"와 탈옥 저항성이 적용됐다고 합니다.  모델 카드에는 아동 안전 관련 레드팀 결과와, 전작 대비 다국어 안전성 지표 변화도 기록돼 있습니다. 

## 3.5 Pro와 Gemini 4는?

이번 발표에서 빠진 것이 플래그십입니다. Google DeepMind 제품 리드 Logan Kilpatrick은 3.5 Pro를 "파트너와 테스트 중이며 곧 내놓기를 바란다"고 했고, 팀이 Gemini 4를 위한 "역대 가장 야심 찬 사전학습"을 시작했다고 밝혔습니다.  9to5Google도 3.5 Pro의 광범위 제공 시점을 "준비되는 대로"라고 전했습니다. 


일부 2차 매체는 전작 3.5 Flash의 출력 가격을 100만 토큰당 $9로 표기하며 인하 폭을 계산하지만, 이 글에서 직접 확인한 Google 공식 페이지에는 전작 가격이 명시돼 있지 않았습니다. "전작보다 저렴하다"는 표현까지만 공식·보도로 확인됩니다.


## 그래서 무엇을 보면 되나요

이번 발표는 새 능력을 여는 출시라기보다 기존 워크로드의 단가를 낮추는 출시에 가깝습니다. 실무자가 확인할 순서를 정리하면 다음과 같습니다. 



같은 작업에서 출력 토큰이 얼마나 줄어드는지 먼저 재보세요. Google이 내세운 핵심 지표가 성능 자체보다 토큰 효율입니다.


DeepSWE 개선의 설명이 "불필요한 편집과 실행 루프 감소"였으므로, 정답률보다 시도 횟수와 비용을 함께 보는 것이 발표 취지에 맞습니다.


$0.30/$2.50 가격과 초당 350 토큰 속도는 단순 반복 작업에 맞춰진 스펙입니다. 3.6 Flash와 나눠 쓰는 라우팅을 고려해 보세요.


3.5 Pro는 아직 파트너 테스트 단계라, 어려운 추론 작업의 기준 모델은 당분간 바뀌지 않습니다.




Flash가 Pro보다 먼저 3.6으로 넘어간 것은, Google이 지금 가장 신경 쓰는 경쟁 지점이 "가장 똑똑한 모델"이 아니라 "에이전트가 하루 종일 돌려도 감당되는 단가"라는 뜻으로 읽힙니다. 모델 카드가 SWE-Bench Pro와 MLE-Bench에서 경쟁사에 뒤지는 수치를 그대로 실은 점도 같은 맥락입니다. 실무자 입장에서는 벤치마크 순위표보다 자기 워크로드에서의 토큰당 결과물을 재는 것이 이번 세대의 올바른 평가 방법이라고 봅니다. 



이 글은 2026년 7월 21일 Google 공식 발표문과 Google DeepMind 모델 카드, TechCrunch·9to5Google 보도를 바탕으로 정리한 비공식 요약입니다. 가격·제공 범위는 변경될 수 있으니 최신 정보는 원문을 확인해 주세요.



## 자주 묻는 질문

**Q. Gemini 3.6 Flash는 전작 3.5 Flash와 무엇이 다른가요?**

Artificial Analysis Index 기준 출력 토큰을 최대 17% 덜 쓰면서 DeepSWE 49%(전작 37%), MLE Bench 63.9%(49.7%), OSWorld-Verified 83.0%(78.4%)로 성능이 올랐습니다. Google은 불필요한 코드 수정과 실행 루프가 줄어든 결과라고 설명합니다.

**Q. Gemini 3.6 Flash는 어디서 쓸 수 있나요?**

발표 당일부터 Gemini API(Google AI Studio·Android Studio), Google Antigravity, Gemini Enterprise Agent Platform, 소비자용 Gemini 앱에서 제공됩니다. 보안 특화 3.5 Flash Cyber만 정부·신뢰 파트너 대상 제한 접근 파일럿으로 제공됩니다.

**Q. Gemini 3.5 Pro는 언제 나오나요?**

이번 발표에는 포함되지 않았습니다. Google DeepMind의 Logan Kilpatrick은 3.5 Pro를 파트너와 테스트 중이라고 밝혔고, Gemini 4 사전학습이 시작됐다고 전했습니다.

## 출처

1. [Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber (Google 블로그)](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/) (official)
2. [Gemini 3.6 Flash 모델 카드 (Google DeepMind)](https://deepmind.google/models/model-cards/gemini-3-6-flash/) (official)
3. [Google AI announcements from July 2026 (Google 블로그)](https://blog.google/innovation-and-ai/technology/ai/google-ai-updates-july-2026/) (official)
4. [Google releases three new Gemini models — but no 3.5 Pro (TechCrunch)](https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro/) (report)
5. [Google launches Gemini 3.6 Flash and 3.5 Flash-Lite, teases Gemini 4 (9to5Google)](https://9to5google.com/2026/07/21/gemini-3-6-flash-launch/) (report)

_이 문서는 AI피셜 편집부가 작성했습니다. 인용 시 출처를 표기해 주세요._