무슨 일인가요
2026년 7월 21일, Google은 Gemini 라인업의 "워크호스" 모델인 Gemini 3.6 Flash와 함께 Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber 세 모델을 동시에 발표했습니다. 공식 발표문은 제품 관리 시니어 디렉터 Tulsee Doshi 명의로 올라왔고, 세 모델 모두 "효율과 품질의 균형점"에서 에이전트 워크플로를 대규모로 돌리는 개발자를 겨냥한다고 설명합니다. 공식

Google의 7월 월간 AI 업데이트 모음에서도 이 세 모델은 "프로덕션 AI 에이전트를 만드는 개발자와 고객"을 위해 "더 높은 토큰 효율, 더 낮은 지연, 더 안정적인 성능"을 목표로 설계됐다고 소개됩니다. 공식 요약하면 이번 세대의 주인공은 최고 성능이 아니라 운영 비용입니다. 추정
눈에 띄는 점은 번호 체계입니다. 플래그십인 3.5 Pro가 아직 나오지 않은 상태에서 Flash만 3.6으로 먼저 올라갔습니다. TechCrunch는 Pro 모델의 마지막 업데이트가 2026년 2월이었다고 짚었습니다. 보도 결과적으로 Flash 계열은 3.6, Flash-Lite와 Cyber는 3.5, Pro는 여전히 3.x 이전 세대라는 다소 복잡한 라인업이 됐습니다. 추정
숫자로 보는 3.6 Flash
-17%
출력 토큰 절감
Artificial Analysis Index 기준, 3.5 Flash 대비 출력 토큰 사용량 최대 17% 감소
$1.50 / $7.50
가격 (입력 / 출력, 100만 토큰당)
TechCrunch는 전작 3.5 Flash보다 저렴해졌다고 보도
1M / 64K
컨텍스트 / 최대 출력
모델 카드 기준. 지식 컷오프 2026년 3월
49% → 37%
DeepSWE 코딩 정밀도 (3.6 vs 3.5)
불필요한 코드 수정과 실행 루프가 줄어든 결과라는 설명
Google이 발표문에서 제시한 3.5 Flash 대비 개선 수치는 아래와 같습니다. 공식
| 벤치마크 | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (코딩 정밀도) | 49% | 37% |
| MLE Bench (ML 연구) | 63.9% | 49.7% |
| OSWorld-Verified (컴퓨터 사용) | 83.0% | 78.4% |
| GDPval-AA v2 (지식노동, Elo) | 1421 | 1349 |
Google은 DeepSWE에서 최대 65%의 효율 개선이 있었다고도 적었는데, 정답률이 아니라 "불필요한 코드 편집과 실행 루프가 줄어 정밀도가 올라갔다"는 설명이 붙어 있습니다. 공식 에이전트가 같은 과제를 풀기 위해 도는 횟수 자체가 줄었다는 의미로, 토큰 절감 수치와 같은 방향의 지표입니다. 추정
경쟁 모델과 비교하면
모델 카드에는 타사 모델과의 비교도 실려 있습니다. SWE-Bench Pro는 58.7%로 Grok 4.5(64.7%)에 뒤지고, MLE-Bench는 63.9%로 Claude Sonnet 5(66.9%)에 못 미치지만, 도구를 쓴 CharXiv는 89.4%로 Sonnet 5(88.3%)를 근소하게 앞섭니다. 공식 즉 "동급 최강"보다는 "가격 대비 균형"이 이 모델의 자리라고 읽는 편이 정확합니다. 추정
함께 나온 두 모델
● Gemini 3.5 Flash-Lite
가장 저렴한 등급
- 가격은 입력 $0.30, 출력 $2.50 (100만 토큰당)
- Artificial Analysis 기준 초당 350 출력 토큰
- Terminal-Bench 2.1 54% (3.1 Flash-Lite 31%), SWE-Bench Pro 54.2% (3 Flash 49.6%)
- Gemini API·AI Studio·Android Studio·Gemini 앱에 제공, Google 검색에도 순차 적용
● Gemini 3.5 Flash Cyber
보안 취약점 탐지·수정 특화
- 취약점을 찾고 고치는 작업에 맞춰 조정된 모델
- CyberGym에서 프론티어급 경쟁력을 보였다고 발표
- 정부·신뢰 파트너 대상 제한 접근 파일럿으로만 제공 (CodeMender 경유)
- 일반 개발자는 당장 쓸 수 없음
Flash-Lite와 Flash Cyber의 위 수치와 제공 범위는 모두 Google 발표문 기준입니다. 공식
어디서 쓸 수 있나요
3.6 Flash는 발표 당일부터 Gemini API(Google AI Studio·Android Studio), Google Antigravity, Gemini Enterprise Agent Platform, 그리고 소비자용 Gemini 앱에서 제공됩니다. 공식 9to5Google은 3.6 Flash와 3.5 Flash-Lite가 같은 날 Gemini 앱에 반영됐다고 확인했습니다. 보도
Flash-Lite는 여기에 더해 Google 검색에도 순차 적용되며, Flash Cyber만 CodeMender를 통한 제한 접근 파일럿으로 정부와 신뢰 파트너에게 제공됩니다. 공식 발표문에는 Figma, Harvey, Hebbia, JetBrains, Palo Alto Networks, Ramp 등 초기 파트너의 평가가 이미지로 실려 있는데, 이 글에서는 본문 텍스트로 확인되지 않아 인용하지 않았습니다.
안전 측면에서는 CBRN(화생방·핵)과 사이버 공격 오용 영역을 겨냥한 "강화된 프론티어 안전장치"와 탈옥 저항성이 적용됐다고 합니다. 공식 모델 카드에는 아동 안전 관련 레드팀 결과와, 전작 대비 다국어 안전성 지표 변화도 기록돼 있습니다. 공식
3.5 Pro와 Gemini 4는?
이번 발표에서 빠진 것이 플래그십입니다. Google DeepMind 제품 리드 Logan Kilpatrick은 3.5 Pro를 "파트너와 테스트 중이며 곧 내놓기를 바란다"고 했고, 팀이 Gemini 4를 위한 "역대 가장 야심 찬 사전학습"을 시작했다고 밝혔습니다. 보도 9to5Google도 3.5 Pro의 광범위 제공 시점을 "준비되는 대로"라고 전했습니다. 보도
그래서 무엇을 보면 되나요
이번 발표는 새 능력을 여는 출시라기보다 기존 워크로드의 단가를 낮추는 출시에 가깝습니다. 실무자가 확인할 순서를 정리하면 다음과 같습니다. 추정
3.5 Flash를 쓰고 있다면 3.6 Flash로 교체 테스트
같은 작업에서 출력 토큰이 얼마나 줄어드는지 먼저 재보세요. Google이 내세운 핵심 지표가 성능 자체보다 토큰 효율입니다.
코딩 에이전트는 '수정 횟수'를 지표로
DeepSWE 개선의 설명이 "불필요한 편집과 실행 루프 감소"였으므로, 정답률보다 시도 횟수와 비용을 함께 보는 것이 발표 취지에 맞습니다.
대량 분류·요약은 Flash-Lite부터
$0.30/$2.50 가격과 초당 350 토큰 속도는 단순 반복 작업에 맞춰진 스펙입니다. 3.6 Flash와 나눠 쓰는 라우팅을 고려해 보세요.
Pro 대기 중이라면 서두르지 않아도 됩니다
3.5 Pro는 아직 파트너 테스트 단계라, 어려운 추론 작업의 기준 모델은 당분간 바뀌지 않습니다.



