제미나이 3.6 플래시 출시, 같이 나온 모델 중 하나는 아무나 못 쓴다 (2026)

·

구글이 2026년 7월 21일, 모델 세 개를 한꺼번에 냈다. 그런데 셋 중 하나는 공개하자마자 “여러분은 못 씁니다”라고 못 박았다.

아래 내용은 구글 공식 발표(2026-07-21) 원문을 근거로 정리했다.

세 모델, 각자 다른 역할

이번에 나온 건 하나가 아니라 세트다. 역할이 뚜렷하게 나뉜다.

모델역할입력/출력 요금(100만 토큰당)
Gemini 3.6 Flash코딩·업무·멀티모달 범용 주력 모델$1.50 / $7.50
Gemini 3.5 Flash-Lite가장 빠르고 저렴한 3.5급 모델$0.3 / $2.5
Gemini 3.5 Flash Cyber보안 취약점 탐지·수정 특화비공개(파일럿 전용)

구글은 3.6 Flash를 코딩·지식노동·멀티모달 성능을 더 잘 해내는 주력 모델로 소개했고(원문: “Our workhorse model that delivers better coding, knowledge work, and multimodal performance”), 3.5 Flash-Lite는 가장 빠르고 비용 효율적인 3.5급 모델이라고 설명했다(원문: “Our fastest, most cost-effective 3.5-class model”).

3.6 Flash — 값은 내렸는데 성능은 올랐다

가장 눈에 띄는 건 3.6 Flash의 가격표다. 출력 요금이 100만 토큰당 9달러에서 7.50달러로 17% 내렸다. 보통 이런 가격 인하는 성능을 조금 깎아서 만드는데, 이번엔 아니다. 구글이 공개한 벤치마크는 이렇다.

  • 코딩(DeepSWE): 37% → 49%
  • 머신러닝 리서치(MLE Bench): 49.7% → 63.9%
  • 컴퓨터 사용(OSWorld-Verified): 78.4% → 83.0%

출력 토큰 사용량도 3.5 Flash 대비 17% 줄었다. 같은 답을 더 짧게 만들어낸다는 뜻이라, 실질 비용 절감 효과는 요금표 숫자보다 더 크다.

3.5 Flash-Lite — 싸고 빠른 쪽

3.5 Flash-Lite는 지능보다 속도와 가격에 맞춘 모델이다. 초당 350토큰을 뽑아내고, 터미널 작업 벤치마크(Terminal-Bench 2.1)에서 31%였던 기존 대비 54%로 올랐다. 100만 토큰당 입력 0.3달러·출력 2.5달러로 세 모델 중 가장 저렴하다. 복잡한 추론보다 단순 반복 작업을 대량으로 처리할 때 맞는 선택이다.

3.5 Flash Cyber — 나오자마자 문 닫힌 모델

세 번째가 가장 특이하다. 보안 취약점을 찾고 고치는 데 특화됐다는 설명까지는 다른 모델과 비슷한데, 공개 범위가 다르다. 구글 공식 발표는 이 모델이 정부와 신뢰할 수 있는 파트너에게만 CodeMender를 통해, 제한적 접근 파일럿 프로그램의 일부로 곧 제공될 예정이라고 밝혔다(원문: “exclusively available to governments and trusted partners via CodeMender soon as part of a limited-access pilot program”).

일반 API 키로 호출할 수 있는 모델이 아니라는 뜻이다. 보안 취약점 탐지 능력이 공격 도구로 악용될 가능성을 고려해 접근을 좁힌 것으로 보이지만, 구글이 그 이유를 명시적으로 밝히지는 않았다.

정리

이번 발표의 핵심은 “성능은 올리고 값은 내린” 3.6 Flash다. 기존에 3.5 Flash를 쓰고 있었다면 API 호출 코드를 거의 그대로 두고 모델명만 바꾸는 것으로 비용은 줄이고 성능은 올리는 결과를 볼 수 있다. 반대로 3.5 Flash Cyber는 이번 발표에 이름만 올랐을 뿐, 당장 써볼 수 있는 모델은 아니다.

자주 묻는 질문

Gemini 3.6 Flash는 이전 3.5 Flash보다 뭐가 좋아졌나요?

공식 발표 기준으로 출력 토큰 사용량이 3.5 Flash 대비 17% 줄었고, 같은 답변을 더 적은 토큰으로 만들어낸다는 뜻입니다. 코딩(DeepSWE 37%→49%), 머신러닝 리서치(MLE Bench 49.7%→63.9%), 컴퓨터 사용(OSWorld-Verified 78.4%→83.0%) 벤치마크도 함께 올랐습니다.

3.5 Flash Cyber는 저도 쓸 수 있나요?

지금은 안 됩니다. 공식 발표에 '정부와 신뢰할 수 있는 파트너에게만 CodeMender를 통해 제한적으로 제공되는 파일럿 프로그램'이라고 명시돼 있습니다. 일반 개발자용 API로 공개되지 않았습니다.

가장 저렴한 모델은 어떤 건가요?

3.5 Flash-Lite입니다. 100만 토큰당 입력 $0.3·출력 $2.5로 세 모델 중 가장 쌉니다. 대신 지능 지표보다는 속도(초당 350토큰)와 비용 효율에 맞춰진 모델이라, 복잡한 추론이 필요한 작업에는 3.6 Flash가 더 적합합니다.

어디서 쓸 수 있나요?

3.6 Flash와 3.5 Flash-Lite는 발표 당일부터 Google AI Studio, Android Studio, Gemini Enterprise, Gemini 앱, 구글 검색에 순차 적용됐습니다. Gemini API를 통한 개발자 접근도 바로 열렸습니다.

#Gemini#제미나이#구글#Gemini 3.6 Flash#AI 모델