---
title: "구글, 토큰값 줄인 제미나이 신모델 3종 공개"
published: 2026-07-22T16:05:03.690Z
canonical: https://jeff.news/article/5054
---
# 구글, 토큰값 줄인 제미나이 신모델 3종 공개

구글이 제미나이 플래시 계열 신모델 3종을 공개했다. 핵심은 무조건 더 큰 모델이 아니라 출력 토큰 절감, 초고속 응답, 코드 보안 특화처럼 용도별 가성비를 밀어붙이는 쪽이다.

- 구글이 제미나이 플래시 계열 신모델 3종을 공개함. 방향은 꽤 노골적임 — 더 큰 모델보다 ‘값 대비 효율’ 쪽으로 밀고 있음
  - 제미나이 3.6 플래시는 제미나이 3.5 플래시 대비 출력 토큰을 17% 줄였다고 함
  - 출력 토큰이 줄어든다는 건 같은 작업을 시켜도 응답 생성 비용이 낮아질 가능성이 있다는 뜻이라, 대량 호출하는 서비스 입장에선 바로 돈 얘기임

- 제미나이 3.5 플래시-라이트는 속도 담당 모델로 나옴
  - 구글이 내세운 수치는 초당 350토큰
  - 채팅형 서비스, 실시간 보조 도구, 자동완성처럼 ‘답이 조금 늦으면 UX가 바로 죽는’ 영역에 맞춘 카드로 보임

- 제미나이 3.5 플래시 사이버는 코드 보안 특화 모델로 따로 분리됨
  - 코드 보안에 맞춘 모델이고, 공개 범위는 정부와 파트너로 제한됨
  - 일반 개발자용 공개 모델이라기보다는 보안 검토, 취약점 탐지, 정부·기업 환경을 겨냥한 제품 라인에 가까움

> [!IMPORTANT]
> 이번 발표의 핵심은 모델 이름이 아니라 포지셔닝임. 구글은 ‘한 모델로 다 때려잡기’보다 비용, 속도, 보안처럼 사용 목적별로 모델을 쪼개는 방향을 더 강하게 가져가고 있음.

---
## 기술 맥락

- 이번 선택의 핵심은 출력 토큰을 줄이는 쪽이에요. 생성형 AI 서비스는 입력보다 출력이 길어질수록 비용과 지연 시간이 같이 튀기 쉬운데, 17% 절감은 대량 트래픽을 받는 제품에서는 꽤 직접적인 운영비 차이로 이어질 수 있거든요.

- 플래시-라이트가 초당 350토큰을 내세운 것도 같은 흐름이에요. 모든 요청에 가장 강한 모델을 붙이면 품질은 좋아질 수 있지만, 실시간 제품에서는 응답 속도가 느려지는 순간 사용성이 무너져요. 그래서 빠른 모델을 별도 라인으로 둔 거예요.

- 코드 보안 특화 모델을 제한 공개한 건 적용 영역이 민감하기 때문이에요. 취약점 분석이나 보안 코드 리뷰는 기업 내부 코드와 정책을 다룰 가능성이 높아서, 일반 공개보다 정부·파트너 환경에서 먼저 검증하려는 판단으로 볼 수 있어요.

## 핵심 포인트

- 제미나이 3.6 플래시는 기존 3.5 플래시보다 출력 토큰을 17% 줄이는 데 초점을 맞췄다.
- 제미나이 3.5 플래시-라이트는 초당 350토큰을 내세운 고속 모델이다.
- 제미나이 3.5 플래시 사이버는 코드 보안에 특화됐고 정부와 파트너 대상으로 제한 공개된다.

## 인사이트

생성형 AI 경쟁이 ‘제일 똑똑한 모델’ 싸움에서 ‘업무별로 싸게, 빠르게, 충분히 잘하는 모델’ 싸움으로 넘어가는 흐름이 더 선명해졌다. 개발자 입장에선 모델 성능표보다 토큰 비용, 응답 속도, 보안 특화 여부를 같이 봐야 하는 구간이다.
