Google releases three new Gemini models — but no 3.5 Pro
Quick Summary
구글 딥마인드는 비용·속도·보안에 초점을 맞춘 세 가지 Gemini Flash 모델을 공개했지만, 기대를 모았던 고성능 Gemini 3.5 Pro 출시는 다시 미뤄졌다.
🖼️ 인포그래픽
🖼️ 4컷 인포그래픽
💡 한 줄 요약
구글 딥마인드는 비용·속도·보안에 초점을 맞춘 세 가지 Gemini Flash 모델을 공개했지만, 기대를 모았던 고성능 Gemini 3.5 Pro 출시는 다시 미뤄졌다.
📌 핵심 요약
- 구글 딥마인드는 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber를 공개했다.
- 주력 실무 모델인 Gemini 3.6 Flash는 코딩·지식 업무·멀티모달 능력을 개선하고, 3.5 Flash보다 토큰 사용량을 최대 17% 줄였다.
- 3.5 Flash-Lite는 같은 계열에서 가장 비용 효율적인 모델이며, 3.5 Flash Cyber는 보안 취약점 탐지와 수정을 위해 미세 조정된 특화 모델이다.
- 구글은 대규모 인공지능 에이전트를 구축하는 고객에게 효율성, 낮은 지연 시간, 신뢰성을 제공하는 것을 이번 출시의 목표로 제시했다.
- Gemini 3.5 Pro는 내부 성능 목표와 관련된 지연 속에서 이번 발표에 포함되지 않았으며, 현재 파트너들과 테스트 중이다.
🧩 주요 포인트
- Flash 제품군 강화 → 구글은 대규모 운영 환경에 필요한 비용 절감, 응답 속도, 안정성 개선에 집중했다.
- 보안 특화 모델의 제한적 제공 → 3.5 Flash Cyber의 이용 대상은 정부와 신뢰할 수 있는 파트너로 한정된다.
- Pro 출시 지연과 경쟁사 신속 출시 → 구글의 최고 역량 모델 갱신이 늦어지는 동안 경쟁 연구소들은 여러 최신 모델을 잇달아 내놓았다.
🧠 상세 정리
1. 세 가지 Gemini Flash 모델 공개
구글 딥마인드는 화요일 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber 등 세 가지 모델을 공개했다. 이 가운데 3.6 Flash는 회사가 ‘주력 실무 모델’로 부르는 제품으로, 코딩과 지식 업무, 멀티모달 처리 능력을 개선했다고 설명했다. 동시에 이전 모델인 3.5 Flash보다 토큰 사용량을 최대 17% 줄여 이용 비용도 낮췄다. 따라서 3.6 Flash의 핵심 변화는 여러 실무 능력의 향상과 토큰 효율 개선을 함께 제공하는 데 있다.
2. 비용 효율 모델과 사이버 보안 특화 모델
Gemini 3.5 Flash-Lite는 같은 계열에서 가장 비용 효율적인 모델로 소개됐다. Gemini 3.5 Flash Cyber는 사이버 보안 취약점을 찾아내고 수정하도록 미세 조정된 특화 모델이며, 구글은 가격 경쟁력도 함께 강조했다. 다만 이 모델은 일반 고객에게 바로 개방되지 않고, 제한적 접근 방식의 시범 프로그램을 통해 정부와 신뢰할 수 있는 파트너에게만 제공된다. 구글은 세 모델의 공통 출시 목표를 대규모로 인공지능 에이전트를 구축하는 고객에게 효율성, 낮은 지연 시간, 신뢰성을 제공하는 것이라고 밝혔다.
3. 이번 발표에서 빠진 Gemini 3.5 Pro
이번 발표에서 눈에 띄는 대목은 더 저렴하고 빠르며 코딩·효율·사이버 보안에 최적화된 모델들이 추가됐지만, 오랫동안 기대를 모은 Gemini 3.5 Pro는 포함되지 않았다는 점이다. Gemini Pro 계열은 복잡한 추론과 코딩 작업을 위한 구글의 최고 역량 모델로 자리매김해 왔고, 마지막 갱신은 2월이었다. 반면 Flash 계열은 생산 환경에서 더 낮은 비용과 더 빠른 응답 시간을 제공하는 데 우선순위를 둔다. 이에 따라 이번 출시는 최고 성능 계열의 갱신이 아니라 실제 운영에 필요한 속도와 비용을 중시하는 Flash 제품군의 확장으로 구분된다.
4. 출시 예고 이후의 지연과 경쟁 상황
구글은 5월 Gemini 3.5 Flash를 발표하면서 Pro 버전이 이미 내부에서 사용되고 있으며 다음 달에 출시하기를 기대한다고 예고했다. 그러나 기사에 인용된 블룸버그 보도에 따르면, 구글은 내부 성능 목표를 충족하는 데 어려움을 겪으면서 3.5 Pro 출시가 내부적으로 지연되는 상황을 맞았다. 같은 기간 OpenAI는 GPT-5.5를 출시하고 GPT-5.6 배포를 시작했으며, Anthropic은 Claude Opus 4.8과 Claude Sonnet 5를 출시하고 Fable 5의 접근 범위를 확대했다. 기사는 이 연속적인 발표를 경쟁 연구소들의 매우 빠른 모델 출시 속도를 보여주는 배경으로 제시한다.
5. 파트너 테스트와 Gemini 4 사전 학습
구글 딥마인드 제품 책임자 로건 킬패트릭은 화요일 Gemini 3.5 Pro를 파트너들과 테스트하고 있으며 곧 출시하기를 바란다고 말했다. 이 발언은 구체적인 공개일을 제시하지는 않았지만, 해당 모델이 현재 파트너 검증 단계에 있다는 사실을 보여준다. 그는 또한 팀이 Gemini 4를 위한 지금까지 가장 야심 찬 사전 학습 작업을 시작했다고 밝혔다. 구글의 현재 개발 상황은 즉시 공급되는 Flash 계열 세 모델, 파트너 테스트 중인 3.5 Pro, 사전 학습에 착수한 Gemini 4라는 서로 다른 진행 단계로 정리된다.
🧾 핵심 주장 / 시사점
- 이번 발표의 공통 축은 최고 성능 모델의 갱신보다 생산 환경에서 요구되는 비용, 지연 시간, 신뢰성 개선에 있다.
- Flash Cyber의 제한적 시범 운영은 사이버 보안 특화 모델의 배포 대상과 접근 범위가 엄격하게 통제되고 있음을 보여준다.
- 구글은 Flash 모델을 즉시 출시하는 동시에 3.5 Pro의 파트너 테스트와 Gemini 4의 사전 학습을 병행하고 있다.
✅ 액션 아이템
- Gemini 3.6 Flash의 코딩·지식 업무·멀티모달 개선과 토큰 사용량 최대 17% 절감을 기존 3.5 Flash 워크로드와 비교한다.
- 가장 비용 효율적인 3.5 Flash-Lite와 주력 실무 모델 Gemini 3.6 Flash의 적용 범위를 대규모 운영 환경 기준으로 나눈다.
- 3.5 Flash Cyber의 보안 취약점 탐지·수정 특화 범위를 정부와 신뢰할 수 있는 파트너 한정 제공 조건과 함께 점검한다.
❓ 열린 질문
- Gemini 3.5 Pro가 내부 성능 목표 관련 지연 속에서 파트너들과 테스트를 마친 뒤 언제 출시될 수 있는가?
- 대규모 인공지능 에이전트를 구축하는 고객에게 제시한 효율성·낮은 지연 시간·신뢰성을 어떤 기준으로 판단할 것인가?
- 구글의 최고 역량 모델 갱신이 늦어지는 동안 경쟁 연구소들의 최신 모델 출시가 Gemini Flash 제품군 선택에 어떤 영향을 주는가?