- 구글은 AI 에이전트 개발의 효율성, 낮은 지연 시간, 신뢰성을 위해 설계된 새로운 제미나이 모델인 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 출시
- Gemini 3.6 Flash는 3.5 Flash에 비해 향상된 코딩, 지식 작업, 멀티모달 성능을 제공하며, 출력 토큰 사용량을 줄이고 비용을 절감
- Gemini 3.5 Flash-Lite는 3.5 클래스에서 가장 빠르고 비용 효율적인 모델로, 에이전트 검색 및 문서 처리와 같은 고처리량 작업에 적합
- Gemini 3.5 Flash Cyber는 사이버 보안 취약점에 맞게 조정된 특수 모델로, CodeMender를 통해 제한된 접근 시범 프로그램을 통해 제공
- Gemini 3.5 Pro는 곧 더 넓은 범위로 출시될 예정이고 Gemini 4의 개발이 진행 중
GN⁺ 추가 요약
Neo가 원문을 바탕으로 추가 정리했습니다
- Google이 대규모 AI 에이전트 구축에 필요한 토큰 효율·지연시간·안정성을 겨냥해 범용, 고속, 보안 특화 모델을 각각 공개함
- 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 적게 사용하고 추론 단계와 도구 호출 횟수를 줄이며, 입력 100만 토큰당 $1.50·출력 100만 토큰당 $7.50에 제공됨
- 3.5 Flash-Lite는 초당 출력 토큰 350개와 입력 100만 토큰당 $0.3·출력 100만 토큰당 $2.5를 제공하며, 사고 수준을 조절해 대량 작업과 다단계 하위 에이전트 작업에 대응함
- 3.5 Flash Cyber는 CodeMender의 다중 에이전트 구성에서 취약점을 탐지·검증·패치하며, 이중용도 위험을 고려해 정부와 신뢰할 수 있는 파트너에게만 제한적으로 제공될 예정임
- 3.6 Flash와 3.5 Flash-Lite는 Gemini API, 기업용 플랫폼, Gemini 앱 등에서 이용할 수 있으며, Google은 3.5 Pro 파트너 테스트와 Gemini 4 사전학습도 진행 중임
세 모델의 역할
- Flash 계열은 AI 에이전트의 효율성과 품질 사이에서 균형을 맞춰 에이전트 워크플로를 확장하도록 설계됨
- 3.6 Flash는 코딩, 지식 작업, 멀티모달 성능을 높인 주력 모델임
- Artificial Analysis Index 기준 3.5 Flash보다 출력 토큰 사용량이 17% 적음
- Datacurve의 DeepSWE 같은 일부 벤치마크에서는 토큰 사용량이 최대 65% 감소함
- 출력 토큰당 가격도 3.5 Flash보다 낮음
- 3.5 Flash-Lite는 3.5 계열에서 가장 빠르고 비용 효율적인 모델이며, 에이전트 워크플로에서도 이전 Flash-Lite 세대보다 높은 성능을 냄
- 3.5 Flash Cyber는 사이버 보안 특화 모델과 CodeMender 에이전트 인프라를 결합해 최전선 모델과 경쟁할 수 있는 성능을 목표로 함
- Gemini 3.5 Pro는 파트너와 테스트 중이며 준비되는 대로 폭넓게 제공할 계획임
- Gemini 4를 위한 역대 가장 야심 찬 사전학습 실행도 시작됨
3.6 Flash의 효율과 가격
- 개발자와 고객의 3.5 Flash 피드백을 반영해 코딩·지식 작업 품질과 토큰 효율을 함께 개선함
- Artificial Analysis Index에서 3.5 Flash보다 출력 토큰을 17% 적게 사용하며, 다단계 워크플로를 완료하는 추론 단계와 도구 호출 수도 줄어듦
- 가격은 입력 100만 토큰당 $1.50, 출력 100만 토큰당 $7.50임
- 적은 토큰 사용량과 낮은 가격을 결합해 에이전트 작업당 전체 비용을 낮춤
- OSWorld 검증 API 작업에서는 3.5 Flash보다 토큰을 효율적으로 사용하면서 불필요하게 긴 출력을 줄임
3.6 Flash의 품질 향상
- 코딩 작업에서 원치 않는 코드 편집과 실행 반복을 줄이고 정밀도를 높임
- DeepSWE: 49%, 3.5 Flash는 37%
- MLE Bench: 63.9%, 3.5 Flash는 49.7%
- 컴퓨터 사용 능력도 개선됨
- OSWorld-Verified: 83.0%, 3.5 Flash는 78.4%
- 컴퓨터 사용 기능은 Gemini API와 Gemini Enterprise에서 클라이언트 측 내장 도구로 제공됨
- 지식 작업 성능도 3.5 Flash를 앞섬
- GDPval-AA v2: 1421, 3.5 Flash는 1349
- Hebbia와 Harvey는 문서 파싱, 차트·데이터 분석, 보고서 작성 같은 멀티모달 작업 역량을 확인함
- 활용 사례는 다음과 같음
- AIS의 Managed Agents로 재무 데이터와 녹취록을 분석함
- AGY의 다중 에이전트 오케스트레이션으로 지연시간을 낮추고 품질 높은 코드 마이그레이션을 수행함
- Gemini 앱의 canvas로 3D 워크플로용 사진 텍스처 추출기를 개발함
- AGY와 tldraw 오프라인 편집기를 사용해 대화형 테마 스튜디오를 구축함
3.6 Flash의 안전장치
- 화학·생물학·방사선·핵(CBRN) 및 사이버 공격 오용 영역에 강화된 Frontier Safety 보호 조치를 적용함
- 탈옥 공격 저항성을 크게 높이는 동시에 유익한 사용에 대한 거부는 최소화하도록 훈련함
- 세부 정보는 3.6 Flash 모델 카드에서 확인할 수 있음
3.5 Flash-Lite의 속도와 비용
- 에이전트 검색과 문서 처리처럼 낮은 지연시간이나 높은 처리량이 필요한 개발자 워크플로를 위해 설계됨
- Artificial Analysis 측정 기준 초당 출력 토큰 350개로 3.5 계열 중 가장 빠름
- 가격은 입력 100만 토큰당 $0.3, 출력 100만 토큰당 $2.5이며 3.1 Flash-Lite보다 품질이 크게 향상됨
- 3.5 Flash보다 낮은 지연시간으로 대량 작업을 실행할 수 있음
- 워크로드에 따라 사고 수준을 조정할 수 있음
- minimal·low 수준은 대량 작업의 지연시간과 비용을 낮추는 데 활용됨
- 높은 사고 수준은 다단계 하위 에이전트 워크로드를 처리함
- 컴퓨터 사용 기능도 여러 환경의 에이전트 작업을 지원하는 내장 도구로 제공됨
3.5 Flash-Lite의 벤치마크와 활용
- 3.1 Flash-Lite와 비교해 코딩, 긴 컨텍스트, 실제 작업 실행 성능이 향상됨
- Terminal-Bench 2.1: 54%, 3.1 Flash-Lite는 31%
- GDM-MRCR v2: 72.2%, 3.1 Flash-Lite는 60.1%
- GDPval-AA v2: 1140, 3.1 Flash-Lite는 642
- 여러 에이전트·코딩 평가에서는 3 Flash도 앞섬
- SWE-Bench Pro: 54.2%, 3 Flash는 49.6%
- OSWorld-Verified: 74.0%, 3 Flash는 65.1%
- 2.5 Flash와 3 Flash 기반 워크로드를 위한 더 빠르고 성능 높은 선택지가 될 수 있음
- 활용 사례는 다음과 같음
- 대규모 전자상거래 데이터세트에서 제품 특성을 추출하고 종합함
- 3.6 Flash를 상위 에이전트로 두고 탐색 가능한 웹 디자인 콘셉트 25개를 생성함
- 멀티모달 이해를 이용해 영수증 번역과 요약을 확장함
- 여러 선택지를 빠르게 생성하고 반복하면서 게임을 구축함
- 세부 정보는 3.5 Flash-Lite 모델 카드에서 확인할 수 있음
CodeMender의 3.5 Flash Cyber
- AI 모델이 기존 시스템의 수정 속도보다 빠르게 보안 취약점을 찾을 수 있어, 소프트웨어 보안에는 높은 역량과 효율성을 갖춘 접근이 필요함
- Gemini 3.5 Flash Cyber는 3.5 Flash를 기반으로 보안 취약점 탐지와 수정에 맞게 미세조정됨
- 대형 모델보다 낮은 토큰당 가격으로 코드 보안 문제를 탐지·검증·패치하도록 설계됨
- CodeMender에서는 여러 3.5 Flash Cyber 에이전트가 협력해 하나의 통합 보고서를 만들며, CyberGym 벤치마크에서 최전선 수준의 경쟁력 있는 성능을 기록함
- 기술의 이중용도 특성을 고려해 배포 범위를 제한함
- CodeMender를 통해 정부와 신뢰할 수 있는 파트너에게 제한 접근 파일럿으로 제공할 예정임
- 방어자가 악용 전에 중대한 취약점을 탐지하고 수정하도록 지원하면서 광범위한 오용을 줄이려는 방식임
제공 경로
- 3.6 Flash와 3.5 Flash-Lite는 공개 당일부터 여러 제품에서 이용할 수 있음
- 개발자는 Gemini API를 Google AI Studio와 Android Studio에서 사용할 수 있음
- 3.6 Flash는 Google Antigravity에서도 제공됨
- 구현 방법은 Developer Guide에서 확인할 수 있음
- 기업은 Gemini Enterprise Agent Platform에서 이용할 수 있으며, 3.6 Flash는 Gemini Enterprise 앱에도 제공됨
- 일반 사용자는 Gemini 앱에서 이용할 수 있고, 3.5 Flash-Lite는 Google Search에도 순차 배포됨
- Google은 사용자 피드백을 향후 Gemini 모델 개선에 반영하고 3.5 Pro도 곧 출시할 계획임