- Google이 Gemini 2.5 Flash와 2.5 Flash-Lite의 새 프리뷰 버전을 공개했으며, 품질 향상과 효율성 개선이 핵심
- Flash-Lite는 지시 이해력 강화, 장황한 답변 감소, 멀티모달·번역 능력 향상으로 고속·저비용 환경에 최적화
- Flash는 도구 활용 능력 강화, 토큰 효율성 개선으로 복잡한 에이전트형 작업에서 성능이 크게 높아짐
- 실제 테스트에서 SWE-Bench Verified 점수 5% 상승, 내부 벤치마크에서는 장기적 작업 성능이 15% 향상됨
- 두 모델 모두
-latest별칭을 지원해 최신 기능을 코드 수정 없이 사용할 수 있으며, 안정성을 원하는 경우 기존2.5모델을 계속 활용 가능함
Gemini 2.5 Flash 및 Flash-Lite 개요
- Gemini 2.5 Flash와 Flash-Lite의 최신 버전이 Google AI Studio와 Vertex AI에서 공개됨. 이번 릴리즈의 목적은 지속적으로 더 나은 모델 품질과 높은 효율성을 제공하는 것
- 새로운 Flash-Lite와 Flash는 전반적인 품질 및 속도, 비용 측면에서 기존 모델 대비 크게 향상된 성능을 보임
- Flash-Lite는 출력 토큰이 50% 절감되고, Flash는 24% 절감되어 동작 비용의 절약과 빠른 처리 속도를 제공함
Updated Gemini 2.5 Flash-Lite
- 명령 따라가기 고도화: 복잡한 명령이나 시스템 프롬프트에서의 이해 및 수행 능력이 크게 향상됨
- 간결함 증가: 더 짧고 알기 쉬운 응답 생성으로 토큰 비용 절감 및 대규모 트래픽 환경에서의 지연시간 감소 효과가 있음
- 멀티모달 및 번역 품질 강화: 오디오 기록, 이미지 인식, 번역 품질 모두에서 신뢰성이 높아짐
- Flash-Lite 프리뷰 버전은
gemini-2.5-flash-lite-preview-09-2025모델명으로 바로 시험해 볼 수 있음
Updated Gemini 2.5 Flash
- 도구 사용 능력 강화: 복잡한 멀티스텝 상황에서의 에이전트 기반 활용도가 크게 높아져, SWE-Bench Verified 기준 전 버전 대비 5%p 오른 성능(48.9% → 54%)을 달성함
- 비용 효율성 향상: 더 적은 토큰 사용으로 더 높은 출력 품질을 제공, 지연시간 및 인프라 비용 절감 효과가 있음
- Primer 사용자들의 피드백도 긍정적임
- Manus의 공동 창업자이자 Chief Scientist인 Yichao ‘Peak’ Ji는, "새로운 Gemini 2.5 Flash 모델은 놀라운 속도와 지능을 모두 구현함. 장기 목표 기반의 에이전트 작업에서 성능이 15% 개선되어, 비용 효율성을 바탕으로 스케일이 한층 커짐"이라고 평가함
- Gemini 2.5 Flash 프리뷰 버전은
gemini-2.5-flash-preview-09-2025모델명으로 사용 가능함
Gemini로 빌드 시작하기
- 지난 1년간 미리보기(preview) 모델을 출시함으로써 개발자들이 최신 기능을 빠르게 시범 적용하고 피드백을 제공할 수 있게 했음.
- 오늘 공개된 프리뷰 버전은 신규 안정화(stable) 버전으로 공식 전환되는 것이 아니며, 차기 정식 버전의 품질을 높이는 기반으로 활용됨
- 장황한 모델명 대신
-latest별칭이 추가되어 항상 최신 모델을 쉽게 쓸 수 있음. 이 별칭은 자동으로 최신 버전에 연결되어, 코드 수정 없이 새로운 기능을 시험 가능하게 해줌-
gemini-flash-latest -
gemini-flash-lite-latest
-
- 특정 버전이 업데이트 혹은 중단될 경우 최소 2주 전에 이메일로 안내함. 별칭은 단순한 레퍼런스로, 가격과 기능, 한도 등은 각 릴리즈 별로 달라질 수 있음
- 장기적 안정성이 필요한 경우에는 기존의
gemini-2.5-flash및gemini-2.5-flash-lite모델명 사용 권장
의의
- 이번 릴리스는 정식 안정 버전 승격이 아닌 프리뷰 업데이트로, 향후 안정 모델을 위한 실험과 사용자 피드백을 모으는 과정임
- Google은 Gemini를 통해 속도와 지능, 비용 효율의 균형을 추구하며, 개발자들이 더 나은 AI 응용을 만들 수 있도록 지속적으로 개선 중임