Google의 Gemini 모델 제품군은 출시 이후 크게 성장해 여러 세대와 성능 등급으로 확장되었습니다. 대규모 처리용 Flash-Lite부터 Pro의 최첨단 추론까지 거의 모든 용도와 예산에 맞는 Gemini 모델이 있습니다. 이 가이드는 주요 Google Gemini 모델을 최신순으로 정리하고 각 모델의 사양, 핵심 기능, 권장 용도를 간결하게 소개하며 Chat Smith에서 사용할 수 있는 모델 링크도 제공합니다.

chat smith pro

Gemini 3.6 Flash

2026년 7월 21일 출시된 Gemini 3.6 Flash는 Google의 최신 중간 등급 주력 모델입니다. 기본 지능은 Gemini 3.5 Flash와 동일하지만(Artificial Analysis Index: 50), 같은 작업에서 출력 토큰을 약 17% 줄이고 백만 출력 토큰당 가격을 $9.00에서 $7.50으로 낮췄습니다. 지식 기준일은 2026년 3월로 앞당겨졌습니다. 벤치마크에서는 에이전트 코딩(DeepSWE: 49% 대 37%), 컴퓨터 사용(OSWorld: 83% 대 78.4%), ML 연구(MLE-Bench: 63.9% 대 49.7%)가 크게 향상되었습니다. 컨텍스트 창은 1M 토큰, 속도는 약 275 tok/s입니다. 추천 용도: 에이전트 코딩, 문서 분석, 지식 업무.

더 보기: Gemini 3.6 Flash 리뷰

Gemini 3.5 Flash-Lite

같은 2026년 7월 21일 출시된 Gemini 3.5 Flash-Lite는 3.5 등급에서 가장 빠르고 비용 효율적인 모델입니다. 초당 350개의 출력 토큰을 처리하며 가격은 입력 $0.30/1M, 출력 $2.50/1M입니다. 가격이 낮아도 에이전트 및 코딩 벤치마크에서 3.1 Flash-Lite를 크게 앞섭니다(SWE-Bench Pro: 54.2% 대 31%). 최소부터 높음까지 설정 가능한 사고 수준으로 속도와 품질을 조절할 수 있습니다. 추천 용도: 고처리량 파이프라인, 에이전트 검색, 문서 처리.

더 보기: Gemini 3.5 Flash-Lite 리뷰

Gemini 3.5 Flash

Google I/O 2026에서 발표된 Gemini 3.5 Flash는 복잡하고 장기적인 작업을 위한 최첨단 에이전트 모델입니다. Flash 시리즈의 속도를 유지하면서 코딩 및 에이전트 벤치마크에서 대형 플래그십 모델과 경쟁합니다. 텍스트, 이미지, 오디오, 동영상의 멀티모달 입력과 1M 토큰 컨텍스트, 뛰어난 지시 이행 능력으로 다양한 프로덕션 환경에 적합합니다. 가격은 입력 $1.50/1M, 출력 $9.00/1M입니다.

더 보기: Gemini 3.5 Flash 리뷰

Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite는 Google 3 시리즈에서 가장 비용 효율적인 모델로, 대규모이면서 지연 시간에 민감한 작업에 최적화되었습니다. 속도와 품질을 조절하는 유연한 사고 수준(최소부터 높음), 향상된 오디오 입력을 제공하며 주요 능력은 Gemini 2.5 Flash와 비슷합니다. 가격은 입력 $0.25/1M, 출력 $1.50/1M입니다. 속도는 약 363 tok/s, 컨텍스트는 1M 토큰입니다. 추천 용도: 대규모 분류, 챗봇, 지시가 많은 워크플로.

더 보기: Gemini 3.1 Flash-Lite 리뷰

Gemini 3.1 Pro

Gemini 3.1 Pro는 3.1 세대의 플래그십 모델로, 가장 복잡한 추론, 코딩, 긴 컨텍스트 작업을 위해 설계되었습니다. Artificial Analysis Intelligence Index에서 46점을 기록했으며 대규모로 높은 정확도가 필요한 기업 사용 사례를 겨냥합니다. 가격은 입력 약 $2.00/1M, 출력 약 $12.00/1M입니다. 속도는 약 145 tok/s, 컨텍스트는 1M+ 토큰입니다. 추천 용도: 심층 추론, 복잡한 다단계 워크플로, 기업 파이프라인.

더 보기: Gemini 3.1 Pro 리뷰

Gemini 3 Flash

Gemini 3 Flash는 속도와 강력한 멀티모달 기능을 결합한 빠르고 효율적인 모델로 설계되었습니다. 1M 토큰 컨텍스트 창에서 텍스트, 이미지, 오디오, 동영상 입력을 처리하며 3.5 세대가 나오기 전 프로덕션 애플리케이션에 널리 채택되었습니다. 추천 용도: 범용 채팅, 요약, 분류, 빠른 프로토타이핑.

더 보기: Gemini 3 Flash 리뷰

Gemini 3 Pro

Gemini 3 Pro는 Gemini 3 세대에서 가장 높은 성능을 제공하며 최첨단 추론과 복잡한 작업 실행을 목표로 합니다. Flash의 멀티모달 강점에 더 깊은 분석, 지시 이행, 긴 컨텍스트 이해를 더했습니다. 추천 용도: 심층 연구, 복잡한 문서 워크플로, 중요도가 높은 추론 작업.

더 보기: Gemini 3 Pro 리뷰

Gemini Nano Banana

Nano Banana는 Google의 네이티브 이미지 생성 및 편집 모델로, 공식적으로 Gemini 이미지 모델 제품군에 속합니다. 여러 이미지 결합, 캐릭터 일관성, 스타일 제어, 대화형 워크플로 안의 반복 편집을 지원합니다. 두 가지 버전이 있습니다: Nano Banana(표준)와 Nano Banana Pro(더 높은 품질의 출력)이며 둘 다 Chat Smith에서 사용할 수 있습니다. 추천 용도: AI 이미지 생성, 사진 편집, 브랜드 비주얼, 캐릭터 제작.

Gemini 2.5 Pro

Gemini 2.5 Pro는 Google 최초의 하이브리드 추론 모델로, 1M 토큰 컨텍스트 창과 설정 가능한 사고 예산을 제공합니다. 복잡한 코딩, 분석, 다단계 추론에서 강력한 성능을 보이며 출시 당시 동급 최상위 모델 중 하나로 평가받았습니다. 가격은 입력 $1.25/1M, 출력 $10.00/1M입니다. 추천 용도: 복잡한 추론, 코딩, 문서 분석.

더 보기: Gemini 2.5 Pro 리뷰

Gemini 2.5 Flash

Gemini 2.5 Flash는 대규모 애플리케이션에서 비용과 성능의 균형을 잡는 빠르고 유능한 프로덕션 모델입니다. 1M 토큰 컨텍스트 창, 멀티모달 입력, Gemini API의 넉넉한 무료 등급을 지원합니다. 가격은 입력 $0.30/1M, 출력 $2.50/1M입니다. 속도는 약 249 tok/s입니다. 추천 용도: 챗봇, 콘텐츠 분류, 번역, 빠른 프로토타이핑.

더 보기: Gemini 2.5 Flash 리뷰

Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite는 Google의 대표적인 경제형 모델입니다. 입력 $0.10/1M, 출력 $0.40/1M으로 시장에서 1M 토큰 컨텍스트 창을 제공하는 가장 저렴한 모델이며, 약 366 tok/s로 가장 빠른 모델 중 하나이기도 합니다. 추천 용도: 깊은 추론보다 속도와 가격이 중요한 비용 민감형 대규모 워크로드.

더 보기: Gemini 2.5 Flash-Lite 리뷰

Gemini 2.0 Flash

Gemini 2.0 Flash는 Google의 이전 세대 주력 모델로, 텍스트, 이미지, 오디오, 동영상 전반에서 빠른 멀티모달 응답을 제공했습니다. 2026년 6월 1일 지원이 중단되어 Gemini API에서 더 이상 사용할 수 없습니다. 기존 사용 팀은 Gemini 3 Flash 또는 3.1 Flash-Lite로 이전하는 것이 권장됩니다. 추천 용도: 역사적 참고용. 새 모델로 이전하세요.

더 보기: Gemini 2.0 Flash 리뷰

Gemini 1.5 Flash

2024년 5월 출시된 Gemini 1.5 Flash는 개발자 친화적 가격으로 1M 토큰 컨텍스트 창을 제공한 최초의 Flash급 모델이라는 점에서 획기적이었습니다. Gemini 1.5 Pro에서 증류해 만들었으며 약 190 tok/s의 처리량으로 텍스트, 이미지, 오디오, 동영상 입력을 지원합니다. 가격은 입력 $0.075–$0.15/1M, 출력 $0.30–$0.60/1M입니다. 새 세대에 대체되었지만 Flash 제품군의 계보를 이해하는 데 유용한 역사적 참고 자료입니다.

더 보기: Gemini 1.5 Flash 리뷰

Google의 Gemini 제품군은 이제 경제적인 Flash-Lite부터 Pro의 최첨단 추론까지 3개의 주요 세대와 여러 성능 등급을 아우릅니다. API 키를 관리하지 않고 이 모델들을 사용하려는 개발자와 팀은 Chat Smith에서 전체 Gemini 모델과 GPT, Claude, Grok, DeepSeek을 하나의 인터페이스로 이용할 수 있습니다. Chat Smith의 전체 모델 카탈로그를 살펴보고 작업 흐름에 맞는 Gemini 모델을 찾아보세요.

자주 묻는 질문

Gemini는 Google DeepMind의 AI 모델 계열로, Gemini 앱과 API, 그리고 구글 워크스페이스 안에서 쓰입니다. 텍스트와 멀티모달 모델은 물론 이미지와 영상 생성을 위한 별도 모델까지 포함하며, 세대별로 출시되면서 매 세대가 같은 등급 이름을 사용합니다.

logo chat smith

Editorial Team

Managing Editor

Chat Smith 편집팀은 AI를 더욱 쉽고 실용적으로 활용할 수 있도록 돕는 AI 애호가, 연구자, 콘텐츠 크리에이터들로 구성되어 있습니다. Chat Smith 블로그를 통해 최신 AI 트렌드, 도구 리뷰, 업계 인사이트, 그리고 실용적인 가이드를 제공하여 개인과 기업이 AI로부터 더 큰 가치를 얻을 수 있도록 지원합니다. 우리의 목표는 빠르게 변화하는 AI 환경 속에서 독자들이 최신 정보를 얻고, 생산성을 높이며, 한발 앞서 나갈 수 있도록 명확하고 신뢰할 수 있으며 이해하기 쉬운 콘텐츠를 제공하는 것입니다.

이 기사 공유하기

관련 아티클