Google 모델
Google의 모든 10개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.
빠른 추천
Gemini 3.7 Flash
신규Mid-tierCoding, instruction following
사용 시기: Best pick for high-volume coding assistants, agentic pipelines and tool-calling workloads on a budget.
업그레이드 하이라이트
- ◆GA on August 13, 2026 — three weeks after Gemini 3.6 Flash
- ◆Priced at half of Gemini 3.6 Flash: $0.75 input / $3.75 output per 1M
- ◆1,048,576-token context, 65,536-token max output
장점
- Google's most intelligent Flash model (GA Aug 13, 2026)
- Purpose-built for coding and agents
- 1M context at $0.75/$3.75 — half the price of Gemini 3.6 Flash
단점
- Below Pro-tier reasoning on the hardest tasks
- Very new — ecosystem tooling still catching up
성능
멀티모달
Gemini 3.1 Pro
Flagship고급 추론, 코딩
사용 시기: 복잡한 추론 및 전문 코딩 작업에 가장 적합한 Google 모델입니다.
업그레이드 하이라이트
- ◆MMLU: 89.2% — Gemini 2.5 Pro 대비 크게 개선된 추론
- ◆1M 컨텍스트 및 65K 출력 — 동일한 컨텍스트, 더 나은 품질
- ◆50% 배치 할인($1/$6) — 가장 저렴한 배치 플래그십
- ◆컨텍스트 캐싱: $0.50/M — 반복 접두사에 대해 75% 절감
- ◆유료 전용 프리뷰 — 무료 티어 없음, 프로덕션급 안정성
장점
- 1M 컨텍스트 및 65K 출력
- 3.0 대비 크게 개선된 추론
- 50% 배치 할인 가능
단점
- 무료 티어 없음(유료 전용 프리뷰)
- 200K 이상의 긴 컨텍스트 입력 2배
- 아직 성숙 중
성능
멀티모달
벤치마크
Gemini 3.5 Pro
Flagship복잡한 코딩, 고급 수학, 심층 추론
사용 시기: 정확성이 가장 중요한 복잡한 코딩, 고급 수학, 심층 추론 작업에 가장 적합한 Google 모델입니다.
업그레이드 하이라이트
- ◆3.1 Pro 대비 추론 성능이 개선된 최신 플래그십
- ◆계층형 가격의 100만 컨텍스트: $1.25/$10 (≤200K), $2.50/$15 (>200K)
- ◆요금 제한이 있는 무료 티어 제공 — 무료 액세스가 가능한 유일한 플래그십
- ◆50% 배치 할인 ($0.625/$5) — 가장 저렴한 배치 플래그십
- ◆컨텍스트 캐싱: $0.315/M — 반복 접두사에 대해 75% 절감
장점
- 계층형 가격의 100만 컨텍스트
- 최고 수준의 추론 벤치마크
- 요금 제한이 있는 무료 티어
- 50% 배치 할인 가능
단점
- 긴 컨텍스트(>200K) 2배 비쌈
- 파인튜닝 미지원
- 출력에 생각 토큰 포함
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
4Gemini Omni Flash
Mid-tier멀티모달 생성: 텍스트, 이미지, 오디오, 비디오
사용 시기: 텍스트, 이미지, 오디오, 비디오를 하나의 모델로 아우르는 멀티모달 창의적 작업에 가장 적합합니다.
업그레이드 하이라이트
- ◆텍스트, 이미지, 오디오, 비디오를 기본적으로 통합한 최초의 최상위 모델
- ◆입력: 모든 모달리티(텍스트/이미지/비디오/오디오)에 대해 $1.50/M
- ◆텍스트 출력: $9/M — 비디오 출력: $17.50/M (~720p에서 초당 $0.10)
- ◆에이전트 기반 창의적 워크플로우 및 실시간 비디오 편집 지원
장점
- 최초의 기본 통합 텍스트/이미지/오디오/비디오 모델
- 실시간 비디오 조작
- 모든 모달리티에 대해 입력 $1.50/M
- 에이전트 기반 창의적 워크플로우
단점
- 비디오 출력 $17.50/M은 비쌈
- 무료 티어 없음
- 프리뷰 — 변경될 수 있음
성능
멀티모달
Gemini 3.5 Flash
Mid-tier빠르고 지능적인 생성
사용 시기: 멀티모달 기능이 필요한 프로덕션 앱에 속도와 지능의 최적 균형을 제공합니다.
업그레이드 하이라이트
- ◆중간 가격대의 최첨단 지능 — Gemini 2.5 Pro 품질과 동등
- ◆1M 컨텍스트 + 65K 출력, $1.50/$9 — 플래그십 대비 8배 저렴
- ◆요금 제한이 있는 무료 티어 제공 — Google 최고의 무료 티어 모델
- ◆컨텍스트 캐싱: $0.375/M — 캐시된 입력에 대해 75% 절감
- ◆플래시 속도의 멀티모달(텍스트 + 비전) — 일반적으로 1초 미만 지연 시간
장점
- 중간 가격대의 최첨단 지능
- 1M 컨텍스트 + 65K 출력
- 요금 제한이 있는 무료 티어
단점
- 3.1 Flash-Lite보다 비쌈
- $9/M의 출력 비용은 대규모 사용 시 부담
- 파인튜닝 없음
성능
멀티모달
벤치마크
Gemini 3.1 Flash-Lite
Lite대량 처리, 저지연 작업
사용 시기: 대량 분류, 추출 및 경량 생성에 가장 적합한 예산 모델입니다.
업그레이드 하이라이트
- ◆100만 컨텍스트에 $0.25/M 입력 — Gemini 2.5 Flash보다 6배 저렴
- ◆최대 65K 출력 — 라이트 가격에 Pro 등급과 동일
- ◆컨텍스트 캐싱: $0.0625/M — 90% 절감, 최고의 캐싱 가치
- ◆배치 API: $0.125/$0.75 — 비동기 처리 시 50% 절감
- ◆요금 제한이 있는 무료 등급 — 무료로 무제한 프로토타이핑
장점
- 100만 컨텍스트에 $0.25/M 입력 — 놀라운 가치
- 최대 65K 출력
- 90% 컨텍스트 캐싱 절감
단점
- 복잡한 작업에서 3.5 Flash보다 낮은 품질
- 파인튜닝 불가
- 신규 모델, 검증 부족
성능
멀티모달
벤치마크
Gemini 2.5 Pro
Flagship복잡한 추론, 긴 컨텍스트
사용 시기: 최고의 가성비 플래그십 모델 — GPT-4.1이나 Claude Sonnet보다 저렴한 비용으로 100만 컨텍스트 제공.
업그레이드 하이라이트
- ◆가장 저렴한 플래그십 입력: $1.25/M — GPT-4.1보다 40% 저렴
- ◆100만 컨텍스트 윈도우 및 65K 출력 — 플래그십 중 최대 출력
- ◆컨텍스트 캐싱: $0.315/M — 반복 접두사에 대해 75% 절감
- ◆무료 티어 제공 — 무료 액세스가 가능한 유일한 플래그십 모델
- ◆MMLU: 85.4% — 절반 비용으로 GPT-4.1과 경쟁력 있음
장점
- 100만 토큰 컨텍스트 윈도우
- 가장 저렴한 플래그십 입력: $1.25
- 최대 65K 출력
단점
- 배치 API 없음
- 파인튜닝 불가
- 출력 비용 높음
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
2Gemini 2.5 Flash
Mid-tier빠르고 효율적인 생성
사용 시기: 프로덕션 앱에 놀라운 가치 — 1M 컨텍스트에 $0.15/1M 입력 토큰.
업그레이드 하이라이트
- ◆Pro와 동일한 1M 컨텍스트를 1/8 입력 가격에 ($0.15 vs $1.25/M)
- ◆최대 65K 출력 — 생성 용량에서 Pro 계층과 동일
- ◆컨텍스트 캐싱: $0.0375/M — 캐시된 접두사에 대해 97% 절감
- ◆관대한 속도 제한이 있는 무료 계층 — 제로 비용으로 프로덕션 준비
- ◆서브 밀리초 지연 — 실시간 앱을 위한 가장 빠른 Google 모델
장점
- Pro와 동일한 1M 컨텍스트를 1/8 가격에
- 최대 65K 출력
- 최고의 캐시된 입력 절감
단점
- 배치 API 없음
- 어려운 작업에서 Pro보다 낮은 품질
- 파인튜닝 불가
성능
멀티모달
벤치마크
Gemini 2.0 Flash
Lite초고속, 저비용
사용 시기: 대량 추출, 분류 및 파인튜닝 모델을 위한 최고의 예산 옵션입니다.
업그레이드 하이라이트
- ◆1M 컨텍스트를 갖춘 최저가 모델: 입력 $0.10/M — 시장 최저
- ◆파인튜닝 + 비전을 지원하는 유일한 라이트 모델 — 전체 기능 세트
- ◆컨텍스트 캐싱: $0.025/M — 반복 접두사에 대해 97.5% 절감
- ◆최대 출력 8K는 낮음 — 2.5 Flash로 업그레이드 시 65K 출력
- ◆파인튜닝 지원 — 도메인 특화 분류 모델에 최적
장점
- 1M 컨텍스트를 갖춘 시장 최저가 모델
- 파인튜닝 + 비전을 지원하는 유일한 라이트 모델
- 전체 기능 세트
단점
- 최대 출력 8K는 낮음
- 오래된 지식 기준
- 2.5 Flash 이하의 품질
성능
멀티모달
벤치마크
DiffusionGemma
Mid-tier빠른 로컬 텍스트 생성, 병렬 디코딩
사용 시기: 소비자용 GPU에서 빠른 로컬 텍스트 생성이 필요하고, 일부 품질을 희생해 4배 속도를 얻을 수 있을 때 사용하세요.
업그레이드 하이라이트
- ◆26B 총 MoE, 3.8B 활성 — 단일 24GB GPU에서 실행
- ◆확산 기반 병렬 디코딩으로 4배 빠른 텍스트 생성
- ◆Apache 2.0 오픈소스 — 어디서나 배포, 자유롭게 미세 조정
- ◆양방향 컨텍스트로 자체 수정 가능
- ◆트레이드오프: 표준 Gemma 4 대비 낮은 벤치마크 점수
장점
- 병렬 확산 디코딩을 통해 표준 Gemma보다 4배 빠름
- 26B MoE, 활성 파라미터 3.8B만 사용 — 24GB VRAM에 적합
- Apache 2.0 오픈소스 — 전체 가중치 제공
- 양방향 컨텍스트로 자체 수정 가능
단점
- 모든 벤치마크에서 표준 Gemma 4에 뒤처짐
- 비전 또는 오디오 지원 없음
- 함수 호출 없음
- 실험 단계 — 프로덕션 중요 작업에는 부적합
성능
멀티모달
벤치마크
나란히 비교
| 모델 | 등급 | 입력 | 출력 | 컨텍스트 |
|---|---|---|---|---|
| Gemini 3.7 Flash | Mid-tier | $0.750 | $3.75 | 1.0M |
| Gemini 3.1 Pro | Flagship | $2.00 | $12.00 | 1M |
| Gemini 3.5 Pro | Flagship | $1.25 | $10.00 | 1M |
| Gemini Omni Flash | Mid-tier | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash | Mid-tier | $1.50 | $9.00 | 1M |
| Gemini 3.1 Flash-Lite | Lite | $0.250 | $1.50 | 1M |
| Gemini 2.5 Pro | Flagship | $1.25 | $10.00 | 1.0M |
| Gemini 2.5 Flash | Mid-tier | $0.150 | $0.600 | 1.0M |
| Gemini 2.0 Flash | Lite | $0.100 | $0.400 | 1.0M |
| DiffusionGemma | Mid-tier | $0.0000 | $0.0000 | 262K |