개발자 영역으로 돌아가기

Google 모델

Google의 모든 10개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.

10
모델
$0.0000
최저 입력
1.0M
최대 컨텍스트
3
품질 등급

빠른 추천

최고 가성비: DiffusionGemma ($0.0000/1M)
최고 품질: Gemini 3.1 Pro

Gemini 3.7 Flash

신규Mid-tier

Coding, instruction following

공식 가격

사용 시기: Best pick for high-volume coding assistants, agentic pipelines and tool-calling workloads on a budget.

업그레이드 하이라이트

  • GA on August 13, 2026 — three weeks after Gemini 3.6 Flash
  • Priced at half of Gemini 3.6 Flash: $0.75 input / $3.75 output per 1M
  • 1,048,576-token context, 65,536-token max output
입력 가격
$0.750
per 1M tokens
출력 가격
$3.75
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 65,536 tokens
지식 기준일: 2026-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • Google's most intelligent Flash model (GA Aug 13, 2026)
  • Purpose-built for coding and agents
  • 1M context at $0.75/$3.75 — half the price of Gemini 3.6 Flash

단점

  • Below Pro-tier reasoning on the hardest tasks
  • Very new — ecosystem tooling still catching up

성능

출력 속도~120 tok/s
속도 제한

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

Gemini 3.1 Pro

Flagship

고급 추론, 코딩

공식 가격

사용 시기: 복잡한 추론 및 전문 코딩 작업에 가장 적합한 Google 모델입니다.

업그레이드 하이라이트

  • MMLU: 89.2% — Gemini 2.5 Pro 대비 크게 개선된 추론
  • 1M 컨텍스트 및 65K 출력 — 동일한 컨텍스트, 더 나은 품질
  • 50% 배치 할인($1/$6) — 가장 저렴한 배치 플래그십
  • 컨텍스트 캐싱: $0.50/M — 반복 접두사에 대해 75% 절감
  • 유료 전용 프리뷰 — 무료 티어 없음, 프로덕션급 안정성
입력 가격
$2.00
per 1M tokens
출력 가격
$12.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$1.00
per 1M tokens
컨텍스트 창: 1M
최대 출력: 65,536 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드

장점

  • 1M 컨텍스트 및 65K 출력
  • 3.0 대비 크게 개선된 추론
  • 50% 배치 할인 가능

단점

  • 무료 티어 없음(유료 전용 프리뷰)
  • 200K 이상의 긴 컨텍스트 입력 2배
  • 아직 성숙 중

성능

출력 속도~55 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
89.2%
SWE-bench Verified
68.0%
GPQA
74.5%

Gemini 3.5 Pro

Flagship

복잡한 코딩, 고급 수학, 심층 추론

공식 가격

사용 시기: 정확성이 가장 중요한 복잡한 코딩, 고급 수학, 심층 추론 작업에 가장 적합한 Google 모델입니다.

업그레이드 하이라이트

  • 3.1 Pro 대비 추론 성능이 개선된 최신 플래그십
  • 계층형 가격의 100만 컨텍스트: $1.25/$10 (≤200K), $2.50/$15 (>200K)
  • 요금 제한이 있는 무료 티어 제공 — 무료 액세스가 가능한 유일한 플래그십
  • 50% 배치 할인 ($0.625/$5) — 가장 저렴한 배치 플래그십
  • 컨텍스트 캐싱: $0.315/M — 반복 접두사에 대해 75% 절감
입력 가격
$1.25
per 1M tokens
출력 가격
$10.00
per 1M tokens
캐시된 입력
$0.315
per 1M tokens
배치 입력
$0.625
per 1M tokens
컨텍스트 창: 1M
최대 출력: 65,536 tokens
지식 기준일: 2026-06
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 계층형 가격의 100만 컨텍스트
  • 최고 수준의 추론 벤치마크
  • 요금 제한이 있는 무료 티어
  • 50% 배치 할인 가능

단점

  • 긴 컨텍스트(>200K) 2배 비쌈
  • 파인튜닝 미지원
  • 출력에 생각 토큰 포함

성능

출력 속도~50 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
90.5%
SWE-bench Verified
72.0%
GPQA
78.0%

이 모델을 사용하는 에이전트

4

Gemini Omni Flash

Mid-tier

멀티모달 생성: 텍스트, 이미지, 오디오, 비디오

공식 가격

사용 시기: 텍스트, 이미지, 오디오, 비디오를 하나의 모델로 아우르는 멀티모달 창의적 작업에 가장 적합합니다.

업그레이드 하이라이트

  • 텍스트, 이미지, 오디오, 비디오를 기본적으로 통합한 최초의 최상위 모델
  • 입력: 모든 모달리티(텍스트/이미지/비디오/오디오)에 대해 $1.50/M
  • 텍스트 출력: $9/M — 비디오 출력: $17.50/M (~720p에서 초당 $0.10)
  • 에이전트 기반 창의적 워크플로우 및 실시간 비디오 편집 지원
입력 가격
$1.50
per 1M tokens
출력 가격
$9.00
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1M
최대 출력: 65,536 tokens
지식 기준일: 2026-06
비전함수 호출파인튜닝JSON 모드

장점

  • 최초의 기본 통합 텍스트/이미지/오디오/비디오 모델
  • 실시간 비디오 조작
  • 모든 모달리티에 대해 입력 $1.50/M
  • 에이전트 기반 창의적 워크플로우

단점

  • 비디오 출력 $17.50/M은 비쌈
  • 무료 티어 없음
  • 프리뷰 — 변경될 수 있음

성능

출력 속도~60 tok/s
속도 제한3,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

Gemini 3.5 Flash

Mid-tier

빠르고 지능적인 생성

공식 가격

사용 시기: 멀티모달 기능이 필요한 프로덕션 앱에 속도와 지능의 최적 균형을 제공합니다.

업그레이드 하이라이트

  • 중간 가격대의 최첨단 지능 — Gemini 2.5 Pro 품질과 동등
  • 1M 컨텍스트 + 65K 출력, $1.50/$9 — 플래그십 대비 8배 저렴
  • 요금 제한이 있는 무료 티어 제공 — Google 최고의 무료 티어 모델
  • 컨텍스트 캐싱: $0.375/M — 캐시된 입력에 대해 75% 절감
  • 플래시 속도의 멀티모달(텍스트 + 비전) — 일반적으로 1초 미만 지연 시간
입력 가격
$1.50
per 1M tokens
출력 가격
$9.00
per 1M tokens
캐시된 입력
$0.375
per 1M tokens
배치 입력
$0.750
per 1M tokens
컨텍스트 창: 1M
최대 출력: 65,536 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 중간 가격대의 최첨단 지능
  • 1M 컨텍스트 + 65K 출력
  • 요금 제한이 있는 무료 티어

단점

  • 3.1 Flash-Lite보다 비쌈
  • $9/M의 출력 비용은 대규모 사용 시 부담
  • 파인튜닝 없음

성능

출력 속도~95 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
86.5%
HumanEval
85.0%
MATH
73.0%

Gemini 3.1 Flash-Lite

Lite

대량 처리, 저지연 작업

공식 가격

사용 시기: 대량 분류, 추출 및 경량 생성에 가장 적합한 예산 모델입니다.

업그레이드 하이라이트

  • 100만 컨텍스트에 $0.25/M 입력 — Gemini 2.5 Flash보다 6배 저렴
  • 최대 65K 출력 — 라이트 가격에 Pro 등급과 동일
  • 컨텍스트 캐싱: $0.0625/M — 90% 절감, 최고의 캐싱 가치
  • 배치 API: $0.125/$0.75 — 비동기 처리 시 50% 절감
  • 요금 제한이 있는 무료 등급 — 무료로 무제한 프로토타이핑
입력 가격
$0.250
per 1M tokens
출력 가격
$1.50
per 1M tokens
캐시된 입력
$0.063
per 1M tokens
배치 입력
$0.125
per 1M tokens
컨텍스트 창: 1M
최대 출력: 65,536 tokens
지식 기준일: 2025-04
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 100만 컨텍스트에 $0.25/M 입력 — 놀라운 가치
  • 최대 65K 출력
  • 90% 컨텍스트 캐싱 절감

단점

  • 복잡한 작업에서 3.5 Flash보다 낮은 품질
  • 파인튜닝 불가
  • 신규 모델, 검증 부족

성능

출력 속도~130 tok/s
속도 제한15,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
79.0%
HumanEval
74.5%

Gemini 2.5 Pro

Flagship

복잡한 추론, 긴 컨텍스트

공식 가격

사용 시기: 최고의 가성비 플래그십 모델 — GPT-4.1이나 Claude Sonnet보다 저렴한 비용으로 100만 컨텍스트 제공.

업그레이드 하이라이트

  • 가장 저렴한 플래그십 입력: $1.25/M — GPT-4.1보다 40% 저렴
  • 100만 컨텍스트 윈도우 및 65K 출력 — 플래그십 중 최대 출력
  • 컨텍스트 캐싱: $0.315/M — 반복 접두사에 대해 75% 절감
  • 무료 티어 제공 — 무료 액세스가 가능한 유일한 플래그십 모델
  • MMLU: 85.4% — 절반 비용으로 GPT-4.1과 경쟁력 있음
입력 가격
$1.25
per 1M tokens
출력 가격
$10.00
per 1M tokens
캐시된 입력
$0.315
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 65,536 tokens
지식 기준일: 2025-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 100만 토큰 컨텍스트 윈도우
  • 가장 저렴한 플래그십 입력: $1.25
  • 최대 65K 출력

단점

  • 배치 API 없음
  • 파인튜닝 불가
  • 출력 비용 높음

성능

출력 속도~50 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
85.4%
SWE-bench Verified
63.8%
MATH
72.0%

이 모델을 사용하는 에이전트

2

Gemini 2.5 Flash

Mid-tier

빠르고 효율적인 생성

공식 가격

사용 시기: 프로덕션 앱에 놀라운 가치 — 1M 컨텍스트에 $0.15/1M 입력 토큰.

업그레이드 하이라이트

  • Pro와 동일한 1M 컨텍스트를 1/8 입력 가격에 ($0.15 vs $1.25/M)
  • 최대 65K 출력 — 생성 용량에서 Pro 계층과 동일
  • 컨텍스트 캐싱: $0.0375/M — 캐시된 접두사에 대해 97% 절감
  • 관대한 속도 제한이 있는 무료 계층 — 제로 비용으로 프로덕션 준비
  • 서브 밀리초 지연 — 실시간 앱을 위한 가장 빠른 Google 모델
입력 가격
$0.150
per 1M tokens
출력 가격
$0.600
per 1M tokens
캐시된 입력
$0.037
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 65,536 tokens
지식 기준일: 2025-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • Pro와 동일한 1M 컨텍스트를 1/8 가격에
  • 최대 65K 출력
  • 최고의 캐시된 입력 절감

단점

  • 배치 API 없음
  • 어려운 작업에서 Pro보다 낮은 품질
  • 파인튜닝 불가

성능

출력 속도~100 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
83.0%
HumanEval
82.5%
MATH
68.0%

이 모델을 사용하는 에이전트

4

Gemini 2.0 Flash

Lite

초고속, 저비용

공식 가격

사용 시기: 대량 추출, 분류 및 파인튜닝 모델을 위한 최고의 예산 옵션입니다.

업그레이드 하이라이트

  • 1M 컨텍스트를 갖춘 최저가 모델: 입력 $0.10/M — 시장 최저
  • 파인튜닝 + 비전을 지원하는 유일한 라이트 모델 — 전체 기능 세트
  • 컨텍스트 캐싱: $0.025/M — 반복 접두사에 대해 97.5% 절감
  • 최대 출력 8K는 낮음 — 2.5 Flash로 업그레이드 시 65K 출력
  • 파인튜닝 지원 — 도메인 특화 분류 모델에 최적
입력 가격
$0.100
per 1M tokens
출력 가격
$0.400
per 1M tokens
캐시된 입력
$0.025
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 8,192 tokens
지식 기준일: 2024-08
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 1M 컨텍스트를 갖춘 시장 최저가 모델
  • 파인튜닝 + 비전을 지원하는 유일한 라이트 모델
  • 전체 기능 세트

단점

  • 최대 출력 8K는 낮음
  • 오래된 지식 기준
  • 2.5 Flash 이하의 품질

성능

출력 속도~140 tok/s
속도 제한15,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
78.5%
HumanEval
75.0%
MATH
62.0%

DiffusionGemma

Mid-tier

빠른 로컬 텍스트 생성, 병렬 디코딩

공식 가격

사용 시기: 소비자용 GPU에서 빠른 로컬 텍스트 생성이 필요하고, 일부 품질을 희생해 4배 속도를 얻을 수 있을 때 사용하세요.

업그레이드 하이라이트

  • 26B 총 MoE, 3.8B 활성 — 단일 24GB GPU에서 실행
  • 확산 기반 병렬 디코딩으로 4배 빠른 텍스트 생성
  • Apache 2.0 오픈소스 — 어디서나 배포, 자유롭게 미세 조정
  • 양방향 컨텍스트로 자체 수정 가능
  • 트레이드오프: 표준 Gemma 4 대비 낮은 벤치마크 점수
입력 가격
$0.0000
per 1M tokens
출력 가격
$0.0000
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 262K
최대 출력: 32,768 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 병렬 확산 디코딩을 통해 표준 Gemma보다 4배 빠름
  • 26B MoE, 활성 파라미터 3.8B만 사용 — 24GB VRAM에 적합
  • Apache 2.0 오픈소스 — 전체 가중치 제공
  • 양방향 컨텍스트로 자체 수정 가능

단점

  • 모든 벤치마크에서 표준 Gemma 4에 뒤처짐
  • 비전 또는 오디오 지원 없음
  • 함수 호출 없음
  • 실험 단계 — 프로덕션 중요 작업에는 부적합

성능

출력 속도~200 tok/s
속도 제한

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
72.0%
HumanEval
68.0%

나란히 비교

모델등급입력출력컨텍스트
Gemini 3.7 FlashMid-tier$0.750$3.751.0M
Gemini 3.1 ProFlagship$2.00$12.001M
Gemini 3.5 ProFlagship$1.25$10.001M
Gemini Omni FlashMid-tier$1.50$9.001M
Gemini 3.5 FlashMid-tier$1.50$9.001M
Gemini 3.1 Flash-LiteLite$0.250$1.501M
Gemini 2.5 ProFlagship$1.25$10.001.0M
Gemini 2.5 FlashMid-tier$0.150$0.6001.0M
Gemini 2.0 FlashLite$0.100$0.4001.0M
DiffusionGemmaMid-tier$0.0000$0.0000262K