Gemini 1.5 Pro & Flash 아키텍처의 특징
Google의 Gemini 1.5 프로 및 플래시 모델은 업계 최초로 최대 200만 토큰(2M Context Window)의 대용량 문맥 처리 기능을 제공합니다.
비디오 1시간, 오디오 11시간, 소스코드 60,000줄을 한 번의 프롬프트에 통째로 입력하고 지능형 추론 및 Q&A를 진행할 수 있습니다.
1.5 Pro vs 1.5 Flash 모델 비교
| 모델 (Model) | 주요 특징 | 추천 유즈케이스 |
| :--- | :--- | :--- |
| Gemini 1.5 Pro | 복잡한 코딩, 깊이 있는 추론, 대용량 파일 다중 분석 | 시스템 설계, 레거시 코드 리팩터링, 연구 보고서 |
| Gemini 1.5 Flash | 서브 밀리초 속도, 저렴한 토큰 비용, 경량화 추론 | 챗봇 응답, 실시간 요약, 대량 데이터 파싱 |
💡 핵심 Gemini AI 용어 사전 (Glossary)
- Gemini (제미나이): Google DeepMind 팀이 개발한 멀티모달 텍스트, 코드, 이미지, 오디오 융합 거대 언어 모델 family.
- Context Window (문맥 윈도우): AI 모델이 단일 요청(Prompt)에서 한 번에 기억하고 처리할 수 있는 최대 토큰 입력량.
- Multimodal (멀티모달): 텍스트뿐만 아니라 이미지, 비디오, 음성, PDF 파일 등 다양한 형태의 입력을 동시에 파싱하고 추론하는 인공지능 능력.
Gemini 체크리스트
- [ ] 200만 토큰 용량에 맞는 최적의 1.5 Pro / Flash 모델을 선택했는가?
- [ ] Google AI Studio API Key 발급 및 보안 환경 변수가 수립되었는가?