이 문서는 컴퓨트 섹션의 일부입니다.
Instance Pool이란?
💡 Instance Pool(인스턴스 풀) 은 유휴 클라우드 인스턴스를 미리 확보해 두는 대기실 입니다. 클러스터가 시작될 때 새 인스턴스를 클라우드에 요청하는 대신, 풀에 미리 준비된 인스턴스를 즉시 할당받아 클러스터 시작 시간을 크게 단축 합니다.
왜 Instance Pool이 필요한가요?
Databricks 클러스터를 시작하면 다음 과정이 순차적으로 진행됩니다.💡 비유: Instance Pool은 “렌터카 대기장”과 같습니다. 매번 공장에서 차를 생산(인스턴스 생성)하는 대신, 대기장에 미리 준비된 차(유휴 인스턴스)를 바로 가져가는 것입니다.
Instance Pool의 동작 원리
Instance Pool 개념:Pool 설정
UI에서 생성
Workspace → Compute→ Pools 탭 → Create Pool 버튼을 클릭합니다.주요 설정 항목
API / JSON 설정 예시
설정 항목 상세
Min Idle Instances (최소 유휴 인스턴스)
Max Capacity (최대 용량)
풀이 동시에 보유할 수 있는 인스턴스의 상한입니다. 이 값을 초과하면 클러스터는 풀을 우회하여 직접 클라우드에서 인스턴스를 요청합니다.Idle Instance Auto Termination (유휴 자동 종료)
유휴 상태인 인스턴스가 지정 시간 동안 사용되지 않으면 자동으로 종료 되어 비용을 절감합니다.Min Idle Instances로 설정한 수만큼은 유지됩니다.
Pool을 클러스터에 연결
UI에서 연결
- Compute→ 클러스터 생성/편집
- Advanced Options→ Instances 탭
- Driver Pool 및 Worker Pool 드롭다운에서 풀을 선택합니다
클러스터 JSON 설정
Databricks Asset Bundle 설정
⚠️ 주의: Pool을 사용하는 클러스터에서는 node_type_id를 별도로 지정할 수 없습니다. 인스턴스 유형은 Pool의 설정을 따릅니다.
비용 분석
유휴 인스턴스 비용 vs 시작 시간 절감
💡 위 예시는 m5.xlarge (AWS, On-Demand $0.192/hr) 기준이며, 팀 규모와 클러스터 시작 빈도에 따라 달라집니다. 일반적으로 하루에 3회 이상 클러스터를 시작하는 팀 이라면 Pool 사용이 경제적입니다.