이 문서는 플랫폼 비교 섹션의 일부입니다.
Serverless, Clusters, Scaling
참고 Databricks Photon 엔진: C++ 네이티브 벡터화 실행 엔진으로, TPC-DS 100TB 벤치마크에서 업계 최고 수준의 가격 대비 성능을 달성합니다. Liquid Clustering 은 파티셔닝의 진화로, 데이터 레이아웃을 자동 최적화하여 수동 OPTIMIZE 없이 최적의 쿼리 성능을 유지합니다.
주의 경쟁사 장점: BigQuery는 프로비저닝 없이 완전 서버리스로 동작하여 관리 오버헤드가 가장 낮습니다. Snowflake는 Auto-suspend/Auto-resume이 매우 직관적이며, 멀티 클러스터 자동 확장이 간단합니다.
Photon 엔진 상세
Photon이란?
Photon 은 Databricks가 자체 개발한 C++ 네이티브 벡터화 쿼리 실행 엔진 입니다. Apache Spark의 JVM 기반 엔진을 대체하여 SQL 및 DataFrame 워크로드에서 최대 12배 성능 향상 을 달성합니다.Photon 성능 벤치마크
참고 Photon은 추가 설정 없이 자동 적용 됩니다. SQL Warehouse에서는 기본 활성화되어 있으며, All-Purpose Cluster에서도 Photon 옵션을 켜면 즉시 적용됩니다. 기존 Spark SQL 코드를 수정할 필요가 없습니다.
경쟁사 쿼리 엔진과의 비교
Serverless vs Classic 컴퓨팅 상세
Databricks 컴퓨팅 옵션
Serverless 선택 가이드
경쟁사 서버리스 비교
자동 스케일링 메커니즘 비교
Databricks 지능형 자동 스케일링
경쟁사 자동 스케일링
스케일링 시나리오별 동작 비교
시나리오: 동시 쿼리 50→200으로 급증 (월말 보고서)비용 모델 상세: DBU vs 크레딧 vs 슬롯
과금 단위 개념 비교
Databricks DBU 워크로드별 가격 (참고)
주의 가격은 클라우드(AWS/Azure/GCP)와 리전에 따라 다릅니다. 위 수치는 참고용이며, 정확한 가격은 Databricks Pricing 페이지에서 확인하세요. 커밋 사용(PAYGO/Commit) 계약으로 추가 할인이 가능합니다.
Liquid Clustering vs 경쟁사 데이터 레이아웃
데이터 레이아웃 최적화 비교
참고
Liquid Clustering의 혁신: 기존 Hive-style 파티셔닝의 고려사항(파티션 키 변경 불가, 소규모 파티션 문제, Z-Order 비용)을 완전히 해결합니다. ALTER TABLE ... CLUSTER BY (col1, col2) 한 줄로 적용되며, 기존 데이터는 점진적으로 재배치됩니다.
GPU 컴퓨팅 및 ML 학습 인프라 비교
GPU 인스턴스 유형별 용도
성공 SA/SE 핵심 메시지: Databricks는 동일 플랫폼에서 CPU(SQL/ETL)와 GPU(ML/AI) 워크로드를 모두 실행 할 수 있으며, Unity Catalog로 데이터→모델→서빙 전체 거버넌스를 통합합니다. SageMaker나 Vertex AI는 데이터 플랫폼과 분리되어 있어 데이터 복사와 거버넌스 이중화가 불가피합니다.
워크로드 격리 및 리소스 관리
워크로드 격리 방식 비교
Databricks 워크로드 격리 베스트 프랙티스
참고 비용 최적화 팁: SQL Warehouse와 Serverless Compute는 유휴 시 자동 종료되므로 비용이 사용량에 정확히 비례합니다. All-Purpose Cluster는 Auto-terminate를 반드시 설정하여 유휴 비용을 방지하세요.