Skip to main content
Azure Synapse는 빅데이터, 데이터 과학, 데이터 웨어하우징을 결합하여 빠르고 대규모 데이터 분석을 지원하는 통합 분석 서비스입니다. Synapse에서 Spark 풀은 필요에 따라 확장 가능한 Apache Spark 클러스터를 제공하므로, 복잡한 데이터 변환, 머신 러닝, 외부 시스템과의 통합을 실행할 수 있습니다. 이 문서에서는 Azure Synapse에서 Apache Spark를 사용할 때 ClickHouse Spark 커넥터를 연동하는 방법을 설명합니다.

커넥터의 종속성 추가

Azure Synapse는 패키지 관리를 다음 3개 수준에서 지원합니다:
  1. 기본 패키지
  2. Spark 풀 수준
  3. 세션 수준

Apache Spark 풀용 라이브러리 관리 가이드를 따라 Spark 애플리케이션에 다음 필수 종속성을 추가하세요.
  • clickhouse-spark-runtime-{spark_version}_{scala_version}-{connector_version}.jar - 공식 Maven
  • clickhouse-jdbc-{java_client_version}-all.jar - 공식 Maven
요구 사항에 맞는 버전을 확인하려면 Spark Connector 호환성 매트릭스 문서를 참조하십시오.

ClickHouse를 catalog로 추가

세션에 Spark 구성을 추가하는 방법은 여러 가지가 있습니다:
  • 세션과 함께 로드할 사용자 지정 설정 파일
  • Azure Synapse UI를 통해 구성 추가
  • Synapse 노트북에서 구성 추가
다음 Apache Spark 구성 관리를 참고하여 커넥터에 필요한 Spark 구성을 추가하십시오. 예를 들어, 노트북에서 다음 설정으로 Spark 세션을 구성할 수 있습니다:
다음과 같이 첫 번째 셀에 표시되는지 확인하십시오: 추가 설정은 ClickHouse Spark configurations page를 참조하십시오.
ClickHouse Cloud를 사용하는 경우 필수 Spark 설정을 반드시 지정하십시오.

설정 확인

종속성과 구성이 성공적으로 설정되었는지 확인하려면 현재 세션의 Spark UI를 열고 Environment 탭으로 이동하십시오. 해당 탭에서 ClickHouse 관련 설정을 찾으십시오:

추가 자료

마지막 수정일 2026년 7월 3일