기술과 일상을 함께 기록합니다.
Kafka 데이터를 Spark Structured Streaming으로 읽는 흐름을 살펴보고, 오프셋·체크포인트·출력 저장소의 복구 역할을 구분한다.
Spark의 Driver·Executor·RDD 구조와 변환·액션의 실행 흐름을 살펴보고, SQL·스트리밍·머신러닝 구성 요소를 정리한다.