Impala를 이용한 데이터 웨어하우징 및 Flink 실시간 스트림 처리 연동
이 문서에서는 대규모 데이터 분석을 위해 Apache Impala를 활용하여 SQL 기반 데이터 웨어하우징 작업을 수행하는 방법과, Apache Flink를 사용하여 Apache Kafka와 연동하여 실시간 스트림 데이터를 처리하는 애플리케이션을 개발하는 과정을 다룹니다.
빅데이터 클러스터 환경 구성
Impala와 Flink를 사용하기 위해서는 Hadoop, Impala, Kafka, Flink, Zookeeper, Rang ...
7월 19일 22:10에 게시됨