Data Refinery 에서 Hadoop 클러스터의 데이터 세분화
Hadoop 클러스터에서 데이터를 세분화할 때 대형 데이터 세트에 대한 Hadoop 지원을 활용하십시오.
Hadoop 환경을 사용하는 경우 데이터를 정제하기 위해 다음 Hadoop 실행 엔진 연결을 사용할 수 있습니다:
- Hadoop 분산 파일 시스템 (HDFS) 파일 용 HDFS via Execution Engine for Hadoop
- Hive 웨어하우스 의 테이블에 저장된 데이터의 경우 Hive via Execution Engine for Hadoop
- Hadoop 클러스터의 Impala 의 테이블에 저장된 데이터의 경우 Impala via Execution Engine for Hadoop
Hadoop 환경 문제 해결 항목도 참조하십시오.