변환 노드
입력 필드를 표준화하는 것은 회귀 분석, 로지스틱 회귀 분석, 판별 분석과 같은 전통적인 점수 산정 기법을 사용하기 전에 중요한 단계입니다. 이러한 기법들은 많은 원시 데이터 파일에 적용되지 않을 수 있는 데이터의 정규 분포에 대한 가정을 전제로 합니다. 실제 데이터를 다루는 한 가지 접근 방식은 원시 데이터 요소를 좀 더 정상적인 분포로 이동시키는 변환을 적용하는 것입니다. 또한 정규화된 필드는 서로 쉽게 비교할 수 있습니다. 예를 들어, 원시 데이터 파일에서 소득과 연령은 완전히 다른 척도로 표시되지만, 정규화하면 각 항목의 상대적 영향을 쉽게 해석할 수 있습니다.
변환 노드는 사용하기 가장 좋은 변환을 신속하게 시각적으로 평가할 수 있는 출력 뷰어를 제공합니다. 변수가 정상적으로 분포되어 있는지 한눈에 확인할 수 있으며, 필요한 경우 원하는 변환을 선택하여 적용할 수 있습니다. 여러 필드를 선택하고 필드별로 하나의 변환을 수행할 수 있습니다.
필드에 대해 선호하는 변환을 선택한 후, 변환을 수행하는 파생 또는 필러 노드를 생성하고 이 노드를 흐름에 연결할 수 있습니다. 파생 노드는 새로운 필드를 생성하는 반면, 채우기 노드는 기존의 필드를 변형합니다.
노드 필드 설정 변환
노드 속성의 FIELDS 섹션에서, 가능한 변형 사항을 확인하고 적용하는 데 사용할 데이터의 필드를 지정할 수 있습니다. 숫자 필드만 변환할 수 있습니다. 하나 이상의 숫자 필드를 선택합니다.