Leitura no texto de origem

É possível usar o nó Identificador de linguagem para identificar a linguagem natural de um campo de texto em seus dados de origem. A saída desse nó é um campo derivado que contém o código de linguagem detectado.

Nó identificador de linguagem

Dados para mineração de texto podem estar em qualquer um dos formatos padrão que são usados pelos fluxos SPSS Modeler , incluindo bancos de dados ou outros formatos "retangulares" que representam dados em linhas e colunas.

  • Para ler em texto a partir de qualquer um dos formatos de dados padrão utilizados pelo SPSS Modeler fluxos, como um banco de dados com um ou mais campos de texto para comentários do cliente, você pode utilizar um nó Importação.
  • Quando você está processando grandes quantidades de dados, que podem incluir texto em vários idiomas diferentes, use o nó Identificador de Idiomas para identificar a linguagem utilizada em um campo específico.