Use o Laboratório de Regras para testar e aperfeiçoar suas regras de análise de links de texto (TLA), executando simulações em dados de texto de amostra.
Antes de iniciar
Para utilizar o Rule Lab, é necessário ter recursos linguísticos com regras TLA definidas em pelo menos uma biblioteca.Ao contrário dos outros recursos avançados, as regras do TLA são específicas de cada biblioteca. Você só pode usar as regras TLA de uma biblioteca por vez. Você pode acessar a guia “Regras de links de texto” no Editor de recursos para especificar a biblioteca que contém as regras TLA que deseja usar.
Sobre essa tarefa
Você pode usar o Laboratório de Regras para testar como um texto de amostra se ajusta às suas regras TLA durante o processo de extração. Ao testar amostras menores, você pode criar novas regras e verificar o desempenho das regras existentes. Você pode então aperfeiçoar as regras antes de processar conjuntos de dados maiores.
Procedimento
- No Text Analytics Workbench, clique em .
- Na caixa de diálogo Dados de simulação, digite o texto que você deseja testar.
Dica: você pode clicar no ícone
“Preencher” para preencher automaticamente o campo de texto com todos os exemplos de texto de todas as regras TLA do seu modelo. Você pode então verificar se todos os seus padrões de texto existentes estão em conformidade com as regras atuais.
- Clique em “Executar simulação ”.
O simulador utiliza suas configurações de extração atuais e seus recursos linguísticos para analisar o texto e aplicar suas regras de TLA.
- Analise os resultados da simulação no painel "Simulação do laboratório de regras":
O texto que você digita é dividido em frases ou expressões. O painel "Simulação do laboratório de regras" mostra os resultados individuais para cada frase ou expressão. Você pode percorrer os resultados para ver todas as frases e expressões extraídas. A frase ou expressão está destacada no painel e pode também apresentar uma marca de seleção:
- A ausência de uma marca de seleção significa que o trecho de texto não corresponde ao texto de exemplo de nenhuma regra.
- Uma marca de seleção verde significa que a amostra de texto corresponde ao texto de exemplo de uma regra TLA.
- Uma marca de verificação vermelha significa que a amostra de texto corresponde ao texto de exemplo da regra TLA, mas que a amostra também se encaixa no padrão de outras regras. Pode ser que haja regras duplicadas, ou que as regras precisem ser aperfeiçoadas.
- Consulte a primeira tabela para ver como os tokens foram identificados e classificados.
- Token de texto de entrada
- Mostra cada palavra ou frase identificada durante o processo de extração.
- Digitado como
- O tipo atribuído ao token. Para tokens identificados como conceitos, o nome do tipo associado é exibido nesta coluna, como
<Person> ou <Location>.
- Macro correspondente
- Quaisquer macros dos seus recursos linguísticos que tenham correspondido ao token. A macro de correspondência determina o tipo atribuído.
- Verifique a tabela de regras correspondentes para ver quais regras TLA corresponderam à amostra:
- Conjunto de Regras
- O conjunto de regras ao qual a regra TLA pertence.
- Saída da regra
- O nome da regra TLA. Você pode clicar nele para abrir a guia “Links de texto” e ver a regra TLA.
- Conceito 1 e Tipo 1
- Essas colunas mostram os valores de saída associados (pares de conceito e tipo) para cada regra correspondente. A regra também exibe os tipos e as macros correspondentes (por exemplo, mPronoun e mTopic ).
- Opcional: Se você quiser gerar uma nova regra com base nos resultados da simulação, clique em “Gerar regra ”.
É adicionada uma nova regra TLA baseada na simulação. Você pode clicar em
“Exibir regra” na janela pop-up da notificação para visualizar a regra na guia “
Links de texto ” dentro da guia
“Editor de recursos” e fazer alterações.
Depois de visualizar e editar a nova regra, você pode clicar em " Laboratório de regras " para voltar ao painel "Simulação do laboratório de regras".
O que fazer a seguir
Depois de modificar as regras ou alterar as configurações de extração, você pode clicar em “Testar nova simulação” para refazer o teste com os mesmos dados de amostra ou com uma amostra diferente. Esse processo iterativo ajuda você a refinar suas regras até obter os resultados desejados.
Ao concluir a execução das simulações, você pode seguir algumas das etapas a seguir:
- Salve as alterações nos recursos linguísticos.
- Execute uma extração completa do seu conjunto de dados para aplicar as regras refinadas.
- Analise os resultados dos padrões TLA na guia “Links de texto ” para verificar se suas regras geram os padrões esperados.