Accéder aux résultats de l'exécution du flux

De nombreux nœuds d' SPSS Modeler s produisent des objets de sortie tels que des modèles, des graphiques et des données tabulaires. Beaucoup de ces résultats contiennent des valeurs utiles qui peuvent être utilisées par des scripts pour guider les exécutions ultérieures. Ces valeurs sont regroupées dans des conteneurs de contenu (appelés simplement conteneurs) accessibles à l'aide de balises ou d'identifiants qui identifient chaque conteneur. La manière dont ces valeurs sont accessibles dépend du format ou du « modèle de contenu » utilisé par ce conteneur.

Par exemple, de nombreux résultats de modèles prédictifs utilisent une variante du langage XML appelée PMML pour représenter des informations sur le modèle, telles que les champs utilisés par un arbre de décision à chaque division, ou la manière dont les neurones d'un réseau neuronal sont connectés et avec quelles forces. Les sorties de modèles qui utilisent PMML fournissent un modèle de contenu XML qui peut être utilisé pour accéder à ces informations. Par exemple :

stream = modeler.script.stream()
# Assume the flow contains a single C5.0 model builder node
# and that the datasource, predictors, and targets have already been
# set up
modelbuilder = stream.findByType("c50", None)
results = []
modelbuilder.run(results)
modeloutput = results[0]

# Now that we have the C5.0 model output object, access the
# relevant content model
cm = modeloutput.getContentModel("PMML")

# The PMML content model is a generic XML-based content model that
# uses XPath syntax. Use that to find the names of the data fields.
# The call returns a list of strings match the XPath values
dataFieldNames = cm.getStringValues("/PMML/DataDictionary/DataField", "name")

SPSS Modeler prend en charge les modèles de contenu suivants dans les scripts :

  • Le modèle de contenu de tableau permet d'accéder aux données tabulaires simples représentées sous forme de lignes et de colonnes.
  • Le modèle de contenu XML permet d'accéder au contenu stocké au format XML.
  • Le modèle de contenu JSON permet d'accéder au contenu stocké au format JSON.
  • Le modèle de contenu des statistiques de colonne permet d'accéder aux statistiques récapitulatives d'un champ spécifique.
  • Le modèle de contenu de statistiques de colonne par paire permet d'accéder à des statistiques récapitulatives entre deux champs ou des valeurs entre deux champs distincts.
Notez que les nœuds suivants ne contiennent pas ces modèles de contenu :
  • Série temporelle
  • Discriminant
  • SLRM
  • Tous les nœuds Extension
  • Tous les nœuds de modélisation de base de données