Noeuds prenant en charge le SQL pushback
Les tableaux suivants présentent les nœuds qui représentent les opérations d'exploration de données prenant en charge le pushback SQL. Si un noeud n'apparaît pas dans ces tableaux, c'est qu'il ne se prête pas au SQL pushback.
| Noeuds acceptant la génération de SQL | Remarques |
|---|---|
| Agréger | La prise en charge de la génération SQL pour l'agrégation dépend du type de stockage des données. |
| Ajouter | Prend en charge la génération si les entrées ne sont pas triées. L'optimisation SQL n'est possible que lorsque les entrées possèdent le même nombre de colonnes. |
| Distinguer | Un noeud Distinguer avec le mode par défaut Créer un enregistrement composite pour chaque groupe sélectionné ne prend pas en charge l'optimisation SQL. |
| Fusionner | Aucun code SQL n'est généré pour la fusion par ordre. La fusion par clé avec les jointures externe complète ou partielle est seulement prise en charge si la base de données/le pilote la prend en charge. Les champs de saisie qui ne correspondent pas peuvent être renommés à l'aide d'un nœud de filtre ou des paramètres de filtre d'un nœud d'importation. Prend en charge la génération SQL pour la fusion conditionnelle. Pour tous les types de fusion, |
| Agréger RFM | Prend en charge la génération sauf en cas d'enregistrement de la date de la deuxième et troisième transactions les plus récentes, ou en cas de prise en compte des transactions récentes. Toutefois,
cette prise en compte fonctionne si la fonction datetime_date(YEAR,MONTH,DAY) est poussée vers la base de données. |
| Exemple | L'échantillonnage simple prend en charge la génération SQL à des degrés variables en fonction de la base de données. |
| Sélectionner | Prend en charge la génération uniquement si la génération SQL pour l'expression de sélection elle-même est prise en charge. Si des champs ont des valeurs nulles, la génération SQL ne donne pas les mêmes résultats pour la suppression que ceux donnés dans SPSS Modelernatif. |
| Trier | Dans l' SPSS Modeler e, bien que le nœud Sort puisse utiliser le pushback SQL, il n'inclut aucune Dans la norme SQL, une table est représentée comme un ensemble non ordonné de lignes. Les lignes n'ont pas d'ordre particulier, sauf indication contraire. De ce fait, certains optimiseurs de bases de données ignorent |
| Mode | Exemple | Taille maximale | Point de départ | Db2 for z/OS | Db2 for OS/400 | Db2 for Win/UNIX | Oracle | SQL Server | Teradata |
|---|---|---|---|---|---|---|---|---|---|
| Inclure | Premier | non disponible | Y | Y | Y | Y | Y | Y | |
| Tous les | désactivé | Y | Y | Y | Y | Y | |||
| maximal | Y | Y | Y | Y | Y | ||||
| % aléatoire | désactivé | désactivé | Y | Y | Y | Y | |||
| activé | Y | Y | Y | ||||||
| maximal | désactivé | Y | Y | Y | Y | ||||
| activé | Y | Y | Y | ||||||
| Annuler | Premier | désactivé | Y | ||||||
| maximal | Y | ||||||||
| Tous les | désactivé | Y | Y | Y | Y | Y | |||
| maximal | Y | Y | Y | Y | Y | ||||
| % aléatoire | désactivé | désactivé | Y | Y | Y | Y | |||
| activé | Y | Y | Y | ||||||
| maximal | désactivé | Y | Y | Y | Y | ||||
| activé | Y | Y | Y |
| Stockage | Somme | Moyenne | Mini | Maxi | Ecart type | Médiane | Nombre | Ecart | Percentile |
|---|---|---|---|---|---|---|---|---|---|
| Entier | Y | Y | Y | Y | Y | O* | Y | Y | O* |
| Réal | Y | Y | Y | Y | Y | O* | Y | Y | O* |
| Date : | Y | Y | O* | Y | O* | ||||
| Durée | Y | Y | O* | Y | O* | ||||
| Horodatage | Y | Y | O* | Y | O* | ||||
| Chaîne | Y | Y | O* | Y | O* |
* La médiane et le percentile sont pris en charge sur Oracle.
| Noeuds acceptant la génération de SQL | Remarques |
|---|---|
| Anonymiser | Prend en charge la génération SQL pour les cibles continues, et une génération SQL partielle pour les cibles nominales et indicateurs. |
| Préparation automatique des données | |
| Regroupement par casiers | La génération SQL est prise en charge si la méthode de regroupement des tuiles (nombre égal) est utilisée et si l'option Lire à partir de l'onglet Valeurs de regroupement si disponible est sélectionnée. En raison des différences dans le mode de calcul des limites de casiers (du fait de la nature de la répartition des données dans les champs de casier), vous pouvez constater des écarts dans la sortie du regroupement par casiers lorsque vous comparez l'exécution de flux normale avec les résultats du SQL pushback. Pour éviter ceci, utilisez la méthode de création de quantiles Nombre d'enregistrements et les quantiles Ajouter au suivant ou Conserver dans l'élément actuel pour obtenir la correspondance la plus proche entre les deux méthodes d'exécution de flux. |
| Calculer | La génération SQL n'est prise en charge que si le code SQL généré à partir de l'expression dérivée est valide. Cependant, SPSS Modeler ne peut pas générer SQL si vous choisissez State ou Count pour l'option Derive as.
|
| Ensemble | Prend en charge la génération SQL pour les cibles continues. Pour les autres champs cible, prend uniquement en charge la génération si la méthode d'ensemble La plus grande confiance gagne est utilisée. |
| Remplacer | La génération SQL est prise en charge si le code SQL généré à partir de l'expression dérivée est valide. |
| Filtrer | |
| Partition | Prend en charge la génération SQL pour affecter des enregistrements aux partitions. |
| Recoder | |
| Restructurer | |
| Analyse RFM | La génération SQL est prise en charge si l'option Lire à partir de l'onglet Valeurs de l'emplacement si disponible est sélectionnée, mais les nœuds en aval ne la prendront pas en charge. |
| Binariser | |
| Type | La génération SQL n'est prise en charge que si le nœud Type est instancié et qu'aucune vérification de type ABORT ou WARN n'est spécifiée. |
| Noeuds acceptant la génération de SQL | Remarques |
|---|---|
| Distribution | |
| Évaluation | |
| Toile d'araignée mondiale |
Pour certains modèles, il est possible de générer du SQL pour le nugget de modèle, ce qui revient à pousser l'étape de scoring du modèle vers la base de données. L'utilisation principale de cette capacité n'est pas d'améliorer les performances, mais de faire en sorte que les flux contenant ces nuggets aient l'intégralité de leur code SQL poussé vers la base de données. Pour plus d'informations, consultez la section « Génération de requêtes SQL à partir de nuggets de modèle ».
| Nuggets de modèle prenant en charge la génération SQL | Remarques |
|---|---|
| Classificateur automatique | Si un adaptateur de scoring de type Fonction définie par l'utilisateur (UDF) est activé, ces nuggets prennent en charge le SQL pushback. En outre, si la Génération SQL pour les cibles continues ou la méthode d'ensemble La confiance la plus élevée l'emporte est utilisée, ces nuggets acceptent davantage d'opérations de pushback en aval. |
| Numérisation automatique | Si un adaptateur de scoring de type Fonction définie par l'utilisateur (UDF) est activé, ces nuggets prennent en charge le SQL pushback. En outre, si la Génération SQL pour les cibles continues ou la méthode d'ensemble La confiance la plus élevée l'emporte est utilisée, ces nuggets acceptent davantage d'opérations de pushback en aval. |
| CHAID | |
| C5.0 | |
| Arbre C&RT | Prend en charge la génération SQL pour l'option d'arbre unique, mais pas pour les options de boosting, de bagging ou de jeux de données volumineux. |
| Liste de décision | |
| Jeu de règles généré | |
| Linéaire | Une pépite de modèle linéaire ne génère du SQL que si vous sélectionnez l'option Score by converting to native SQL. Vous pouvez utiliser la génération SQL pour l'option de modèle standard, mais pas pour les options boosting, bagging ou large dataset. |
| Logistique | Prend en charge la génération SQL pour la procédure multinomiale, mais pas la procédure binomiale. Pour la procédure multinomiale, la génération n'est pas prise en charge lorsque les confiances sont sélectionnées, sauf si le type de cible est Indicateur. |
| Réseau de neurones | Une pépite de modèle de réseau neuronal ne génère du SQL que si vous sélectionnez l'option Score by converting to native SQL. Vous pouvez utiliser la génération SQL pour l'option de modèle standard (perceptron multicouche uniquement), mais pas pour les options boosting, bagging ou large dataset. |
| ACP/Facteur | |
| QUEST |
| Noeuds acceptant la génération de SQL | Remarques |
|---|---|
| Analyse | La prise en charge de la génération dépend des options sélectionnées. |
| Matrice | |
| Rapport | |
| Valeurs globales | |
| Statistiques | Prend en charge la génération si l'option Corrélation n'est pas utilisée. |
| Tableau | Prend en charge la génération si la génération SQL est prise en charge pour l'expression de mise en évidence. |
| Transformer |