Impala via Execution Engine for Hadoop connexion

Vous pouvez créer un actif de connexion pour Impala via Execution Engine for Hadoop.

Utilisez la connexion « Impala via Execution Engine for Hadoop » pour vous connecter aux données stockées dans les tables de la base de données « Impala » sur le cluster « Hadoop ».

Prérequis

  • Votre administrateur doit enregistrer le cluster Hadoop à partir du panneau Hadoop Execution Engine . Demandez l' URL à votre administrateur.
  • LDAP doit être activée dans le cadre de l'authentification par le protocole Impala.
  • Vous devez créer une définition d'environnement d'exécution pour Hadoop dans votre projet.
  • Facultatif : un certificat « SSL » pour le démon Impala si celui-ci prend en charge la fonction « SSL ».
  • Téléchargez le ImpalaJDBC41.jar fichier sur le site web de l' Cloudera :
    1. Sélectionnez la dernière version du connecteur JDBC Impala.
    2. Cliquez sur GET IT NOW, puis téléchargez et extrayez le fichier ClouderaImpala_JDBC-#.#.##.####.zip .
    3. Décompressez le ClouderaImpalaJDBC41-#.#.##.####.zip fichier. Le ImpalaJDBC41.jar fichier se trouve dans le dossier décompressé.

Chiffrement pris en charge

  • Certificat SSL (facultatif)
  • Cette connexion permet de se connecter à un environnement Hadoop sécurisé par Kerberos.

Conditions préalables à l'authentification Kerberos

Si vous envisagez d'utiliser l'authentification Kerberos, vous devez remplir les conditions suivantes :

  • Configurez la source de données pour l'authentification Kerberos. Facultatif : Cette connexion prend en charge Kerberos SSO avec impersonation de l'utilisateur, ce qui nécessite une configuration supplémentaire.
  • Confirmez que le service que vous prévoyez d'utiliser pour la connexion prend en charge Kerberos. Pour plus d'informations, voir Kerberos authentification dans Cloud Pak for Data.

Données d'identification

Nom d'utilisateur et mot de passe

Pour Données d'identification et Certificats, vous pouvez utiliser des secrets si un coffre est configuré pour la plateforme et que le service prend en charge les coffres-forts. Pour plus d'informations, voir Utilisation de secrets à partir de coffres-forts dans les connexions.

Créez une connexion Impala via Execution Engine for Hadoop au cluster Hadoop

  • Nom d'hôte ou adresse IP : nom d'hôte ou adresse IP où le démon Impala est accessible.
  • Port : le port du démon Impala provenant du cluster Hadoop.

Certificats

  • Le port prend en charge le protocole SSL : activez cette option si le port que vous avez choisi est configuré pour accepter les connexions SSL.

Si l'option « Port compatible avec l SSL » est activée, remplissez les champs suivants :

  • SSL Certificat : saisissez le certificat de l' SSL ur de l'hôte auquel vous souhaitez accorder votre confiance
  • Nom d'hôte dans le certificat SSL : le nom d'hôte figurant dans la partie « SubjectAlternativeName » ou « Common Name » (CN) du certificat SSL
  • Valider le certificat SSL : activez cette option pour vérifier que le certificat SSL renvoyé par l'hôte est fiable.

Conformité aux normes FIPS (Federal Information Processing Standards)

Cette connexion ne peut pas être établie dans un environnement FIPS.

Restrictions

  • Pour Data Refinery, vous ne pouvez utiliser cette connexion qu'en tant que source. Vous ne pouvez pas utiliser cette connexion comme connexion cible ni comme ressource de données connectée cible. Pour une solution palliative, voir Amélioration des données stockées dans les tables dans Impala.
  • Pour SPSS Modeler, vous ne pouvez utiliser cette connexion que pour importer des données. Vous ne pouvez pas exporter de données vers cette connexion ou vers un actif de données connecté Impala via Execution Engine for Hadoop .

Problèmes connus

Dépannage des environnements d' Hadoop

En savoir plus