Conexión de Apache Hive

Para acceder a tus datos en Apache Hive, crea un recurso de conexión para ellos.

Apache Hive es un proyecto de software de almacén de datos que permite consultar y analizar datos y que se ha desarrollado sobre la base de Apache Hadoop.

Versiones soportadas

Apache Hive 1.0.x, 1.1.x, 1.2.x. 2.0.x, 2.1.x, 3.0.x, 3.1.x.

Requisitos previos para la autenticación Kerberos

Si tiene previsto utilizar la autenticación de « Kerberos », cumpla los siguientes requisitos:

Establece una conexión con Apache Hive

Para crear el activo de conexión, necesita los siguientes detalles de conexión:

  • Nombre de la base de datos (opcional): si no introduces un nombre de base de datos, deberás introducir el nombre del catálogo, el nombre del esquema y el nombre de la tabla en las propiedades de las consultas SQL.
  • Nombre de host o dirección IP
  • Número de puerto
  • HTTP ruta (opcional): la ruta del punto final, como la puerta de enlace, el valor predeterminado o el enjambre, si el servidor está configurado para el modo de transporte « HTTP ».
  • Si así lo requiere el servidor de la base de datos, el certificado de SSL

Método de autenticación

Nombre de usuario y contraseña o Kerberos de Kerberos
Las selecciones de Kerberos disponibles dependen de si selecciona credenciales personales o compartidas .

Credenciales

El valor de credenciales determina los métodos de autenticación disponibles.
Si selecciona Compartido (valor predeterminado), puede utilizar la autenticación de nombre de usuario y contraseña o la autenticación Kerberos (sin SSO). Para obtener más información, consulte Requisitos previos para la autenticación Kerberos. Para Kerberos, necesita los siguientes detalles de conexión:

  • Nombre del servicio principal (SPN) configurado para el origen de datos
  • Nombre principal de usuario para conectarse al origen de datos Kerberizado
  • El archivo keytab correspondiente al nombre principal de usuario que se utiliza para autenticarse en el Centro de Distribución de Claves (KDC)

Si selecciona Personal, puede especificar su nombre de usuario y contraseña para el servidor manualmente, utilizar secretos de una caja fuerte o utilizar la autenticación Kerberos . Para obtener más información, consulte Requisitos previos para la autenticación Kerberos. Tiene dos opciones para Kerberos:

  • Kerberos (sin SSO). Para Kerberos sin SSO, necesita los siguientes detalles de conexión:
    • Nombre principal de servicio (SPN) que se ha configurado para el origen de datos
    • Nombre de principal de usuario para conectarse al origen de datos Kerberos
    • El archivo de tabla de claves para el nombre de principal de usuario que se utiliza para autenticarse en el Centro de distribución de claves (KDC)
  • SSO de Kerberos . Seleccione Kerberos SSO y especifique el nombre principal de servicio (SPN) que se ha configurado para el origen de datos.

Descubrimiento de ZooKeeper (opcional)

Seleccione Utilizar descubrimiento de ZooKeeper para garantizar un acceso continuado a la conexión en caso de que falle el servidor Apache Hive en el que ha iniciado sesión.

Requisitos previos para el descubrimiento de ZooKeeper :

  • ZooKeeper debe estar configurado en el clúster de Hadoop .
  • El Hive servicio en el Hadoop El clúster debe estar configurado para ZooKeeper, junto con ZooKeeper espacio de nombres.
  • Servidores alternativos para la migración tras error.

Especifique el espacio de nombres ZooKeeper y una lista separada por comas de servidores alternativos con este formato:
hostname1:port-number1,hostname2:port-number2,hostname3:port-number3

Para Credenciales y Certificados, puede utilizar secretos si se ha configurado una caja fuerte para la plataforma y el servicio da soporte a cajas fuertes. Para obtener información, consulte Utilización de secretos de cajas fuertes en conexiones.

Conformidad con FIPS (Federal Information Processing Standards)

Esta conexión cumple con la norma FIPS y puede utilizarse en un clúster compatible con FIPS.

Apache Hive configuración

Apache Hive instalación y configuración

Restricción

No es posible escribir ni exportar datos con esta conexión.

Ejecución de sentencias SQL

Para garantizar que tus sentencias SQL se ejecuten correctamente, consulta la sección «Autorización basada en el estándar SQL» ( Hive ) en la documentación de « Apache Hive » para conocer la sintaxis correcta.

Más información