使用 AnalyticsEngine CR 配置定制 Spark 应用程序和 Notebook

您可以在 cc-home 卷中的 Spark 实例,项目和部署空间中持久存储要在 Spark 应用程序和 Python Notebook 中使用的定制 Python 包。

使用 Python 定制包

  1. 连接到 OpenShift 集群:

    oc login OpenShift_URL:port
    
  2. 将上下文设置为部署了 ` Cloud Pak for Data ` 的项目:

    oc project ${PROJECT_CPD_INST_OPERANDS}
    
  3. 在xml-ph-0000@deepl.internal自定义资源中设置为true: mountCustomizationsFromCCHome 在 AnalyticsEnginge 自定义资源中设置为true

    oc patch AnalyticsEngine analyticsengine-sample --namespace CHANGE_ME_NAMESPACE --type merge --patch '{"spec": {"serviceConfig":{"mountCustomizationsFromCCHome":true}}}'
    
  4. 等待 AnalyticsEnginge 定制资源状态更改为 已完成

    oc get AnalyticsEngine --namespace CHANGE_ME_NAMESPACE
    

    AnalyticsEngine 定制资源状态可能需要几分钟才能更改为 已完成

  5. 获取所需的平台访问令牌。 有关详细信息,请参阅 认证以进行编程访问

  6. 针对 cc-home-pvc创建卷实例。 有关操作说明,请参阅 《设置存储卷以保存 common core services 的自定义设置 》。

  7. 要验证新卷实例是否可用,请使用 volumes 端点。

    curl -k $CPDHOST/zen-data/v3/service_instances -H "Authorization: ZenApiKey ${TOKEN}" -H 'Content-Type: application/json' | jq '.service_instances[] | .display_name,.id,.metadata.existing_pvc_name'
    
  8. 要停止文件服务器,请使用 volume_services 端点。

    curl -k -X DELETE $CPDHOST/zen-data/v1/volumes/volume_services/$NAMESPACE::$VSNAME -H "Authorization: ZenApiKey ${TOKEN}"
    
  9. 要重新启动文件服务器,请使用 volumes_services 端点。

    curl -k -X POST $CPDHOST/zen-data/v1/volumes/volume_services/$NAMESPACE::$VSNAME -H "Authorization: ZenApiKey ${TOKEN}" -H 'Content-Type: application/json' -d '{}'
    
  10. 上载定制包:

    1. 转至 Cloud Pak for Data 导航菜单。
    2. 选择 管理> 存储卷
    3. 从卷列表中,选择 CCHome
    4. 上载目录中的软件包: _global_/dbdrivers/jdbc/default
    重要说明:

    必须将软件包上载到 _global_/dbdrivers/jdbc/default 目录。