Data Refinery 中新增和更改的内容

Data Refinery更新可包括新功能和修复。 发行版按逆向时间顺序列出,以便最新发行版位于主题的开头。

您可以在 IBM Software Hub 中查看平台和所有服务的新功能列表。

IBM® watsonx™ 版本 2.4.0

该软件 Data Refinery 的新版本已于 2026年6月发布。

本版本包括以下更改:

新功能
Data Refinery 此版本包含以下功能:
使用新属性在外部创建 Data Refinery 流程,无需使用用户界面
现在,您可以使用新的 shaperAPICreated 属性通过编程方式创建 Data Refinery 流程,而无需使用用户界面。 此功能意味着您可以:
  • 使用外部 API 创建 Data Refinery 流程。
  • 使用第三方集成来生成包含整形操作的流程。
  • 使用自动化工作流来创建数据转换管道。
  • 使用自定义应用程序,无需通过用户界面即可构建 Data Refinery 流程。

如需了解更多信息,请参阅 API 文档: <hostname:port_number>/v2/data_flow_spark/docs/swagger/index.html

在文件夹中创建 Data Refinery 流程
现在,您可以在文件夹中创建 Data Refinery 流程,或将现有流程保存到文件夹中。 信息面板显示了您所选流程和目标的文件夹路径。 您还可以在文件夹中创建任务,并在流程设置中修改流程和目标文件夹的路径。

如需了解更多信息,请参阅 “管理 Data Refinery 流程 ”。

Data Refinery 流程中定义源数据和目标数据的参数
在流程的 Data Refinery 任务创建向导中,现已新增一个参数步骤。 您可以为源数据和目标数据分别定义参数,以便同一作业可用于不同的数据集。 您还可以编辑现有作业,使用参数来定义源数据和目标数据。

如需了解更多信息,请参阅 “Data Refinery 中创建作业 ”。

取消 Data Refinery 处于“启动”状态的任务
现在您可以取消 Data Refinery 处于该 Starting 状态的任务。 此项改进提升了作业管理和资源控制能力。
新增连接至 Data Refinery
Data Refinery现在,您可以使用以下连接:
  • Vertica
  • Microsoft Azure Databricks

支持的数据源包括 Data Refinery如需了解更多信息,请参阅。

更新
此版本引入了以下更新:
  • 已添加新的默认 Spark 3.5 和 R 4.3 环境。
  • 默认的 Spark 3.4 和 R 4.3 环境已停止提供。

现在,在为流程作业 Data Refinery 选择环境时,您可以选择“默认 Spark” 3.5 和“默认 R” 4.3。

如果您是从较早的产品版本进行升级,且该版本中的流处理作业使用了 Data Refinery 已停用的环境、已弃用的环境或自定义的 Spark 3.x 环境,请将这些作业修改为使用新的默认 Spark 3.5 和 R 4.3 环境。 利用新环境开拓新工作

如需了解更多信息,请参阅 Data Refinery “环境”部分

本版本修复了客户报告的问题
有关本次发布中已修复的客户报告问题的列表,请参阅支持网站 IBM 上的相关文档 待修复列表 IBM Cloud Pak for Data