文本分类

您可以使用文本分类 API 对文档中的文本进行分类,以确定文件中的数据是否与各种文档类型的模式定义中的键值对格式相匹配。

通过对文档进行预处理,您可以快速验证文档是否被归类到某个预定义模式或自定义模式中,而无需执行键值对提取(这可能是一个耗费较长时间的资源密集型过程)。 然后,您就可以决定使用哪种模式来将文本正确提取到键值对格式的字段中。

兼容性和规格

支持的输入文件类型

您可以对不同语言的文档或混合多种语言的文档中的文本进行分类。 对以下文件类型中的文本进行分类

支持的文档格式:

文件类型 分机 文本分类支持
PDF文件 .pdf
Powerpoint .pptx.ppt
Word 文档 .docx.doc
Excel .xlsx False

支持的图像格式:

文件类型 分机 文本分类支持
BMP 图像 .bmp(简体中文(大陆))
HEIC/HEIF 图像 .heic.heif
JFIF 图像 .jfif
JPEG图像 .jpeg.jpg
PNG 图片 .png
TIFF 图像/多图像 .tif.tiff

其他支持的格式:

文件类型 分机 文本分类支持
HTML .html
降价 .md False
注意: 您无法使用文本分类 API 处理键值对数据来分类 XLSX 文档。
支持的存储类型

您可以将输入文档存储在以下已连接的存储类型中:

  • IBM Cloud Object Storage
  • Amazon S3
  • 任何与 Amazon S3 兼容的通用存储
  • Microsoft OneDrive
  • Microsoft Azure Blob Storage
  • 微软 Azure File Storage
  • IBM watsonx.data SharePoint
  • IBM FileNet P8 Content Manager
  • Slack
  • 汇流
  • Google Drive
  • NFS

您可以将文本分类的输出文件存储在以下已连接的存储类型中:

  • IBM Cloud Object Storage

  • Amazon S3

  • 任何与 Amazon S3 兼容的通用存储

  • Microsoft OneDrive

  • Microsoft Azure Blob Storage

  • 微软 Azure File Storage

  • NFS

    注:

有关如何在项目中创建与各类数据存储的连接的详细信息,请参阅 watsonx.ai 的连接器

支持的基础模型

文本分类 API 经认证可使用 mistral-small-3-1-24b-instruct-2503 模型进行键值对分类。

您还可以使用其他模型,这些模型可以处理可视化输入并以 JSON 格式做出响应,例如

  • llama-4-maverick-17b-128e-instruct-fp8
  • mistral-medium-2505
  • mistral-medium-2508

有关地基型号的详细信息,请参阅支持的地基型号

支持的语言

文本分类 API 已通过英文文档进行了测试。 预计该 API 可与底层视觉语言模型支持的其他语言配合使用。

工作方式

您必须生成凭据才能通过 watsonx.ai 的API进行身份验证。 详情请参阅生成持有人令牌

您可以使用这些编程方法对 watsonx.ai 项目中存储的文档中的文本进行分类:

REST API

您可以使用 watsonx.ai REST API 的文本分类方法,以编程方式对 IBM watsonx.ai 文件中的文本进行分类。

有关如何自定义文本分类请求的详细信息,请参阅文本分类参数

有关 API 方法的详细信息,请参阅 watsonx.ai API 参考文档

Python

您可以使用 Python 库,以编程方式从 IBM watsonx.ai 中的文件提取文本。

参见 watsonx.ai Python 库的 TextClassification 类

Node.js

您可以使用 Node.js SDK 以编程方式对 IBM watsonx.ai 文件中的文本进行分类。 有关更多信息,请参阅以下资源:

了解更多