Gerenciando especificações de hardware para implementações

Quando você implanta determinados ativos no watsonx.ai Runtime, pode escolher o tipo, o tamanho e a potência da configuração de hardware que corresponde às suas necessidades de computação.

Criando especificações de hardware para implementações

É possível criar especificações de hardware para suas implementações das seguintes maneiras:

  • Python : use a função hardware_specifications.store da biblioteca do cliente Python . Para obter mais informações, consulte Python client library reference
  • API de núcleo comum de dados e IA: Use ' POST /v2/hardware_specifications da lista Environments (Ambientes) na API Data and AI Common Core para criar uma especificação de hardware. Para obter mais informações, consulte Referência da API de Ambientes

Tipos de implementação que requerem especificações de hardware

Selecionar uma especificação de hardware está disponível para todos os tipos de implementação em lote . Para implementações on-line, será possível selecionar uma especificação de hardware específica se estiver implementando:

  • Funções Python
  • Modelos Tensorflow
  • Modelos com especificações de software customizadas

Configurações de hardware disponíveis para implementar ativos

  • XS: 1x4 = 1 vCPU e 4 GB de RAM
  • S: 2x8 = 2 vCPU e 8 GB de RAM
  • M: 4x16 = 4 vCPU e 16 GB de RAM
  • L: 8x32 = 8 vCPU e 32 GB de RAM
  • XL: 16x64 = 16 vCPU e 64 GB de RAM

É possível usar a configuração XS para implementar:

  • Funções do Python
  • Scripts Python
  • Scripts r
  • Modelos baseados em bibliotecas customizadas e imagens customizadas

Para implementações do Decision Optimization , é possível usar estas especificações de hardware:

  • S
  • M
  • L
  • XL

Saiba Mais