planos de serviço de tempo de execução do watsonx.ai

Você usa os recursos de tempo de execução watsonx.ai, que são medidos em horas de unidade de capacidade (CUH), quando treina modelos AutoAI, executa modelos de aprendizado de máquina ou pontua modelos implantados. Você usa recursos de tempo de execução watsonx.ai, medidos por tokens consumidos ou a uma taxa horária, quando executa serviços de inferência com modelos de fundação. Este tópico descreve os vários planos que você pode escolher, quais serviços estão incluídos, e como os recursos de computação são calculados

Observação: O serviço watsonx.ai Runtime era conhecido anteriormente como serviço Watson Machine Learning.

Se você estiver usando tanto watsonx quanto Cloud Pak for Data as a Service em sua conta, poderá alternar entre as duas plataformas. Para obter detalhes, consulte Comparação entre IBM watsonx e Cloud Pak for Data as a Service.

Escolha de um plano de tempo de execução watsonx.ai

os planos watsonx.ai Runtime determinam como você será cobrado pelos modelos que treinar e implantar com o watsonx.ai Runtime e pelos prompts que usar com os modelos da fundação. Você deve selecionar um plano para cada instância do watsonx.ai Runtime que criar.

Selecione um dos seguintes planos com base nas suas necessidades:

plano Lite
Um plano gratuito com capacidade limitada. Escolha o plano Lite se estiver avaliando o watsonx.ai Runtime e quiser experimentar os recursos. O plano Lite não suporta a execução de um experimento de ajuste do modelo básico em watsonx.
Plano Essentials
Um plano pré-pago que oferece flexibilidade para criar, implantar e gerenciar modelos de acordo com suas necessidades.
Plano Standard
Um plano empresarial de alta capacidade projetado para atender a todas as necessidades de IA de uma organização. O plano Standard tem uma taxa mensal de US$ 1.110, que inclui um bloco de 2.500 horas de unidade de capacidade (CUH). Qualquer uso do CUH acima desse valor e todos os outros usos são medidos com base no consumo real, de acordo com a tarifa do plano padrão.
Nota:A taxa da instância do plano watsonx.ai Runtime Standard é cobrada independentemente do uso da CUH. Por exemplo, se você consumir apenas unidades de recursos, ainda será cobrada a taxa da instância. A taxa é rateada se o plano for cancelado.

Para obter detalhes do plano e preços, consulte o catálogo IBM Cloud : watsonx.ai Runtime.

Os recursos disponíveis em cada plano dependem da região em que você está provisionando o serviço a partir do catálogo IBM Cloud. Consulte Disponibilidade regional de serviços e recursos.

O plano Lite fornece recursos gratuitos suficientes para você avaliar os recursos de watsonx.ai Em seguida, é possível escolher um plano pago que corresponda às necessidades de sua organização, com base nos recursos e capacidade do plano.

Tabela 1. Diferenças entre os limites e custos dos planos de tempo de execução d watsonx.ai
Recursos do plano. Lite Itens básicos Padrão
uso do tempo de execução do watsonx.ai no CUH 20 CUH por mês Faturamento de CUH com base na taxa de CUH multiplicada por horas de consumo 2500 CUH por mês
Máximo de tarefas em lote paralelas do Decision Optimization por implementação 2 5 100
Tarefas de implementação retidas por espaço 100 1000 3000
Tempo de implementação inativo 1 dia 3 dias 3 dias

Observação: se você atualizar sua instância do Essentials para o Standard, não será possível reverter para um plano Essentials. Você deve criar uma instância com um novo plano. Da mesma forma, se você fizer o upgrade do plano Lite para o Essentials ou do Lite para o Standard, não poderá voltar para o plano Lite e deverá criar uma instância com um novo plano.

Saiba Mais