planos de serviço de tempo de execução do watsonx.ai
Você usa os recursos de tempo de execução watsonx.ai, que são medidos em horas de unidade de capacidade (CUH), quando treina modelos AutoAI, executa modelos de aprendizado de máquina ou pontua modelos implantados. Você usa recursos de tempo de execução watsonx.ai, medidos por tokens consumidos ou a uma taxa horária, quando executa serviços de inferência com modelos de fundação. Este tópico descreve os vários planos que você pode escolher, quais serviços estão incluídos, e como os recursos de computação são calculados
Se você estiver usando tanto watsonx quanto Cloud Pak for Data as a Service em sua conta, poderá alternar entre as duas plataformas. Para obter detalhes, consulte Comparação entre IBM watsonx e Cloud Pak for Data as a Service.
Escolha de um plano de tempo de execução watsonx.ai
os planos watsonx.ai Runtime determinam como você será cobrado pelos modelos que treinar e implantar com o watsonx.ai Runtime e pelos prompts que usar com os modelos da fundação. Você deve selecionar um plano para cada instância do watsonx.ai Runtime que criar.
Selecione um dos seguintes planos com base nas suas necessidades:
- plano Lite
- Um plano gratuito com capacidade limitada. Escolha o plano Lite se estiver avaliando o watsonx.ai Runtime e quiser experimentar os recursos. O plano Lite não suporta a execução de um experimento de ajuste do modelo básico em watsonx.
- Plano Essentials
- Um plano pré-pago que oferece flexibilidade para criar, implantar e gerenciar modelos de acordo com suas necessidades.
- Plano Standard
- Um plano empresarial de alta capacidade projetado para atender a todas as necessidades de IA de uma organização. O plano Standard tem uma taxa mensal de US$ 1.110, que inclui um bloco de 2.500 horas de unidade de capacidade (CUH). Qualquer uso do CUH acima desse valor e todos os outros usos são medidos com base no consumo real, de acordo com a tarifa do plano padrão.Nota:
A taxa da instância do plano watsonx.ai Runtime Standard é cobrada independentemente do uso da CUH. Por exemplo, se você consumir apenas unidades de recursos, ainda será cobrada a taxa da instância. A taxa é rateada se o plano for cancelado.
Para obter detalhes do plano e preços, consulte o catálogo IBM Cloud : watsonx.ai Runtime.
Os recursos disponíveis em cada plano dependem da região em que você está provisionando o serviço a partir do catálogo IBM Cloud. Consulte Disponibilidade regional de serviços e recursos.
O plano Lite fornece recursos gratuitos suficientes para você avaliar os recursos de watsonx.ai Em seguida, é possível escolher um plano pago que corresponda às necessidades de sua organização, com base nos recursos e capacidade do plano.
| Recursos do plano. | Lite | Itens básicos | Padrão |
|---|---|---|---|
| uso do tempo de execução do watsonx.ai no CUH | 20 CUH por mês | Faturamento de CUH com base na taxa de CUH multiplicada por horas de consumo | 2500 CUH por mês |
| Máximo de tarefas em lote paralelas do Decision Optimization por implementação | 2 | 5 | 100 |
| Tarefas de implementação retidas por espaço | 100 | 1000 | 3000 |
| Tempo de implementação inativo | 1 dia | 3 dias | 3 dias |
Saiba Mais
- Detalhes de faturamento para ativos de aprendizado de máquina
- Para obter mais informações sobre o rastreamento da alocação e do consumo de recursos de computação, consulte Uso do tempo de execução.
- IBM Cloud catálogo: watsonx.ai Tempo de execução