Explore a biblioteca da IBM de modelos de IA disponíveis no estúdio watsonx.ai
Selecione o modelo IBM Granite, de código aberto ou de terceiros mais adequado para seus negócios e implemente no local ou na nuvem.
Escolha o modelo que melhor se adapte ao seu caso de uso específico, considerações orçamentárias, interesses regionais e perfil de risco.
Adaptada para os negócios, a família IBM Granite de modelos abertos, de alto desempenho e confiáveis oferece desempenho excepcional a um preço competitivo, sem comprometer a segurança.
Os modelos Llama são grandes modelos de linguagem abertos e eficientes, desenvolvidos para oferecer versatilidade e alto desempenho em uma ampla variedade de tarefas de linguagem natural
Os modelos Mistral são modelos de linguagem rápidos, de alto desempenho e de peso aberto, projetados para modularidade e otimizados para geração de texto, raciocínio e aplicações multilíngues.
Diversos modelos de base de outros provedores estão disponíveis no watsonx.ai
Granite-speech-4-1-2b
IBM
Implementar somente sob demanda
granite-4-1-3b
IBM
Implementar somente sob demanda
granite-4-1-8b
IBM
Implementar somente sob demanda
granite-4-1-30b
IBM
Implementar somente sob demanda
granite-vision-4-1-4b
IBM
Implementar somente sob demanda
Granite-4h-micro
IBM
Implementar somente sob demanda
Granite-4h-tiny
IBM
Implementar somente sob demanda
granite-4h-small
IBM
Tanto com pagamento conforme o uso quanto com implementação sob demanda
granite-vision-3-3-2b
IBM
Implementar somente sob demanda
granite-3-3-2b-instruct
IBM
Implementar somente sob demanda
granite-3-3-8b-instruct
IBM
Implementar somente sob demanda
granite-3-2-8b-instruct
IBM
Implementar somente sob demanda
granite-3-1-8b-base
IBM
Implementar somente sob demanda
granite-3-1-8b-instruct
IBM
Implementar somente sob demanda
granite-3-8b-base
IBM
Implementar somente sob demanda
Granite-13b-chat-v2
IBM
Implementar somente sob demanda
granite-3b-code-instruct
IBM
Implementar somente sob demanda
granite-8b-code-instruct
IBM
Tanto com pagamento conforme o uso quanto com implementação sob demanda
granite-20b-code-base-sql-gen
IBM
Implementar somente sob demanda
granite-20b-code-instruct
IBM
Implementar somente sob demanda
granite-20b-multilingual
IBM
Implementar somente sob demanda
granite-20b-code-base-schema-linking
IBM
Implementar somente sob demanda
granite-34b-code-instruct
IBM
Implementar somente sob demanda
granite-7b-lab
IBM
Implementar somente sob demanda
granite-8b-japanese
IBM
Implementar somente sob demanda
granite-guardian-3-8b
IBM
Pague apenas conforme o uso
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
llama-4-maverick-17b-128e-instruct-int4
Meta
Implementar somente sob demanda
llama-4-maverick-17b-128e-instruct-fp8
Meta
Tanto com pagamento conforme o uso quanto com implementação sob demanda
llama-4-scout-17b-16e-instruct-fp8-dynamic
Meta
Implementar somente sob demanda
llama-3-3-70b-instruct
Meta
Tanto com pagamento conforme o uso quanto com implementação sob demanda
llama-3-3-70b-instruct-hf
Meta
Implementar somente sob demanda
llama-3-2-11b-vision-instruct
Meta
Pague apenas conforme o uso
llama-3-2-90b-vision-instruct
Meta
Implementar somente sob demanda
llama-3-1-405b-instruct-fp8
Meta
Implementar somente sob demanda
llama-3-1-8b
Meta
Implementar somente sob demanda
llama-3-1-8b-instruct
Meta
Implementar somente sob demanda
llama-3-1-70b
Meta
Implementar somente sob demanda
llama-3-1-70b-gptq
Meta
Implementar somente sob demanda
llama-3-1-70b-instruct
Meta
Implementar somente sob demanda
llama-3-1-405b-instruct-fp8
Meta
Implementar somente sob demanda
llama-3-8b-instruct
Meta
Implementar somente sob demanda
llama-3-70b-instruct
Meta
Implementar somente sob demanda
llama-2-70b-chat
Meta
Implementar somente sob demanda
codellama-34b-instruct-hf
Meta
Implementar somente sob demanda
llama-guard-3-11b-vision
Meta
Pague apenas conforme o uso
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
mistral-médio-3-5-0
Mistral
Implementar somente sob demanda
devstral-small-2512
Mistral
Implementar somente sob demanda
mistral-large-2512
Mistral
Tanto com pagamento conforme o uso quanto com implementação sob demanda
ministral-14b-instruct-2512
Mistral
Implementar somente sob demanda
ministral-8b-instruct-2512
Mistral
Implementar somente sob demanda
ministral-3b-instruct-2512
Mistral
Implementar somente sob demanda
mistral-medium-2508
Mistral
Implementar somente sob demanda
devstral-medium-2507
Mistral
Implementar somente sob demanda
devstral-small-2507
Mistral
Implementar somente sob demanda
mistral-small-3-2-24b-instruct-2506
Mistral
Implementar somente sob demanda
mistral-medium-2505
Mistral
Tanto com pagamento conforme o uso quanto com implementação sob demanda
mistral-small-3-1-24b-instruct-2503
Mistral
Tanto com pagamento conforme o uso quanto com implementação sob demanda
codestral-2501
Mistral
Implementar somente sob demanda
mistral-large-instruct-2411
Mistral
Implementar somente sob demanda
ministral-8b-instruct-2410
Mistral
Implementar somente sob demanda
mistral-large-instruct-2407
Mistral
Implementar somente sob demanda
mistral-nemo-instruct-2407
Mistral
Implementar somente sob demanda
mixtral-8x7b-base
Mistral
Implementar somente sob demanda
Mixtral-8x7b-instruct-v01
Mistral
Implementar somente sob demanda
pixtral-12b
Mistral
Implementar somente sob demanda
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
nvidia-nemotron-3-ultra-550b-a55b-quantized
Red Hat
Implementar somente sob demanda
gpt-oss-120b
OpenAI
Tanto com pagamento conforme o uso quanto com implementação sob demanda
GPT-OSS-20B
OpenAI
Implementar somente sob demanda
deepseek-r1-distill-llama-8b
DeepSeek
Implementar somente sob demanda
deepseek-r1-distill-llama-70b
DeepSeek
Implementar somente sob demanda
allam-1-13b-instruct
SDAIA
Implementar somente sob demanda
llama-3-1-nemotron-ultra-253b-v1-fp8
NVIDIA
Implementar somente sob demanda
nvidia-nemotron-3-super-120b-a12b-fp8
NVIDIA
Implementar somente sob demanda
nvidia-nemotron-nano-12b-v2-vl-fp8
NVIDIA
Implementar somente sob demanda
eurollm-1-7b-instruct
Utter Project
Implementar somente sob demanda
eurollm-9b-instruct
Utter Project
Implementar somente sob demanda
mt0-xxl-13b
BigScience
Implementar somente sob demanda
poro-34b-chat
LumiOpen
Implementar somente sob demanda
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
*Os preços apresentados são indicativos, podem variar de acordo com o país, excluem impostos e taxas aplicáveis e estão sujeitos à disponibilidade de ofertas do produto em uma localidade.
O que acontece quando você treina um modelo de IA poderoso com seus próprios dados exclusivos? Melhores experiências do cliente e geração de valor acelerada com IA. Explore essas histórias e veja como.
O Wimbledon usou os modelos de base do watsonx.ai para treinar a IA para criar comentários sobre tênis.
A Recording Academy usou as histórias de IA com o IBM watsonx para gerar e escalar conteúdos editoriais relacionados aos indicados ao GRAMMY.
The Masters usa o watsonx.ai para trazer insights impulsionados por IA combinados com opiniões de especialistas para plataformas digitais.
A AddAI.Life utiliza watsonx.ai para acessar modelos de linguagem de código aberto e criar assistentes virtuais de alta qualidade.
A IBM acredita na criação, implementação e uso de modelos de IA que promovem a inovação empresarial de forma responsável. O portfólio de IA do IBM watsonx oferece um processo completo para desenvolvimento e teste de modelos de base e IA generativa. Nos modelos desenvolvidos pela IBM, eliminamos duplicações, aplicamos listas de bloqueio de URLs, filtros para conteúdos inadequados e verificamos a qualidade dos documentos, além de usar técnicas de segmentação de frases e tokenização antes do treinamento do modelo.
Durante o processo de treinamento de dados, trabalhamos para evitar desalinhamentos nos resultados do modelo e utilizamos o ajuste fino supervisionado para habilitar um melhor seguimento de instruções, de modo que o modelo possa ser usado para concluir tarefas corporativas por meio da engenharia de prompt. Continuamos a expandir os modelos Granite em diversas frentes, como outras modalidades, conteúdo específico para setores e mais anotações de dados para treinamento, além de aplicar medidas contínuas de proteção de dados para modelos desenvolvidos pela IBM.
Dado o cenário de rápida mudança da tecnologia da IA generativa, espera-se que nosso processo completo evolua e melhore constantemente. Como prova do rigor que a IBM aplica ao desenvolvimento e teste de seus modelos de base, a empresa oferece indenização contratual padrão de propriedade intelectual para os modelos desenvolvidos pela IBM, semelhante àquelas que oferece para itens de hardware e software da IBM.
Além disso, diferentemente de alguns outros fornecedores de grandes modelos de linguagem e em conformidade com a abordagem padrão da IBM sobre indenização, a IBM não exige que seus clientes a indenizem pelo uso que fazem dos modelos que ela desenvolveu. Além disso, de acordo com a abordagem da IBM em relação à sua obrigação de indenização, a IBM não limita sua responsabilidade de indenização para os modelos desenvolvidos pela IBM.
Agora, sob essas proteções, os modelos watsonx incluem:
(1) Família Slate de modelos somente para codificação
(2) Família Granite de modelos somente para decodificação
Saiba mais sobre o licenciamento de modelos do Granite (PDF)
* Comprimento de contexto especificado pelo fornecedor do modelo, mas o comprimento real do contexto na plataforma é limitado. Para mais informações, consulte a documentação.
A inferência é cobrada em Unidades de Recurso. 1 Unidade de Recurso equivale a 1.000 tokens. Os tokens de entrada e saída são cobrados na mesma taxa. 1.000 tokens correspondem, em média, a 750 palavras.
Nem todos os modelos estão disponíveis em todas as regiões. Consulte nossa documentação para obter mais informações.
O comprimento do contexto é medido em tokens.
As declarações da IBM sobre seus planos, direções e intenções podem mudar ou ser retiradas sem aviso prévio, a seu exclusivo critério. Consulte Preços para mais detalhes. Salvo indicação contrária na precificação de software, todas as funcionalidades, recursos e possíveis atualizações referem-se exclusivamente ao SaaS. A IBM não garante que as funcionalidades e recursos do SaaS e do software sejam os mesmos.