Modelos de base compatíveis no watsonx.ai

Você pode trabalhar com modelos de base de terceiros e do IBM no IBM watsonx.ai.

Como escolher um modelo

Para conhecer os fatores que podem ajudá-lo a escolher um modelo, como tarefas e linguagens compatíveis, consulte Escolhendo um modelo e Benchmarks de modelos de base.

Você pode optar por implantar modelos básicos fornecidos com o watsonx.ai, modelos otimizados ou modelos básicos personalizados adequados a um caso de uso específico. Para saber mais sobre as diversas formas de implantar modelos no watsonx.ai, consulte Métodos de implantação de modelos do Foundation.

Para obter mais informações sobre os modelos básicos fornecidos com o watsonx.ai para incorporação e reclassificação de texto, consulte Modelos de codificador compatíveis.

Acesso a modelos de outros provedores por meio do gateway de modelos

Você pode acessar e interagir com segurança com modelos de base de vários fornecedores por meio do gateway de modelos. O gateway de modelos oferece uma API OpenAI-compatible que encaminha as solicitações para esses modelos básicos. Use o gateway de modelos para alternar com eficiência entre vários provedores de modelos, encaminhando e formatando as solicitações por meio de uma interface unificada. Você pode criar e implantar agentes de IA, padrões RAG e muito mais usando esses modelos.

Para obter mais informações, consulte “Gateway modelo ”.

Modelos básicos prontos para uso

Você pode implantar modelos básicos a partir de uma coleção de modelos selecionados pelo IBM em watsonx.ai. Você pode acionar esses modelos de base no ` Prompt Lab ` ou por meio de programação.

Você pode trabalhar com os seguintes tipos de modelos de fundação fornecidos:

Todos os modelos de fundação da IBM disponíveis em watsonx.ai são protegidos por IBM.

Para obter informações sobre os requisitos de GPU para os modelos de base compatíveis, consulte a seção “Modelos de base” em IBMwatsonx.ai na documentação do IBMSoftware Hub.

Modelos de base IBM

Você pode inferir os seguintes modelos de base compatíveis, fornecidos pelo IBM. Os modelos base devem ser implementados em seu cluster por um administrador para estarem disponíveis para uso. Todos os modelos da IBM são ajustados por instrução

Observação:Uma visão geral de todos os modelos de fundação está disponível no Centro de Recursos.

Últimos modelos de base do IBM

A tabela a seguir lista os modelos básicos mais recentes do IBM disponíveis no watsonx.ai para inferência.

Tabela 1. Os modelos de base mais recentes do IBM no watsonx.ai para inferência
Nome do modelo Janela de contexto
(tokens de entrada + saída)
Tarefas suportadas Informações adicionais
granite-4-1b-speech 128.000
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação•
extração•
tradução• chamada
de função • código
Documentação do ` Granite ` e do ` 4.0 `
granite-4-1b-speech 128.000
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação•
extração•
tradução• chamada
de função • código
Documentação do ` Granite ` e do ` 4.0 `
ibm-defense-4-0-small 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• chamada de função
Modelo de Defesa de IBM
ibm-defense-4-0-micro 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• chamada de função
Modelo de Defesa de IBM
granite-docling-258M 8.192
extração• geração•
geração aumentada por recuperação
Documentação do Docling em Granite
granite-4-h-tiny 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada de função
Documentação do ` Granite ` e do ` 4.0 `
granite-4-h-micro 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada
de função • código
Documentação do ` Granite ` e do ` 4.0 `
granite-4-h-small 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada
de função • código
Documentação do ` Granite ` e do ` 4.0 `
ibm-defense-3-3-8b-instruct 128.000
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada de função
Modelo de Defesa de IBM
granite-vision-3-3-2b 131.072 • resposta
a perguntas • geração
Documentação do Granite Vision
granite-3-3-8b-instruct 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada de função
Blog sobre modelos da Granite
granite-guardian-3-2-5b 128.000 classificação
extração
geração
resposta da pergunta
sumarização
Documentação do Guardian sobre o Granite
Tabela 2. IBM modelos de base fornecidos pelo watsonx.ai para prever valores futuros
Nome do modelo Comprimento
do contexto: Número mínimo de pontos de dados
Informações adicionais
granite-ttm-512-96-r2
512 Documentação
sobre séries temporais do Granite • Artigo científico
granite-ttm-1024-96-r2
1.024 Documentação
sobre séries temporais do Granite • Artigo científico
granite-ttm-1536-96-r2
1.536 Documentação
sobre séries temporais do Granite • Artigo científico

 

Modelos de base do IBM

A tabela a seguir lista os modelos de base do IBM, da versão anterior, disponíveis no watsonx.ai para inferência. Quando uma versão mais recente de um modelo básico é lançada, os modelos básicos existentes passam a ser considerados obsoletos. Você ainda pode acessar esses modelos antigos com o mesmo nível de suporte oferecido pelas versões mais recentes, mas é recomendável mudar para os modelos mais novos.

Tabela 3. Modelos de base do Legacy IBM no watsonx.ai para inferência
Nome do modelo Janela de contexto
(tokens de entrada + saída)
Tarefas suportadas Informações adicionais
granite-3-2-8b-instruct 131.072
classificação•
extração• geração•
resposta a
perguntas•
resumo• geração
aumentada por recuperação• código•

extração•
tradução• chamada de função
Site
Artigo científico
granite-3-2b-instruct 4.096
classificação•
extração• chamada
de funções• geração•
resposta
a perguntas• resumo
Site
Artigo científico
granite-3-8b-instruct 4.096
classificação•
extração• chamada
de funções• geração•
resposta
a perguntas• resumo
Site
Artigo científico
granite-guardian-3-2b 8.192 classificação
extração
geração
resposta da pergunta
sumarização
Site
granite-guardian-3-8b 8.192 classificação
extração
geração
resposta da pergunta
sumarização
Site
granite-20b-code-base-schema-linking 8.192 código Artigo científico
granite-20b-code-base-sql-gen 8.192 código Artigo científico
granite-8b-code-instruct 128.000 • código
• classificação
• Extração
• geração
• resposta a perguntas
• resumo
Site
Artigo científico
granite-vision-3-2-2b 131.072 • resposta a perguntas Site
Artigo científico

 

Modelos de fundação de terceiros

Você pode inferir os seguintes modelos de base de terceiros compatíveis. Um administrador deve implementar os modelos básicos no seu cluster antes que você possa utilizá-los.

Observação:Uma visão geral de todos os modelos de fundação está disponível no Centro de Recursos.

Modelos de base de terceiros mais recentes

A tabela a seguir lista os modelos básicos compatíveis fornecidos por terceiros.

Tabela 4. Últimos modelos de base de terceiros compatíveis com o watsonx.ai
Nome do modelo Provedor Janela de contexto
(tokens de entrada + saída)
Tarefas suportadas Informações adicionais
voxtral-mini-2507 Mistral AI 32.000 • chamada
de funções • geração
• resposta a
perguntas • resumo

• tradução
Postagem no blog sobre o Ministral 3
ministral-3-14b-instruct-2512-bf16 Mistral AI 256.000 • Autocompletar
conversas • Chamada
de funções • Agentes e conversas
• Saídas
estruturadas • OCR
• Document QnA
• Preenchimento de lacunas (FIM)
• Incorporações
Postagem no blog sobre o Ministral 3
ministral-3b-instruct-2512 Mistral AI 256.000 • autocompletar
conversas • agentes e conversas
• resultados
reestruturados • OCR
• representações de vetores
• classificação
• extração
• chamada
de funções • geração
• resposta
a perguntas • geração
aumentada por recuperação • resumo
• tradução
Postagem no blog sobre o Ministral 3
nvidia-nemotron-nano-12b-v2-vl-fp8 NVIDIA 128.000
classificação•
extração• geração•
geração
aumentada por recuperação•
resumo•
tradução• chamada
de funções• código
de resposta a perguntas •
Hugging Face
nvidia-nemotron-3-nano-30b-a3b-fp8 NVIDIA 256.000
classificação•
extração• geração•
geração
aumentada por recuperação•
resumo•
tradução• chamada
de funções• código
de resposta a perguntas •
Hugging Face
magistral-small-2509 Mistral AI 128.000
classificação•
extração• geração
auxiliada por recuperação•
resumo•
tradução• chamada
de funções• código
de resposta a perguntas •
magistral-medium-2509 Mistral AI 128.000
classificação• código•
correção
de código• explicação de
código• geração
de código•
extração• geração
aumentada por recuperação•
resumo•
tradução• chamada
de função• código
de resposta a perguntas •
ministral-3-8b-instruct-2512 Mistral AI 256.000
classificação•
extração• geração
auxiliada por recuperação•
resumo•
tradução• chamada
de funções• código
de resposta a perguntas •
ministral-14b-instruct-2512 Mistral AI 262.144
classificação•
extração• geração•
geração
aumentada por recuperação•
resumo•
tradução• chamada
de funções• resposta a perguntas
Postagem no blog sobre o Ministral 3
mistral-large-2512 Mistral AI 131.072
classificação• código•

extração• geração•
geração
aumentada por recuperação•
resumo•
tradução• chamada de função
Postagem no blog sobre o Mistral Large 3
devstral-medium-2512
Mistral AI 256.000 código Postagem no blog sobre o Devstral 2
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
devstral-small-2512
Mistral AI 256.000 código Postagem no blog sobre o Devstral 2
codestral-2508
Mistral AI 256.000 código Postagem no blog da Codestral 25.08
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
devstral-medium-2507
Mistral AI 128.000 código Postagem no blog da Codestral 25.01
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
mistral-medium-2508 Mistral AI 131.072 classificação
código
extração
geração
recuperação-geração aumentada
sumarização
conversão
Postagem no blog sobre o Mistral Medium 3
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
mistral-small-3-2-24b-instruct-2506 Mistral AI 131.072 • classificação
• extração
• geração
• resposta a
perguntas • geração aumentada
por recuperação • resumo
• chamada
de funções • código
• tradução
Artigo científico
gpt-oss-20b OpenAI 131.072 • classificação
• extração
• geração
• resposta a
perguntas • geração aumentada
por recuperação • resumo
• chamada
de funções • código
• tradução
Blog do OpenAI
gpt-oss-120b OpenAI 131.072 • classificação
• extração
• resposta a
perguntas • geração aumentada
por recuperação • resumo
• chamada
de funções • código
• tradução
Blog do OpenAI
voxtral-small-24b-2507 Mistral AI 32.000 • classificação
• extração
• geração
• resposta a
perguntas • geração aumentada
por recuperação • resumo
• tradução
• chamada
de função • compreensão de áudio
Blog da Voxtral
llama-4-maverick-17b-128e-instruct-fp8 Meta 131.072
classificação• código•

extração• geração•
resposta a
perguntas• geração
aumentada por recuperação• resumo
• tradução
• chamada de função
Meta AI blog
llama-4-maverick-17b-128e-instruct-int4 Meta 131.072
classificação• código•

extração• geração•
resposta a
perguntas• geração
aumentada por recuperação• resumo
• tradução
• chamada de função
Meta AI blog
llama-4-scout-17b-16e-instruct-int4 Meta 131.072
classificação• código•

extração• geração•
resposta a
perguntas• geração
aumentada por recuperação• resumo
• tradução
• chamada de função
Meta AI blog
llama-3-3-70b-instruct
Meta 131.072 classificação
código
extração
geração
resposta da pergunta
recuperação-geração aumentada
sumarização
Meta AI blog
Meta AI documentos
llama-3-2-11b-vision-instruct Meta 131.072
classificação• geração e conversão
de códigos•
extração• chamada
de funções• geração•
resposta
a perguntas• geração
aumentada por recuperação• resumo
Meta AI blog
Artigo científico
llama-3-2-90b-vision-instruct Meta 131.072
classificação• geração e conversão
de códigos•
extração• chamada
de funções• geração•
resposta
a perguntas• geração
aumentada por recuperação• resumo
Meta AI blog
Artigo científico
llama-guard-3-11b-vision Meta 131.072
classificação• geração e conversão
de códigos•
extração• chamada
de funções• geração•
resposta
a perguntas• geração
aumentada por recuperação• resumo
Meta AI blog
Artigo científico
ministral-8b-instruct Mistral AI 128.000
classificação• código•

extração• geração•
geração
aumentada por recuperação•
resumo•
tradução• resposta

a perguntas• chamada de funções
Postagem no blog da Ministral 8b
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
mistral-large-instruct-2411
Mistral AI 131.072 classificação
código
extração
geração
recuperação-geração aumentada
sumarização
conversão
Postagem no blog sobre o Mistral Large 2
pixtral-large-instruct-2411
Mistral AI 128.000
classificação• geração•
geração
complementada por recuperação• resumo
Postagem no blog para o Pixtral Large
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
allam-1-13b-instruct Centro Nacional de Inteligência Artificial e Autoridade Saudita de Dados e Inteligência Artificial 4.096 classificação
extração
geração
pergunta de resposta
recuperação-geração aumentada
sumarização
conversão de
Artigo científico

Modelos de base de terceiros legados

A tabela a seguir lista os modelos de base de terceiros legados disponíveis no watsonx.ai para inferência. Quando uma versão mais recente de um modelo básico é lançada, os modelos básicos existentes passam a ser considerados obsoletos. Você ainda pode acessar esses modelos antigos com o mesmo nível de suporte oferecido pelas versões mais recentes, mas é recomendável mudar para os modelos mais novos.

Tabela 5. Modelos de base de terceiros mais antigos compatíveis com o watsonx.ai
Nome do modelo Provedor Janela de contexto
(tokens de entrada + saída)
Tarefas suportadas Informações adicionais
mistral-medium-2505 Mistral AI 131.072 classificação
código
extração
geração
recuperação-geração aumentada
sumarização
conversão
Postagem no blog sobre o Mistral Medium 3
mistral-small-3-1-24b-instruct-2503 Mistral AI 131.072 classificação
código
extração
geração
recuperação-geração aumentada
sumarização
conversão
Postagem no blog sobre o Mistral Small 3
codestral-2501
Mistral AI 256.000 código Postagem no blog da Codestral 25.01
Observação:Você deve adquirir Mistral AI com IBM separadamente antes de poder utilizar este modelo.
llama-3-2-1b-instruct Meta 131.072
classificação• geração e conversão
de códigos•
extração• chamada
de funções• geração•
resposta
a perguntas• geração
aumentada por recuperação• resumo
Meta AI blog
Artigo científico
llama-3-2-3b-instruct Meta 131.072
classificação• geração e conversão
de códigos•
extração• chamada
de funções• geração•
resposta
a perguntas• geração
aumentada por recuperação• resumo
Meta AI blog
Artigo científico
llama-3-1-8b-instruct Meta 131.072 classificação
código
extração
geração
resposta da pergunta
recuperação-geração aumentada
sumarização
Meta AI blog
llama-3-1-70b-instruct Meta 131.072 classificação
código
extração
geração
resposta da pergunta
recuperação-geração aumentada
sumarização
Meta AI blog
pixtral-12b Mistral AI 128.000
classificação• geração•
geração
complementada por recuperação• resumo
Postagem no blog da Pixtral 12B

Saiba mais