Modelos de base compatíveis no watsonx.ai
Você pode trabalhar com modelos de base de terceiros e do IBM no IBM watsonx.ai.
Como escolher um modelo
Para conhecer os fatores que podem ajudá-lo a escolher um modelo, como tarefas e linguagens compatíveis, consulte Escolhendo um modelo e Benchmarks de modelos de base.
Você pode optar por implantar modelos básicos fornecidos com o watsonx.ai, modelos otimizados ou modelos básicos personalizados adequados a um caso de uso específico. Para saber mais sobre as diversas formas de implantar modelos no watsonx.ai, consulte Métodos de implantação de modelos do Foundation.
Para obter mais informações sobre os modelos básicos fornecidos com o watsonx.ai para incorporação e reclassificação de texto, consulte Modelos de codificador compatíveis.
Acesso a modelos de outros provedores por meio do gateway de modelos
Você pode acessar e interagir com segurança com modelos de base de vários fornecedores por meio do gateway de modelos. O gateway de modelos oferece uma API OpenAI-compatible que encaminha as solicitações para esses modelos básicos. Use o gateway de modelos para alternar com eficiência entre vários provedores de modelos, encaminhando e formatando as solicitações por meio de uma interface unificada. Você pode criar e implantar agentes de IA, padrões RAG e muito mais usando esses modelos.
Para obter mais informações, consulte “Gateway modelo ”.
Modelos básicos prontos para uso
Você pode implantar modelos básicos a partir de uma coleção de modelos selecionados pelo IBM em watsonx.ai. Você pode acionar esses modelos de base no ` Prompt Lab ` ou por meio de programação.
Você pode trabalhar com os seguintes tipos de modelos de fundação fornecidos:
Todos os modelos de fundação da IBM disponíveis em watsonx.ai são protegidos por IBM.
Para obter informações sobre os requisitos de GPU para os modelos de base compatíveis, consulte a seção “Modelos de base” em IBMwatsonx.ai na documentação do IBMSoftware Hub.
Modelos de base IBM
Você pode inferir os seguintes modelos de base compatíveis, fornecidos pelo IBM. Os modelos base devem ser implementados em seu cluster por um administrador para estarem disponíveis para uso. Todos os modelos da IBM são ajustados por instrução
Últimos modelos de base do IBM
A tabela a seguir lista os modelos básicos mais recentes do IBM disponíveis no watsonx.ai para inferência.
| Nome do modelo | Janela de contexto (tokens de entrada + saída) |
Tarefas suportadas | Informações adicionais |
|---|---|---|---|
| granite-4-1b-speech | 128.000 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• extração• tradução• chamada de função • código |
• Documentação do ` Granite ` e do ` 4.0 ` |
| granite-4-1b-speech | 128.000 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• extração• tradução• chamada de função • código |
• Documentação do ` Granite ` e do ` 4.0 ` |
| ibm-defense-4-0-small | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• chamada de função |
• Modelo de Defesa de IBM |
| ibm-defense-4-0-micro | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• chamada de função |
• Modelo de Defesa de IBM |
| granite-docling-258M | 8.192 | • extração• geração• geração aumentada por recuperação |
• Documentação do Docling em Granite |
| granite-4-h-tiny | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função |
• Documentação do ` Granite ` e do ` 4.0 ` |
| granite-4-h-micro | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função • código |
• Documentação do ` Granite ` e do ` 4.0 ` |
| granite-4-h-small | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função • código |
• Documentação do ` Granite ` e do ` 4.0 ` |
| ibm-defense-3-3-8b-instruct | 128.000 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função |
• Modelo de Defesa de IBM |
| granite-vision-3-3-2b | 131.072 | • resposta a perguntas • geração |
• Documentação do Granite Vision |
| granite-3-3-8b-instruct | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função |
• Blog sobre modelos da Granite |
| granite-guardian-3-2-5b | 128.000 | classificação extração geração resposta da pergunta sumarização |
• Documentação do Guardian sobre o Granite |
| Nome do modelo | Comprimento do contexto: Número mínimo de pontos de dados |
Informações adicionais |
|---|---|---|
| granite-ttm-512-96-r2 |
512 | • Documentação sobre séries temporais do Granite • Artigo científico |
| granite-ttm-1024-96-r2 |
1.024 | • Documentação sobre séries temporais do Granite • Artigo científico |
| granite-ttm-1536-96-r2 |
1.536 | • Documentação sobre séries temporais do Granite • Artigo científico |
Modelos de base do IBM
A tabela a seguir lista os modelos de base do IBM, da versão anterior, disponíveis no watsonx.ai para inferência. Quando uma versão mais recente de um modelo básico é lançada, os modelos básicos existentes passam a ser considerados obsoletos. Você ainda pode acessar esses modelos antigos com o mesmo nível de suporte oferecido pelas versões mais recentes, mas é recomendável mudar para os modelos mais novos.
| Nome do modelo | Janela de contexto (tokens de entrada + saída) |
Tarefas suportadas | Informações adicionais |
|---|---|---|---|
| granite-3-2-8b-instruct | 131.072 | • classificação• extração• geração• resposta a perguntas• resumo• geração aumentada por recuperação• código• extração• tradução• chamada de função |
• Site • Artigo científico |
| granite-3-2b-instruct | 4.096 | • classificação• extração• chamada de funções• geração• resposta a perguntas• resumo |
• Site • Artigo científico |
| granite-3-8b-instruct | 4.096 | • classificação• extração• chamada de funções• geração• resposta a perguntas• resumo |
• Site • Artigo científico |
| granite-guardian-3-2b | 8.192 | classificação extração geração resposta da pergunta sumarização |
• Site |
| granite-guardian-3-8b | 8.192 | classificação extração geração resposta da pergunta sumarização |
• Site |
| granite-20b-code-base-schema-linking | 8.192 | código | • Artigo científico |
| granite-20b-code-base-sql-gen | 8.192 | código | • Artigo científico |
| granite-8b-code-instruct | 128.000 | • código • classificação • Extração • geração • resposta a perguntas • resumo |
• Site • Artigo científico |
| granite-vision-3-2-2b | 131.072 | • resposta a perguntas | • Site • Artigo científico |
Modelos de fundação de terceiros
Você pode inferir os seguintes modelos de base de terceiros compatíveis. Um administrador deve implementar os modelos básicos no seu cluster antes que você possa utilizá-los.
Modelos de base de terceiros mais recentes
A tabela a seguir lista os modelos básicos compatíveis fornecidos por terceiros.
| Nome do modelo | Provedor | Janela de contexto (tokens de entrada + saída) |
Tarefas suportadas | Informações adicionais |
|---|---|---|---|---|
| voxtral-mini-2507 | Mistral AI | 32.000 | • chamada de funções • geração • resposta a perguntas • resumo • • tradução |
Postagem no blog sobre o Ministral 3 |
| ministral-3-14b-instruct-2512-bf16 | Mistral AI | 256.000 | • Autocompletar conversas • Chamada de funções • Agentes e conversas • Saídas estruturadas • OCR • Document QnA • Preenchimento de lacunas (FIM) • Incorporações |
Postagem no blog sobre o Ministral 3 |
| ministral-3b-instruct-2512 | Mistral AI | 256.000 | • autocompletar conversas • agentes e conversas • resultados reestruturados • OCR • representações de vetores • classificação • extração • chamada de funções • geração • resposta a perguntas • geração aumentada por recuperação • resumo • tradução |
Postagem no blog sobre o Ministral 3 |
| nvidia-nemotron-nano-12b-v2-vl-fp8 | NVIDIA | 128.000 | • classificação• extração• geração• geração aumentada por recuperação• resumo• tradução• chamada de funções• código de resposta a perguntas • |
Hugging Face |
| nvidia-nemotron-3-nano-30b-a3b-fp8 | NVIDIA | 256.000 | • classificação• extração• geração• geração aumentada por recuperação• resumo• tradução• chamada de funções• código de resposta a perguntas • |
Hugging Face |
| magistral-small-2509 | Mistral AI | 128.000 | • classificação• extração• geração auxiliada por recuperação• resumo• tradução• chamada de funções• código de resposta a perguntas • |
|
| magistral-medium-2509 | Mistral AI | 128.000 | • classificação• código• correção de código• explicação de código• geração de código• extração• geração aumentada por recuperação• resumo• tradução• chamada de função• código de resposta a perguntas • |
|
| ministral-3-8b-instruct-2512 | Mistral AI | 256.000 | • classificação• extração• geração auxiliada por recuperação• resumo• tradução• chamada de funções• código de resposta a perguntas • |
|
| ministral-14b-instruct-2512 | Mistral AI | 262.144 | • classificação• extração• geração• geração aumentada por recuperação• resumo• tradução• chamada de funções• resposta a perguntas |
Postagem no blog sobre o Ministral 3 |
| mistral-large-2512 | Mistral AI | 131.072 | • classificação• código• extração• geração• geração aumentada por recuperação• resumo• tradução• chamada de função |
• Postagem no blog sobre o Mistral Large 3 |
| devstral-medium-2512 |
Mistral AI | 256.000 | código | • Postagem no blog sobre o Devstral 2 Observação:
|
| devstral-small-2512 |
Mistral AI | 256.000 | código | • Postagem no blog sobre o Devstral 2 |
| codestral-2508 |
Mistral AI | 256.000 | código | • Postagem no blog da Codestral 25.08 Observação:
|
| devstral-medium-2507 |
Mistral AI | 128.000 | código | • Postagem no blog da Codestral 25.01 Observação:
|
| mistral-medium-2508 | Mistral AI | 131.072 | classificação código extração geração recuperação-geração aumentada sumarização conversão |
• Postagem no blog sobre o Mistral Medium 3 Observação:
|
| mistral-small-3-2-24b-instruct-2506 | Mistral AI | 131.072 | • classificação • extração • geração • resposta a perguntas • geração aumentada por recuperação • resumo • chamada de funções • código • tradução |
• Artigo científico |
| gpt-oss-20b | OpenAI | 131.072 | • classificação • extração • geração • resposta a perguntas • geração aumentada por recuperação • resumo • chamada de funções • código • tradução |
• Blog do OpenAI |
| gpt-oss-120b | OpenAI | 131.072 | • classificação • extração • resposta a perguntas • geração aumentada por recuperação • resumo • chamada de funções • código • tradução |
• Blog do OpenAI |
| voxtral-small-24b-2507 | Mistral AI | 32.000 | • classificação • extração • geração • resposta a perguntas • geração aumentada por recuperação • resumo • tradução • chamada de função • compreensão de áudio |
• Blog da Voxtral |
| llama-4-maverick-17b-128e-instruct-fp8 | Meta | 131.072 | • classificação• código• extração• geração• resposta a perguntas• geração aumentada por recuperação• resumo • tradução • chamada de função |
• Meta AI blog |
| llama-4-maverick-17b-128e-instruct-int4 | Meta | 131.072 | • classificação• código• extração• geração• resposta a perguntas• geração aumentada por recuperação• resumo • tradução • chamada de função |
• Meta AI blog |
| llama-4-scout-17b-16e-instruct-int4 | Meta | 131.072 | • classificação• código• extração• geração• resposta a perguntas• geração aumentada por recuperação• resumo • tradução • chamada de função |
• Meta AI blog |
| llama-3-3-70b-instruct |
Meta | 131.072 | classificação código extração geração resposta da pergunta recuperação-geração aumentada sumarização |
• Meta AI blog • Meta AI documentos |
| llama-3-2-11b-vision-instruct | Meta | 131.072 | • classificação• geração e conversão de códigos• extração• chamada de funções• geração• resposta a perguntas• geração aumentada por recuperação• resumo |
• Meta AI blog • Artigo científico |
| llama-3-2-90b-vision-instruct | Meta | 131.072 | • classificação• geração e conversão de códigos• extração• chamada de funções• geração• resposta a perguntas• geração aumentada por recuperação• resumo |
• Meta AI blog • Artigo científico |
| llama-guard-3-11b-vision | Meta | 131.072 | • classificação• geração e conversão de códigos• extração• chamada de funções• geração• resposta a perguntas• geração aumentada por recuperação• resumo |
• Meta AI blog • Artigo científico |
| ministral-8b-instruct | Mistral AI | 128.000 | • classificação• código• extração• geração• geração aumentada por recuperação• resumo• tradução• resposta a perguntas• chamada de funções |
• Postagem no blog da Ministral 8b Observação:
|
| mistral-large-instruct-2411 |
Mistral AI | 131.072 | classificação código extração geração recuperação-geração aumentada sumarização conversão |
• Postagem no blog sobre o Mistral Large 2 |
| pixtral-large-instruct-2411 |
Mistral AI | 128.000 | • classificação• geração• geração complementada por recuperação• resumo |
• Postagem no blog para o Pixtral Large Observação:
|
| allam-1-13b-instruct | Centro Nacional de Inteligência Artificial e Autoridade Saudita de Dados e Inteligência Artificial | 4.096 | classificação extração geração pergunta de resposta recuperação-geração aumentada sumarização conversão de |
• Artigo científico |
Modelos de base de terceiros legados
A tabela a seguir lista os modelos de base de terceiros legados disponíveis no watsonx.ai para inferência. Quando uma versão mais recente de um modelo básico é lançada, os modelos básicos existentes passam a ser considerados obsoletos. Você ainda pode acessar esses modelos antigos com o mesmo nível de suporte oferecido pelas versões mais recentes, mas é recomendável mudar para os modelos mais novos.
| Nome do modelo | Provedor | Janela de contexto (tokens de entrada + saída) |
Tarefas suportadas | Informações adicionais |
|---|---|---|---|---|
| mistral-medium-2505 | Mistral AI | 131.072 | classificação código extração geração recuperação-geração aumentada sumarização conversão |
• Postagem no blog sobre o Mistral Medium 3 |
| mistral-small-3-1-24b-instruct-2503 | Mistral AI | 131.072 | classificação código extração geração recuperação-geração aumentada sumarização conversão |
• Postagem no blog sobre o Mistral Small 3 |
| codestral-2501 |
Mistral AI | 256.000 | código | • Postagem no blog da Codestral 25.01 Observação:
|
| llama-3-2-1b-instruct | Meta | 131.072 | • classificação• geração e conversão de códigos• extração• chamada de funções• geração• resposta a perguntas• geração aumentada por recuperação• resumo |
• Meta AI blog • Artigo científico |
| llama-3-2-3b-instruct | Meta | 131.072 | • classificação• geração e conversão de códigos• extração• chamada de funções• geração• resposta a perguntas• geração aumentada por recuperação• resumo |
• Meta AI blog • Artigo científico |
| llama-3-1-8b-instruct | Meta | 131.072 | classificação código extração geração resposta da pergunta recuperação-geração aumentada sumarização |
• Meta AI blog |
| llama-3-1-70b-instruct | Meta | 131.072 | classificação código extração geração resposta da pergunta recuperação-geração aumentada sumarização |
• Meta AI blog |
| pixtral-12b | Mistral AI | 128.000 | • classificação• geração• geração complementada por recuperação• resumo |
• Postagem no blog da Pixtral 12B |