Obtenir des informations sur le modèle de base

Obtenez la liste des modèles de base déployés dans watsonx.ai et filtrez-la selon vos besoins.

Moyens de se développer

Vous devez générer des identifiants pour vous authentifier auprès des API d' watsonx.ai. Pour plus d'informations, consultez la section « Génération d'un jeton porteur ».

Vous pouvez obtenir des informations sur les modèles de base disponibles en utilisant les méthodes de programmation suivantes :

Vous pouvez également consulter la liste des modèles de base et les filtrer à partir du Centre de ressources dans l'interface utilisateur d' watsonx.ai. Pour plus d'informations, consultez les ressources suivantes :

API REST

Vous pouvez utiliser la méthode « List the available foundation models » de l'API watsonx.ai pour obtenir des informations sur les modèles de base disponibles.

Les informations sur le modèle renvoyées comprennent l'identifiant du modèle, dont vous aurez besoin pour faire référence au modèle dans votre code.

Énumérer les modèles de base disponibles

La méthode `List the available foundation models` de l'API ` watsonx.ai ` permet d'obtenir des informations sur les modèles de base déployés dans votre cluster et destinés à l'inférence.

À partir d'une installation allégée d' watsonx.ai, la requête renvoie également des informations sur les modèles de base personnalisés disponibles.

curl -X GET \
  'https://cpd-<namespace-name>.apps.<OCP-domain>/ml/v1/foundation_model_specs?version=2024-05-01'

Une fois que vous avez obtenu l'identifiant du modèle, vous pouvez le mentionner dans votre requête API comme suit :

curl --request POST 'https://cpd-<namespace-name>.apps.<OCP-domain>/ml/v1/text/generation?version=2023-05-02'
-H 'Authorization: Bearer ${TOKEN}'
-H 'Content-Type: application/json'
-H 'Accept: application/json'
--data-raw '{
  "model_id": "ibm/granite-8b-code-instruct",
  "input": "Tell me a story",
  "project_id": "63dc4cf1-252f-424b-b52d-5cdd9814987f"
}'

Identifiants de modèles pour l'inférence de modèles de base

La liste suivante indique les valeurs à utiliser dans le {model_id} paramètre lorsque vous effectuez une inférence sur un modèle de base à partir de l'API.

  • allam-1-13b-instruct

    sdaia/allam-1-13b-instruct
    
  • devstral-medium-2507

    mistralai/devstral-medium-2507
    
  • codestral-2501

    mistralai/codestral-2501
    
  • codestral-2508

    mistralai/codestral-2508
    
  • gpt-oss-20b

    openai/gpt-oss-20b
    
  • gpt-oss-120b

    openai/gpt-oss-120b
    
  • granite-4-h-tiny

    ibm/granite-4-h-tiny
    
  • granite-4-h-small

    ibm/granite-4-h-small
    
  • granite-4-h-micro

    ibm/granite-4-h-micro
    
  • granite-4-1b-speech

    ibm/granite-4-1b-speech
    
  • granite-3-2-8b-instruct

    ibm/granite-3-2-8b-instruct
    
  • granite-3-2b-instruct

    ibm/granite-3-2b-instruct
    
  • granite-3-8b-instruct

    ibm/granite-3-8b-instruct
    
  • granite-docling-258M

    ibm/granite-docling-258M
    
  • granite-guardian-3-2-5b

    ibm/granite-guardian-3-2-5b
    
  • granite-guardian-3-2b

    ibm/granite-guardian-3-2b
    
  • granite-guardian-3-8b

    ibm/granite-guardian-3-8b
    
  • granite-3b-code-instruct

    ibm/granite-3b-code-instruct
    
  • granite-8b-code-instruct

    ibm/granite-8b-code-instruct
    
  • granite-20b-code-instruct

    ibm/granite-20b-code-instruct
    
  • granite-34b-code-instruct

    ibm/granite-34b-code-instruct
    
  • granite-vision-3-3-2b

    ibm/granite-vision-3-3-2b
    
  • granite-vision-3-2-2b

    ibm/granite-vision-3-2-2b
    
  • ibm-defense-3-3-8b-instruct

    ibm/ibm-defense-3-3-8b-instruct
    
  • ibm-defense-4-0-micro

    ibm/ibm-defense-4-0-micro
    
  • jais-13b-chat

    core42/jais-13b-chat
    
  • llama-4-maverick-17b-128e-instruct-fp8

    meta-llama/llama-4-maverick-17b-128e-instruct-fp8
    
  • llama-4-maverick-17b-128e-instruct-int4

    redhatai/llama-4-maverick-17b-128e-instruct-int4
    
  • llama-4-scout-17b-16e-instruct-int4

    redhatai/llama-4-scout-17b-16e-instruct-int4
    
  • llama-3-3-70b-instruct

    meta-llama/llama-3-3-70b-instruct
    
  • llama-3-2-1b-instruct

    meta-llama/llama-3-2-1b-instruct
    
  • llama-3-2-3b-instruct

    meta-llama/llama-3-2-3b-instruct
    
  • llama-3-2-11b-vision-instruct

    meta-llama/llama-3-2-11b-vision-instruct
    
  • llama-guard-3-11b-instruct

    meta-llama/llama-guard-3-11b-vision
    
  • llama-3-1-8b-instruct

    meta-llama/llama-3-1-8b-instruct
    
  • llama-3-1-70b-instruct

    meta-llama/llama-3-1-70b-instruct
    
  • ministral-3b-instruct-2512

    mistralai/ministral-3b-instruct-2512
    
  • ministral-8b-instruct

    mistralai/ministral-8b-instruct
    
  • mistral-medium-2505

    mistralai/mistral-medium-2505
    
  • mistral-medium-2508

    mistralai/mistral-medium-2508
    
  • mistral-large-instruct-2411

    mistralai/mistral-large-instruct-2411
    
  • mistral-small-3-1-24b-instruct-2503

    mistralai/mistral-small-3-1-24b-instruct-2503
    
  • nvidia-nemotron-nano-12b-v2-vl-fp8

    nvidia/nvidia-nemotron-nano-12b-v2-vl-fp8
    
  • nvidia-nemotron-3-nano-30b-a3b-fp8

    nvidia/nvidia-nemotron-3-nano-30b-a3b-fp8
    
  • pixtral-12b

    mistralai/pixtral-12b
    
  • pixtral-large-instruct-2411

    mistralai/pixtral-large-instruct
    
  • voxtral-small-24b-2507

    mistralai/voxtral-small-24b-2507
    
  • voxtral-mini-2507

    mistralai/voxtral-mini-2507