Obtenir des informations sur le modèle de base
Obtenez la liste des modèles de base déployés dans watsonx.ai et filtrez-la selon vos besoins.
Moyens de se développer
Vous devez générer des identifiants pour vous authentifier auprès des API d' watsonx.ai. Pour plus d'informations, consultez la section « Génération d'un jeton porteur ».
Vous pouvez obtenir des informations sur les modèles de base disponibles en utilisant les méthodes de programmation suivantes :
Vous pouvez également consulter la liste des modèles de base et les filtrer à partir du Centre de ressources dans l'interface utilisateur d' watsonx.ai. Pour plus d'informations, consultez les ressources suivantes :
API REST
Vous pouvez utiliser la méthode « List the available foundation models » de l'API watsonx.ai pour obtenir des informations sur les modèles de base disponibles.
Les informations sur le modèle renvoyées comprennent l'identifiant du modèle, dont vous aurez besoin pour faire référence au modèle dans votre code.
Énumérer les modèles de base disponibles
La méthode `List the available foundation models` de l'API ` watsonx.ai ` permet d'obtenir des informations sur les modèles de base déployés dans votre cluster et destinés à l'inférence.
À partir d'une installation allégée d' watsonx.ai, la requête renvoie également des informations sur les modèles de base personnalisés disponibles.
curl -X GET \
'https://cpd-<namespace-name>.apps.<OCP-domain>/ml/v1/foundation_model_specs?version=2024-05-01'
Une fois que vous avez obtenu l'identifiant du modèle, vous pouvez le mentionner dans votre requête API comme suit :
curl --request POST 'https://cpd-<namespace-name>.apps.<OCP-domain>/ml/v1/text/generation?version=2023-05-02'
-H 'Authorization: Bearer ${TOKEN}'
-H 'Content-Type: application/json'
-H 'Accept: application/json'
--data-raw '{
"model_id": "ibm/granite-8b-code-instruct",
"input": "Tell me a story",
"project_id": "63dc4cf1-252f-424b-b52d-5cdd9814987f"
}'
Identifiants de modèles pour l'inférence de modèles de base
La liste suivante indique les valeurs à utiliser dans le {model_id} paramètre lorsque vous effectuez une inférence sur un modèle de base à partir de l'API.
allam-1-13b-instruct
sdaia/allam-1-13b-instructdevstral-medium-2507
mistralai/devstral-medium-2507codestral-2501
mistralai/codestral-2501codestral-2508
mistralai/codestral-2508gpt-oss-20b
openai/gpt-oss-20bgpt-oss-120b
openai/gpt-oss-120bgranite-4-h-tiny
ibm/granite-4-h-tinygranite-4-h-small
ibm/granite-4-h-smallgranite-4-h-micro
ibm/granite-4-h-microgranite-4-1b-speech
ibm/granite-4-1b-speechgranite-3-2-8b-instruct
ibm/granite-3-2-8b-instructgranite-3-2b-instruct
ibm/granite-3-2b-instructgranite-3-8b-instruct
ibm/granite-3-8b-instructgranite-docling-258M
ibm/granite-docling-258Mgranite-guardian-3-2-5b
ibm/granite-guardian-3-2-5bgranite-guardian-3-2b
ibm/granite-guardian-3-2bgranite-guardian-3-8b
ibm/granite-guardian-3-8bgranite-3b-code-instruct
ibm/granite-3b-code-instructgranite-8b-code-instruct
ibm/granite-8b-code-instructgranite-20b-code-instruct
ibm/granite-20b-code-instructgranite-34b-code-instruct
ibm/granite-34b-code-instructgranite-vision-3-3-2b
ibm/granite-vision-3-3-2bgranite-vision-3-2-2b
ibm/granite-vision-3-2-2bibm-defense-3-3-8b-instruct
ibm/ibm-defense-3-3-8b-instructibm-defense-4-0-micro
ibm/ibm-defense-4-0-microjais-13b-chat
core42/jais-13b-chatllama-4-maverick-17b-128e-instruct-fp8
meta-llama/llama-4-maverick-17b-128e-instruct-fp8llama-4-maverick-17b-128e-instruct-int4
redhatai/llama-4-maverick-17b-128e-instruct-int4llama-4-scout-17b-16e-instruct-int4
redhatai/llama-4-scout-17b-16e-instruct-int4llama-3-3-70b-instruct
meta-llama/llama-3-3-70b-instructllama-3-2-1b-instruct
meta-llama/llama-3-2-1b-instructllama-3-2-3b-instruct
meta-llama/llama-3-2-3b-instructllama-3-2-11b-vision-instruct
meta-llama/llama-3-2-11b-vision-instructllama-guard-3-11b-instruct
meta-llama/llama-guard-3-11b-visionllama-3-1-8b-instruct
meta-llama/llama-3-1-8b-instructllama-3-1-70b-instruct
meta-llama/llama-3-1-70b-instructministral-3b-instruct-2512
mistralai/ministral-3b-instruct-2512ministral-8b-instruct
mistralai/ministral-8b-instructmistral-medium-2505
mistralai/mistral-medium-2505mistral-medium-2508
mistralai/mistral-medium-2508mistral-large-instruct-2411
mistralai/mistral-large-instruct-2411mistral-small-3-1-24b-instruct-2503
mistralai/mistral-small-3-1-24b-instruct-2503nvidia-nemotron-nano-12b-v2-vl-fp8
nvidia/nvidia-nemotron-nano-12b-v2-vl-fp8nvidia-nemotron-3-nano-30b-a3b-fp8
nvidia/nvidia-nemotron-3-nano-30b-a3b-fp8pixtral-12b
mistralai/pixtral-12bpixtral-large-instruct-2411
mistralai/pixtral-large-instructvoxtral-small-24b-2507
mistralai/voxtral-small-24b-2507voxtral-mini-2507
mistralai/voxtral-mini-2507