IBM modèles de base
Dans IBM watsonx.ai, vous pouvez utiliser des modèles de base IBM construits avec intégrité et conçus pour l'entreprise.
La famille Granite des modèles de base IBM inclut des modèles de décodeur uniquement qui peuvent efficacement prévoir et générer du langage.
Les modèles ont été créés avec des données de confiance présentant les caractéristiques suivantes:
- Provenant d'ensembles de données de qualité dans des domaines tels que la finance (SEC Filings), le droit (Free Law), la technologie (Stack Exchange), la science ( arXiv, DeepMind Mathématiques), littérature (Projet Gutenberg ( PG-19)), et plus.
- Conforme aux normes de gouvernance et d'approbation des données IBM rigoureuses.
- Épuré de la haine, des abus et des grossièretés, de la duplication des données et des URL bloquées, entre autres choses.
IBM s'engage à développer une IA ouverte, fiable, ciblée et responsabilisante. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, veuillez consulter le contrat de relation client d' IBM.
Les modèles de base suivants, issus de IBM, sont disponibles sur watsonx.ai:
- ibm-defense-4-0-micro
- ibm-defense-4-0-small
- ibm-defense-3-3-8b-instruct
- granite-docling-258M
- granite-4-h-tiny
- granite-4-h-small
- granite-4-h-micro
- granite-4-1b-speech
- granite-3-3-8b-instruct
- granite-3-2-8b-instruct
- granite-3-1-8b-base
- granite-3-2b-instruct
- granite-3-8b-instruct
- granite-3b-code-instruct
- granite-8b-code-instruct
- granite-20b-code-instruct
- granite-20b-code-base-schema-linking
- granite-20b-code-base-sql-gen
- granite-34b-code-instruct
- granite-guardian-3-2-5b
- granite-guardian-3-2b
- granite-guardian-3-8b
- granite-ttm-512-96-r2
- granite-ttm-1024-96-r2
- granite-ttm-1536-96-r2
- granite-vision-3-3-2b
- granite-vision-3-2-2b
Pour plus d'informations sur la configuration GPU requise pour les modèles de base pris en charge, consultez la section « Modèles de base » de la documentation « IBM » disponible à l'adresse Software Hub.
Pour plus d'informations sur les modèles d'encodeurs développés par IBM, consultez la section « Modèles de base d'encodeurs pris en charge ».
Pour plus d'informations sur les modèles de base tiers, consultez la section « Modèles de base tiers ».
Comment choisir un modèle
Pour découvrir les critères qui peuvent vous aider à choisir un modèle, tels que les tâches et les langues prises en charge, consultez les sections « Choisir un modèle » et « Comparatifs des modèles de base ».
Un modèle de base obsolète est signalé par une icône d'avertissement indiquant qu'il est obsolète.
Les modèles de fondation retirés sont signalés par une icône d'avertissement de retrait. Pour plus d'informations sur la dépréciation et le retrait des modèles, consultez la section « Cycle de vie des modèles de base ».
Détails du modèle de base
Les modèles de base d' watsonx.ai prennent en charge un large éventail de cas d'utilisation, tant pour les langues naturelles que pour les langages de programmation. Pour découvrir les types de tâches que ces modèles sont capables d'effectuer, consultez et testez les exemples de requêtes.
IBM 4.0 de la Défense
Les modèles « Defense 4.0 » d' IBM constituent une famille de grands modèles linguistiques (LLM) spécialement conçus pour la défense. Ces modèles sont conçus pour s'intégrer aux données de base de Jane's sur la défense afin de fournir des résultats rapides, fiables et contextualisés pour les tâches essentielles au bon fonctionnement des organisations de défense.
- Utilisation
Capable d'effectuer des tâches génératives courantes, notamment la classification, l'appel de fonctions, la synthèse, la réponse à des questions, la génération augmentée par la recherche, et bien plus encore.
- Taille
Micro : 3 milliards de paramètres Petit : 30 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) :
- ibm-defense-4-0-h-micro: 131 072
- ibm-defense-4-0-h-small: 131 072
- ibm-defense-4-0-h-micro: 131 072
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois.
- Informations sur l'optimisation des instructions
Les modèles de base de l'approche « Defense- 4.0 » ( IBM ) ont été affinés à partir des modèles de base de l'approche « Granite » ( 4.0 ). Les données d'entraînement des modèles comprennent des ensembles de données accessibles au public sous licence libre, des données synthétiques générées en interne pour améliorer le raisonnement, des ensembles de données militaires accessibles au public, ainsi que de la documentation sélectionnée, des exemples d'utilisation et des exemples synthétiques d'interactions avec l'API Janes.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite Docling
ce modèle a été lancé à l'occasion de la sortie d' 2.3.0.
Granite Docling est un modèle multimodal « image-texte vers texte » particulièrement efficace pour la conversion de documents. Ce modèle conserve les fonctionnalités essentielles de Docling tout en assurant une intégration transparente avec DoclingDocuments; il est capable d'analyser des fichiers PDF, des diapositives et des pages numérisées pour les convertir directement en formats structurés et lisibles par machine.
- Utilisation
Idéal pour la compréhension et la conversion de documents.
- Taille
258 millions de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 8 192
- Langues naturelles prises en charge
Anglais
- Informations sur l'optimisation des instructions
Conçu à partir d' Idefics3 et formé à l'aide du framework nanoVLM. Les données d'entraînement se composent d'ensembles de données accessibles au public et d'ensembles de données synthétiques créés en interne, conçus pour évaluer des capacités spécifiques de compréhension de documents.
- Architecture type
Codeur-décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite 4 modèles
Les modèles de base de la fondation Granite 4.0 font partie de la famille de modèles IBM Granite. Les modèles « granite-4-h-small », « granite-4-h-micro » et « granite-4-h-tiny » sont des modèles capables d'exécuter des instructions, conçus pour offrir des capacités de traitement de contextes structurés et de grande longueur. Ces modèles ont recours au réglage fin, à l'apprentissage par renforcement et à la fusion de modèles pour améliorer leurs performances. Granite 4.0 offre une meilleure gestion des instructions et une meilleure utilisation des outils, ce qui le rend particulièrement adapté aux tâches d'entreprise.
ce modèle d' granite-4-h-tiny s a été introduit avec la version 2.3.0.
- Utilisation
Conçu pour répondre à des instructions générales, il peut être utilisé pour développer des assistants IA dans divers domaines, y compris les applications professionnelles. Ce modèle est capable d'effectuer des tâches génératives courantes, notamment la synthèse, la classification de textes, l'extraction de texte, la réponse à des questions, la génération augmentée par la recherche (RAG), les tâches d'appel de fonctions, le code « Fill-In-the-Middle » (FIM) et les cas d'utilisation de dialogues multilingues.
- Taille
- Petit : 30 milliards de paramètres
- Une goutte d'eau dans l'océan : 7 milliards de paramètres
- Micro : 3 milliards de paramètres
- Petit : 30 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) :
- granite-4-h-small: 131 072
- granite-4-h-tiny: 131 072
- granite-4-h-micro: 131 072
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois. Les utilisateurs peuvent affiner les modèles d' Granite 4.0 au-delà de ces langues.
- Informations sur l'optimisation des instructions
Les modèles « Granite » 4 ont été affinés à partir de « Granite-4.0-H-Small-Base » en combinant des ensembles de données d'instructions open source sous licence permissive et des ensembles de données synthétiques collectés en interne.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
granite-4-1b-speech
granite-4.0-1b-speech est un modèle linguistique compact et performant, spécialement conçu pour la reconnaissance vocale automatique (ASR) multilingue et la traduction automatique bidirectionnelle (AST). Le modèle a été entraîné à partir d'un ensemble de corpus publics comprenant divers ensembles de données destinés à la reconnaissance vocale (ASR) et à la traduction vocale (AST), ainsi que des ensembles de données synthétiques spécialement conçus pour la reconnaissance vocale en japonais, la reconnaissance vocale axée sur des mots-clés et la traduction vocale. granite-4.0-1b-speech a été formé par un modèle d'alignement « granite-4.0-1b-base -to-speech » sur des corpus open source accessibles au public, contenant des données audio en entrée et des textes cibles.
- Utilisation
- Capable d'effectuer des tâches génératives courantes, notamment des tâches liées au code, l'appel de fonctions, la réponse à des questions, la synthèse, la traduction, etc.
- Taille
- 1 milliard de paramètres
- Limites de jetons
- Longueur de la fenêtre de contexte (entrée + sortie) : 128 000
- Langues naturelles prises en charge
- anglais, français, allemand, espagnol, portugais, japonais
- Informations sur l'optimisation des instructions
- Ce modèle ne peut pas être ajusté
- Architecture type
- Architecture de pipeline en trois étapes (codeur vocal, projecteur vocal/sous-échantillonneur, modèle linguistique de grande envergure (LLM))
ibm-defense-3-3-8b-instruct
Le modèle « IBM » watsonx.ai est une version optimisée du modèle « granite-3-3-8b-instruct », qui a été entraîné à partir de connaissances générales sur l'industrie de la défense et de l'API Janes. Le modèle « ibm-defense-3-3-8b-instruct » est conçu pour effectuer à la fois des appels d'outils via l'API Janes Inventory et des tâches de génération augmentée par la recherche (RAG). Ce modèle est capable de synthétiser des données, d'en extraire les informations clés, d'identifier des tendances et d'exploiter des connaissances spécifiques au domaine de la défense afin de fournir des résultats rapides, fiables et adaptés au contexte.
- Utilisation
Capable d'effectuer des tâches génératives courantes, notamment des tâches liées au code, l'appel de fonctions, l'exécution d'instructions, la réponse à des questions, et bien plus encore. Spécialisé dans la génération augmentée d'appels et de récupération d'outils.
- Taille
8 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 128 000
- Langues naturelles prises en charge
Anglais. Cependant, le modèle de base en granit prend également en charge l'allemand, l'espagnol, le français, le japonais, le portugais, l'arabe, le tchèque, l'italien, le coréen, le néerlandais et le chinois. Vous pouvez affiner davantage le modèle d' Granite s afin de prendre en charge d'autres langues.
- Informations sur l'optimisation des instructions
Conçu à partir d' granite-3-3-8b-base, le modèle s'appuie sur des données d'entraînement comprenant des ensembles de données accessibles au public sous licence libre, des données synthétiques générées en interne pour améliorer le raisonnement, des ensembles de données militaires accessibles au public, ainsi que de la documentation sélectionnée, des exemples d'utilisation et des exemples synthétiques d'interactions avec l'API Janes.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
Granite Modèles d' 3.3
Ces Granite Instruct modèles de base font partie de la famille de modèles « IBM » ( Granite ). Les modèles de base « granite-3-3-2b-instruct » et « granite-3-3-8b-instruct » sont disponibles à l'adresse Granite 3.3. Ces modèles s'appuient sur des versions antérieures pour améliorer les capacités de raisonnement, de calcul, de programmation et d'exécution d'instructions.
- Utilisation
- Conçu pour exceller dans les tâches nécessitant une compréhension de contextes étendus et l'exécution d'instructions, telles que la synthèse, la résolution de problèmes, la traduction de textes, le raisonnement, les tâches de programmation, l'appel de fonctions, etc. Peut être intégré à des assistants IA dans divers domaines.
Dimensions - 8 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie)
- 8b: 131 072
Remarque : le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 16 384.
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois. Toutefois, les utilisateurs peuvent affiner ces modèles d' Granite s pour d'autres langues que ces 12 langues.
- Langages de programmation pris en charge
Les Granite Instruct modèles sont entraînés à l'aide de code écrit dans 116 langages de programmation.
- Informations sur l'optimisation des instructions
Ces Granite Instruct modèles sont des modèles de base optimisés Granite Instruct , entraînés sur plus de 12 000 milliards de tokens à partir d'un mélange de données d'instructions open source sous licence permissive et de données propriétaires.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
granite-3-2-8b-instruct
Ce modèle de base est obsolète dans la version 2.4.0. Voir le cycle de vie des modèles de base.
Granite 3.2 Instruct est un modèle de base à long contexte qui a été optimisé pour offrir des capacités de raisonnement améliorées. La capacité de raisonnement est configurable, ce qui signifie que vous pouvez déterminer à quel moment le raisonnement est appliqué.
- Utilisation
Capable d'effectuer des tâches génératives courantes, notamment des tâches liées au code, l'appel de fonctions et des dialogues multilingues. Spécialisé dans le raisonnement et les tâches nécessitant une compréhension approfondie du contexte, telles que la synthèse de longs documents ou de comptes rendus de réunion. Il est capable de répondre à des questions en s'appuyant sur le contexte tiré de longs documents.
- Taille
8 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 131 072
Remarque : le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 16 384.
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois
- Informations sur l'optimisation des instructions
Conçu à partir d' Granite-3.1-8B-Instruct, le modèle a été entraîné à l'aide d'un mélange de jeux de données open source sous licence permissive et de données synthétiques générées en interne, spécialement conçues pour des tâches de raisonnement.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
granite-3-1-8b-base
Le modèle de base « granite-3-1-8b-base » fait partie de la famille de modèles IBM Granite 3.1. Ce modèle étend la longueur du contexte de granite-3-8b-base.
- Utilisation
Le Granite 3.1 modèle de base est un modèle autorégressif pré-entraîné destiné à l'ajustement, à la synthèse, à la classification de textes, à l'extraction d'informations, aux systèmes de questions-réponses et à d'autres tâches nécessitant un contexte étendu.
Vous pouvez utiliser le
granite-3-1-8b-basemodèle de base uniquement à des fins de réglage fin. On ne peut pas déduire ce modèle directement.- Taille
8 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 131 072
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois. Les utilisateurs peuvent affiner les modèles d' Granite 3.1 pour des langues autres que ces 12 langues.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite Instruct 3.1 modèles
Ces Granite Instruct modèles de base font partie de la famille de modèles « IBM » ( Granite ). Les modèles de base « granite-3-2b-instruct » et « granite-3-8b-instruct » sont des modèles linguistiques optimisés par instruction pour la génération 3.0, destinés à des tâches telles que la synthèse, la génération, le codage, etc. Les modèles de base utilisent une architecture de type GPT composée uniquement d'un décodeur, enrichie d'innovations issues d' IBM Research et de la communauté open source.
Une mise à jour des modèles de base a été effectuée afin d'actualiser ces modèles sur IBM Granite 3.1. La version « 1.1.0 » de ces modèles s'appuie sur les versions précédentes pour offrir une meilleure prise en charge des tâches de codage et des fonctions intrinsèques des agents.
- Utilisation
Granite Instruct Les modèles de base sont conçus pour exceller dans les tâches consistant à suivre des instructions, telles que la synthèse, la résolution de problèmes, la traduction de textes, le raisonnement, les tâches de programmation, l'appel de fonctions, etc.
Vous pouvez utiliser le
granite-3-1-8b-basemodèle de base issu de la famille de modèles « Granite » ( 3.1 ) uniquement à des fins de réglage fin. On ne peut pas déduire ce modèle directement.
Granite Code modèles
Ces Granite Code modèles font partie de la famille des modèles de base de l' IBM Granite. Les modèles de base sont des modèles capables de suivre des instructions, qui ont été affinés à l'aide d'une combinaison de commits de l' Git, associés à des instructions humaines et à des ensembles de données open source contenant des instructions de code générées de manière synthétique.
Le modèle de base « granite-8b-code-instruct » ( v2.0.0 ) est capable de traiter des invites plus longues grâce à une fenêtre contextuelle plus étendue.
- Utilisation
Les modèles de base suivants Granite Code sont conçus pour répondre à des instructions liées au codage et peuvent être utilisés pour créer des assistants de codage :
- granite-3b-code-instruct
- granite-8b-code-instruct
- granite-20b-code-instruct
- granite-34b-code-instruct
Les modèles de base suivants Granite Code sont des versions optimisées par apprentissage par instruction du modèle de base « granite-20b-code-base », conçues pour les tâches de génération de requêtes SQL à partir de texte.
- granite-20b-code-base-schema-linking
- granite-20b-code-base-sql-gen
- Tailles
- 3 milliards de paramètres
- 8 milliards de paramètres
- 20 milliards de paramètres
- 34 milliards de paramètres
- Essayez-le
Faites des essais avec des échantillons :
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie)
granite-3b-code-instruct : 128 000
Le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 8 192.
granite-8b-code-instruct : 128 000
Le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 4 096.
granite-20b-code-instruct : 8 192
Le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 4 096.
granite-20b-code-base-schema-linking : 8 192
granite-20b-code-base-sql-gen : 8 192
granite-34b-code-instruct : 8 192
- Langues naturelles prises en charge
Anglais
- Langages de programmation pris en charge
Les Granite Code modèles de base prennent en charge 116 langages de programmation, notamment PythonJavaScript,, Java, C++, Go et Rust. Pour consulter la liste complète, rendez-vous sur IBM foundation-models.
- Informations sur l'optimisation des instructions
Ces modèles ont été affinés à Granite Code partir de modèles de base en utilisant un ensemble de données d'instructions sous licence libre, afin d'améliorer leurs capacités à suivre des instructions, notamment en matière de raisonnement logique et de résolution de problèmes.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
granite-guardian-3-2-5b
Ces Granite Guardian modèles de base font partie de la famille de modèles « IBM » ( Granite ). Le modèle de base « granite-guardian-3-2-5b » est une version allégée du modèle « Granite Guardian» 3.1 de même taille, conçu pour détecter les risques dans les invites et les réponses. Les modèles de base facilitent la détection des risques dans de nombreux domaines clés de l 'Atlas des risques liés à l'IA.
- Utilisation
Granite Guardian Les modèles de base sont conçus pour détecter les risques potentiels dans les textes générés instantanément ou les réponses des modèles (en tant que garde-fous) et peuvent être utilisés dans des cas d'utilisation de génération augmentée par la recherche pour évaluer la pertinence du contexte (à savoir si le contexte récupéré est pertinent par rapport à la requête), la fiabilité (à savoir si la réponse est exacte et fidèle au contexte fourni) et la pertinence de la réponse (à savoir si la réponse répond directement à la requête de l'utilisateur).
- Tailles
5 milliards de paramètres
- Essayez-le
Faites des essais avec des échantillons :
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 128 000
- Langues naturelles prises en charge
Anglais
- Informations sur l'optimisation des instructions
Ces Granite Guardian modèles sont des modèles affinés Granite Instruct , entraînés à partir d'une combinaison de données annotées par des humains et de données synthétiques.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite Guardian 3.1 modèles
granite-guardian-3-8b et « granite-guardian-3-2b » sont obsolètes dans la version 2.4.0. Voir le cycle de vie des modèles de base.
Ces Granite Guardian modèles de base font partie de la famille de modèles « IBM » ( Granite ). Les modèles de base « granite-guardian-3-2b » et « granite-guardian-3-8b » sont des modèles affinés Granite Instruct conçus pour détecter les risques dans les invites et les réponses. Le modèle de base facilite la détection des risques dans de nombreux domaines clés de l 'Atlas des risques liés à l'IA.
Une mise à jour des modèles de base a été effectuée afin d'actualiser ces modèles sur IBM Granite 3.1. La version « 1.1.0 » de ces modèles s'appuie sur des versions antérieures et a été entraînée à partir d'un ensemble de données annotées par des humains et de données synthétiques supplémentaires, afin d'améliorer les performances concernant les risques liés aux hallucinations et au «jailbreak».
- Utilisation
Granite Guardian Les modèles de base sont conçus pour détecter les risques liés à des contenus préjudiciables dans les textes générés instantanément ou dans les réponses des modèles (en tant que garde-fous). Ces modèles peuvent être utilisés dans des cas d'utilisation de la génération assistée par la recherche afin d'évaluer la pertinence du contexte (à savoir si le contexte extrait est pertinent par rapport à la requête), la fiabilité (à savoir si la réponse est exacte et fidèle au contexte fourni) et la pertinence de la réponse (à savoir si la réponse répond directement à la requête de l'utilisateur).
- Tailles
- 2 milliards de paramètres
- 8 milliards de paramètres
- Essayez-le
Faites des essais avec des échantillons :
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie)
- granite-guardian-3-2b: 8 192
- granite-guardian-3-8b: 8 192
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie)
- granite-guardian-3-8b: 131 072
Remarque : le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 8 192.
- Langues naturelles prises en charge
Anglais
- Informations sur l'optimisation des instructions
Ces Granite Guardian modèles sont des modèles affinés Granite Instruct , entraînés à partir d'une combinaison de données annotées par des humains et de données synthétiques.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite time series modèles
Granite time series Les modèles de base appartiennent à la famille de modèles « IBM » Granite. Ces modèles sont des modèles compacts et pré-entraînés destinés à la prévision de séries chronologiques multivariées, développés par l' IBM. Les versions suivantes sont disponibles pour la prévision de données dans l' watsonx.ai:
- granite-ttm-512-96-r2
- granite-ttm-1024-96-r2
- granite-ttm-1536-96-r2
- Utilisation
Vous pouvez appliquer l'un de ces modèles pré-entraînés à vos données cibles pour obtenir une prévision initiale sans avoir à entraîner le modèle sur vos données. À partir d'un ensemble d'observations historiques horodatées, les Granite time series modèles de base peuvent mettre à profit leur compréhension des systèmes dynamiques pour prédire les valeurs futures des données. Ces modèles fonctionnent mieux avec des points de données à intervalles d'une minute ou d'une heure et génèrent un ensemble de données prévisionnelles pouvant contenir jusqu'à 96 points de données par canal cible.
- Taille
1 million de paramètres
- Essayez-le
- Longueur du contexte
Nombre minimum de points de données requis par canal dans la requête API :
- granite-ttm-512-96-r2: 512
- granite-ttm-1024-96-r2: 1 024
- granite-ttm-1536-96-r2: 1 536
- Langues naturelles prises en charge
Anglais
- Informations sur l'optimisation des instructions
Les Granite time series modèles ont été entraînés à partir de près d'un milliard d'échantillons de données de séries chronologiques issues de divers domaines, notamment l'électricité, le trafic routier, l'industrie manufacturière et bien d'autres encore.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite Vision 3.3 2b
Granite Vision 3.3 2b est un modèle de base compact et performant combinant vision et langage, conçu pour les cas d'utilisation en entreprise. Le modèle « granite-vision-3-3-2b » introduit de nouvelles fonctionnalités expérimentales telles que la segmentation d'images, la génération de balises doctag et la prise en charge des documents multipages. Ce modèle offre également une sécurité accrue par rapport aux modèles de vision « Granite » précédents.
- Utilisation
Le modèle de base « granite-vision-3-3-2b » est conçu pour la compréhension visuelle des documents; il permet l'extraction automatisée de contenu à partir de tableaux, de graphiques, d'infographies, de tracés, de schémas et bien plus encore.
- Taille
2 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 131 072
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois.
- Informations sur l'optimisation des instructions
Le modèle de base « granite-vision-3-3-2b » a été formé à partir d'un ensemble de données sélectionnées avec soin et axées sur le suivi d'instructions, composé de divers ensembles de données publics et d'ensembles de données synthétiques spécialement conçus pour prendre en charge un large éventail de tâches liées à la compréhension de documents et au traitement général d'images. Le modèle a été entraîné en affinant le modèle de base « granite-3-2b-instruct » à l'aide de données à la fois visuelles et textuelles.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :
Granite Vision 3.2 2b
Ce modèle est obsolète. Voir le cycle de vie des modèles de base.
Granite Vision 3.2 2b est un modèle de base « image-vers-texte » conçu pour les cas d'utilisation en entreprise. Ce modèle d' Granite e multimodale est capable de traiter des images et du texte pour des tâches telles que la compréhension de tableaux, de schémas, de graphiques et bien plus encore.
- Utilisation
Le modèle de base « granite-vision-3-2-2b » est conçu pour la compréhension visuelle des documents; il permet l'extraction automatisée de contenu à partir de tableaux, de graphiques, d'infographies, de tracés, de schémas et bien plus encore.
Remarque : il est recommandé d'utiliser le modèle « granite-vision-3-2-2b » uniquement avec des fichiers image destinés au traitement visuel et à la compréhension des cas d'utilisation.- Taille
2 milliards de paramètres
- Limites de jetons
Longueur de la fenêtre de contexte (entrée + sortie) : 131 072
Remarque : le nombre maximal de nouveaux jetons, c'est-à-dire les jetons générés par le modèle de base à chaque requête, est limité à 16 384.
- Langues naturelles prises en charge
anglais, allemand, espagnol, français, japonais, portugais, arabe, tchèque, italien, coréen, néerlandais et chinois
- Informations sur l'optimisation des instructions
Le modèle de base « granite-vision-3-2-2b » a été formé à partir d'un ensemble de données sélectionnées avec soin et axées sur le suivi d'instructions, composé de divers ensembles de données publics et d'ensembles de données synthétiques spécialement conçus pour prendre en charge un large éventail de tâches liées à la compréhension de documents et au traitement d'images en général. Il a été formé en affinant le modèle de base « granite-3-2b-instruct » à l'aide de données à la fois visuelles et textuelles.
- Architecture type
décodeur
- Licence
IBM - Les modèles de base développés sont considérés comme faisant partie du service IBM watsonx.ai. Pour plus d'informations sur les garanties contractuelles relatives à l'indemnisation d' IBM, consultez la section « Informations sur la licence ».
- En savoir plus
- Consultez les ressources suivantes :