Accélérez votre stratégie en matière d’IA et de cloud hybride grâce à une plateforme sécurisée, évolutive et ouverte, mise au point par IBM et Red Hat.
Évolutive. Adapté à l’IA. Ouverte. Flexible.
Red Hat AI on IBM Cloud offre un moyen cohérent et sécurisé de créer, d’entraîner, de personnaliser et de déployer des workloads d’IA et de machine learning dans des environnements de cloud hybride. Ce portefeuille combine l’innovation open source avec une infrastructure cloud dédiée aux entreprises, permettant aux équipes informatiques de réduire la complexité opérationnelle et d’accélérer l’adoption de l’IA. Cette offre s’adresse aux entreprises qui ont besoin d’une infrastructure d’IA fiable et souhaitent passer plus rapidement du prototype à la production.
Personnalisez les modèles avec vos propres données d’entreprise, puis exploitez-les efficacement en production grâce à des fonctionnalités intégrées d’ajustement, de compression et d’inférence des modèles.
Déployez des workloads d’IA sur une plateforme cloud hybride cohérente, y compris une inférence haute performance et évolutive pour les applications en temps réel et agentiques.
Faites évoluer l’entraînement et l’inférence grâce à une infrastructure optimisée pour les GPU et à des environnements d’exécution d’inférence distribués qui maximisent le débit et la rentabilité sur différents accélérateurs.
Appliquez la sécurité, la gouvernance et la conformité dans tous les environnements, de la création des modèles à l’inférence en production, afin de garantir des opérations d’IA contrôlées et dignes de confiance.
Une plateforme d’IA ouverte, hybride et dédiée aux entreprises.
Red Hat AI Inference offre une plateforme cohérente et haute performance pour exécuter des modèles d’IA générative dans des environnements cloud hybrides. Basée sur Red Hat OpenShift AI et optimisée par vLLM et llm-d, elle permet une inférence rapide, prévisible et économique pour les workloads en temps réel et agentiques.
Principales fonctionnalités
Red Hat AI Inference fournit une base évolutive et gouvernée permettant de déployer une inférence prête pour la production à travers les équipes, les applications et les environnements.
OpenShift AI on IBM Cloud associe Red Hat OpenShift à des outils MLOps et d’IA générative intégrés. Vous bénéficiez ainsi d’une plateforme cohérente basée sur Kubernetes pour gérer les workloads d’IA dans des environnements de cloud hybride.
Principales caractéristiques :
Une infrastructure optimisée pour l’entraînement et l’inférence en matière d’IA
Des pipelines intégrés pour la gestion de bout en bout du cycle de vie des modèles
Des options de calcul adaptées aux GPU avec mise à l’échelle automatique intelligente
Un support unifié assuré conjointement par IBM et Red Hat
OpenShift AI offre une base fiable et sécurisée pour les opérations d’IA et le déploiement en production.
Red Hat Enterprise Linux AI (RHEL AI) offre un environnement stable pour exécuter et personnaliser les LLM dans le cloud, les centres de données et les emplacements en périphérie (edge). Cette solution inclut la famille de modèles open source Granite et les outils InstructLab, offrant ainsi aux équipes un environnement de développement et de déploiement d’IA prêt à l’emploi.
Principales caractéristiques :
RHEL AI fournit une base sécurisée et prévisible pour les workloads d’IA d’entreprise.
Red Hat AI InstructLab on IBM Cloud est un service entièrement géré qui vous permet de personnaliser des grands modèles de langage sans nécessiter de réentraînement complet. La solution utilise la génération d’instructions synthétiques pour ajouter de nouveaux comportements, compétences et connaissances spécialisées, contribuant ainsi à réduire les coûts liés aux GPU et à accélérer le développement des modèles.
Principales caractéristiques d’InstructLab :
InstructLab offre un moyen plus rapide de créer des modèles d’IA adaptés à vos besoins métier et à vos exigences de gouvernance.
Red Hat AI on IBM Cloud offre une base sécurisée, cohérente et évolutive pour faire passer les workloads d’IA de la phase pilote à la production dans vos environnements de cloud hybride.
Passez plus rapidement du projet pilote à la production grâce à des outils rationalisés, des workflows automatisés et une inférence haute performance prête à l’emploi.
Exécutez n’importe quel modèle sur n’importe quel accélérateur pris en charge avec une expérience unifiée dans les environnements sur site et cloud.
Protégez les workloads sensibles grâce à une gouvernance intégrée, des contrôles d’accès, des capacités d’audit et des opérations d’inférence sécurisées.
Des capacités de calcul, de stockage et de mise en réseau optimisées pour les GPU offrent les performances nécessaires à l’entraînement et à l’inférence à l’échelle.
Des données de haute qualité, des modèles validés et des options de déploiement robustes contribuent à améliorer la précision du système et la prise de décision.
Optimisez l’utilisation des ressources et réduisez le coût par token grâce à un batch intelligent, à la compression des modèles et à une utilisation efficace des accélérateurs.
Les contrôles de sécurité et de confidentialité facilitent la mise en conformité avec les exigences réglementaires.
Une pile complète, de l’infrastructure au cycle de vie des modèles et à l’inférence de production, réduit la complexité et accélère l’adoption par les entreprises.