IBMとRed Hatによって構築された安全でスケーラブルなオープン・プラットフォームを使用して、AIとハイブリッドクラウドのストラテジーを加速します。
スケーラブルに。AI対応。オープン。フレキシブル。
Red Hat AI on IBM Cloudは、ハイブリッドクラウド環境全体でAIおよび機械学習のワークロードを構築、トレーニング、カスタマイズ、デプロイするための一貫した安全な方法を提供します。このポートフォリオは、オープンソースのイノベーションとエンタープライズ・グレードのクラウド・インフラストラクチャーを組み合わせて、ITチームが運用の複雑さを軽減し、AI導入を加速できるよう支援します。このポートフォリオは、信頼性の高いAIインフラストラクチャーと、プロトタイプから本番環境への移行を迅速化する必要がある組織向けに設計されています。
独自のエンタープライズ・データでモデルをカスタマイズし、統合されたモデル・チューニング、圧縮、推論機能を使用して、本番環境で効率的に提供します。
リアルタイムおよびエージェント型アプリケーション向けの高性能でスケーラブルな推論を含むAIワークロードを、一貫したハイブリッドクラウド・プラットフォームにデプロイします。
GPUに最適化されたインフラストラクチャーと分散型推論ランタイムにより、トレーニングと推論を拡張し、多様なアクセラレーター間でスループットとコスト効率を最大化します。
モデル作成から本番環境での推論まで、環境全体にセキュリティー、ガバナンス、コンプライアンスを適用して、制御された信頼できるAIのオペレーションを実現します。
オープンかつハイブリッドなエンタープライズ・グレードのAIプラットフォーム。
Red Hat AI Inferenceは、ハイブリッドクラウド環境全体で生成AIモデルを実行するための一貫した高性能プラットフォームを提供します。Red Hat OpenShift AI上に構築され、vLLMとllm‑dを搭載することで、リアルタイムおよびエージェント型ワークロード向けの高速で予測可能、かつコスト効率の高い推論が可能になります。
主な機能
Red Hat AI Inferenceは、チーム、アプリケーション、環境全体で本番環境に対応した推論を実現するための、スケーラブルで管理された基盤を提供します。
OpenShift AI on IBM Cloudは、Red Hat OpenShiftを統合型のMLOpsおよび生成AIツールと統合します。ハイブリッドクラウド環境全体でAIワークロードを管理するための、一貫性のあるKubernetesベースのプラットフォームを提供します。
主な機能
AIのトレーニングと推論のために最適化されたインフラストラクチャー
エンドツーエンドのモデル・ライフサイクル管理のための統合パイプライン
インテリジェントな自動スケーリングを備えたGPU対応コンピューティング・オプション
エンタープライズ・グレードのセキュリティー、コンプライアンス、オブザーバビリティー
IBMとRed Hatが共同で提供する一元的なサポート
OpenShift AI は、AI の運用および本番環境へのデプロイメントのための信頼性が高く安全な基盤を提供します。
Red Hat Enterprise Linux AI(RHEL AI)は、クラウド、データセンター、エッジの各拠点でLLMを実行し、カスタマイズするための安定した環境を提供します。オープンソースのGranite® モデルファミリーとInstructLabツールが含まれており、チームはすぐに使用できるAI開発・デプロイメント環境を手に入れることができます。
主な機能
RHEL AIは、エンタープライズAIワークロードに安全で予測可能な基盤を提供します。
Red Hat AI InstructLab on IBM Cloudは、完全な再トレーニングを必要とせずに大規模な言語モデルをカスタマイズできるフルマネージド・サービスです。合成命令生成を使用して、新しい動作、スキル、ドメイン知識を追加し、GPUコストを削減してモデル開発を高速化します。
InstructLabの主な機能:
InstructLabは、ビジネス・ニーズとガバナンス要件に合ったAIモデルをより迅速に構築する方法を提供します。
Red Hat AI on IBM Cloudは、ハイブリッドクラウド全体でAIワークロードをパイロット環境から本番環境に移行するための、安全で一貫性のあるスケーラブルな基盤を提供します。
合理化されたツール、自動化されたワークフロー、すぐに実行できる高性能な推論により、パイロットから実稼働環境への移行を迅速化します。
オンプレミス環境とクラウド環境全体で統合されたエクスペリエンスを備え、サポートされている任意のアクセラレーターであらゆるモデルを実行できます。
組み込みのガバナンス、アクセス制御、監査可能性、安全な推論オペレーションにより、機密性の高いワークロードを保護します。
GPUに最適化されたコンピューティング、ストレージ、ネットワークは、大規模にトレーニングと推論に必要な性能を提供します。
高品質なデータ、検証済みモデル、堅牢な展開オプションがシステムの精度と意思決定の向上に寄与します。
インテリジェントなバッチ処理、モデル圧縮、効率的なアクセラレーター利用により、リソースの使用を最適化し、トークンあたりのコストを削減します。
セキュリティーとプライバシーの管理は、規制上のニーズをサポートするのに役立ちます。
インフラストラクチャーからモデル・ライフサイクルや本番推論までの完全なスタックにより、複雑さが軽減され、企業の導入が迅速化されます。