IBM과 Red Hat이 구축한 안전하고 확장가능한 개방형 플랫폼에서 AI 및 하이브리드 클라우드 전략을 가속화하세요.
확장성. AI 지원. 개방성. 유연성.
Red Hat AI on IBM Cloud는 하이브리드 클라우드 환경에서 AI 및 머신 러닝 워크로드를 구축, 학습, 맞춤 설정, 배포하는 일관되고 안전한 방법을 제공합니다. 오픈 소스 혁신과 엔터프라이즈급 클라우드 인프라를 결합해서 IT 팀이 운영 복잡성을 줄이고 AI 도입을 가속화하도록 지원하는 포트폴리오를 구성했습니다. 이 포트폴리오는 신뢰할 수 있는 AI 인프라가 필요하고, 프로토타입에서 생산으로 더 빠르게 넘어가야 하는 조직을 위해 설계되었습니다.
자체 기업 데이터를 사용해 모델을 사용자 지정한 후, 통합된 모델 튜닝, 압축 및 추론 기능을 활용해 운영 환경에서 효율적으로 제공하세요.
실시간 및 에이전틱 애플리케이션을 위한 고성능의 확장 가능한 추론 기능을 포함한 일관된 하이브리드 클라우드 플랫폼에 AI 워크로드를 배포하세요.
다양한 가속기 전반에서 처리량과 비용 효율성을 극대화하는 GPU 최적화 인프라와 분산 추론 런타임을 통해 학습과 추론을 확장하세요.
모델 생성부터 운영 환경 추론까지 환경 전반에 걸쳐 보안, 거버넌스 및 컴플라이언스를 적용하여 통제 가능하고 신뢰할 수 있는 AI 운영을 보장하세요.
하나의 개방형 하이브리드 엔터프라이즈급 AI 플랫폼으로
Red Hat AI Inference는 하이브리드 클라우드 환경 전반에서 생성형 AI 모델을 실행하기 위한 일관된 고성능 플랫폼을 제공합니다. Red Hat OpenShift AI를 기반으로 구축되고 vLLM 및 llm-d로 구동되며, 실시간 및 에이전틱 워크로드를 위한 빠르고 예측 가능하며 비용 효율적인 추론을 지원합니다.
주요 기능
Red Hat AI Inference는 팀, 애플리케이션 및 환경 전반에 걸쳐 운영 환경에 적합한 추론을 제공하기 위한 확장 가능하고 거버넌스가 적용된 기반을 제공합니다.
IBM Cloud의 OpenShift AI는 Red Hat OpenShift, 통합형 MLOps 및 생성형 AI 툴을 함께 제공합니다. 하이브리드 클라우드 환경 전반에서 AI 워크로드를 관리할 수 있도록 일관된 Kubernetes 기반 플랫폼을 이용하세요.
주요 기능:
AI 학습과 추론에 최적화된 인프라
엔드투엔드 모델 라이프사이클 관리를 위한 통합형 파이프라인
엔터프라이즈급 보안, 규정 준수 및 관측 가능성
IBM과 Red Hat이 공동으로 제공하는 통합 지원
OpenShift AI는 AI 운영과 프로덕션 배포를 위해 안전하고 신뢰할 수 있는 기반을 제공합니다.
Red Hat Enterprise Linux AI(RHEL AI)는 클라우드, 데이터 센터, 엣지 위치 전반에서 LLM을 실행하고 맞춤 설정할 수 있는 안정적인 환경을 제공합니다. 오픈 소스 Granite 모델 제품군과 InstructLab 도구도 함께 제공해서 팀이 AI 개발 및 배포 환경을 즉시 이용할 수 있습니다.
주요 기능:
RHEL AI는 엔터프라이즈 AI 워크로드를 위해 안전하고 예측 가능한 기반을 제공합니다.
Red Hat AI InstructLab on IBM Cloud는 대대적인 재학습 없이도 대규모 언어 모델을 맞춤 설정할 수 있는 완전 관리형 서비스입니다. 합성 명령어 생성을 사용하여 새로운 동작, 기술, 도메인 지식을 추가하기 때문에 GPU 비용을 절감하고 모델 개발 속도를 높이는 데 도움이 됩니다.
InstructLab 주요 기능:
InstructLab은 비즈니스 요건과 거버넌스 요건에 맞는 AI 모델을 더 빠르게 구축하는 길을 제공합니다.
Red Hat AI on IBM Cloud는 하이브리드 클라우드 전반에서, 파일럿으로 출발한 AI 워크로드를 프로덕션으로 이동시키는 안전하고 일관되며 확장가능한 기반을 제공합니다.
간소화된 툴, 자동화된 워크플로 및 즉시 실행 가능한 고성능 추론을 통해 시범 운영에서 운영 환경으로 더 빠르게 전환하세요.
온프레미스 및 클라우드 환경 전반에서 일관된 경험을 제공하며, 지원되는 모든 가속기에서 모든 모델을 실행할 수 있습니다.
내장된 거버넌스, 액세스 제어, 감사 가능성 및 안전한 추론 운영을 통해 민감한 워크로드를 보호하세요.
GPU에 최적화된 컴퓨팅과 스토리지, 네트워킹이 대규모 학습과 추론에 필요한 성능을 제공합니다.
고품질 데이터와 검증된 모델, 강력한 배포 옵션은 시스템 정확도와 의사 결정을 개선하는 데 도움이 됩니다.
지능형 배치 처리, 모델 압축 및 효율적인 가속기 활용을 통해 리소스 사용을 최적화하고 토큰당 비용을 절감하세요.
보안과 개인정보 보호 제어는 규제 요건 충족에 도움이 됩니다.
인프라부터 모델 라이프사이클 및 운영 환경 추론에 이르는 완전한 스택을 통해 복잡성을 줄이고 기업 도입을 가속화할 수 있습니다.