Visão geral do Cloud Pak for Data as a Service

O Cloud Pak for Data as a Service é uma plataforma de serviço em nuvem para toda a sua governança de dados, engenharia de dados, análise de dados e tarefas de ciclo de vida de IA. O Cloud Pak for Data as a Service implementa uma solução de malha de dados para que você possa fornecer acesso instantâneo e seguro a dados confiáveis para sua organização, automatizar processos e a conformidade e entregar IA confiável em seus aplicativos.

O Cloud Pak for Data as a Service é uma plataforma de serviço de nuvem totalmente gerenciada com os benefícios a seguir:

  • Nenhuma instalação, gerenciamento ou atualização de software ou hardware
  • Aumento e redução simples de capacidade
  • Seguro e compatível
  • Arquitetura de serviços combinável
  • Faturamento mensal baseado em assinatura ou consumo

Assista a este vídeo para ver uma visão geral do Cloud Pak for Data as a Service

Este vídeo fornece um método visual para aprender os conceitos e tarefas nesta documentação.


A solução de malha de dados do Cloud Pak for Data as a Service

Uma arquitetura de malha de dados permite que sua empresa desbloqueie o valor de seus dados em uma paisagem de dados multicloud híbrida. Mudar para uma arquitetura de malha de dados transforma a maneira como sua empresa se integra, governa e usa dados para análise, ciência de dados, dados principais do cliente e conformidade.

Com um tecido de dados, você pode ter uma maneira segura e consistente de acessar dados de fontes díspares. É possível eliminar processos de acesso e integração de dados ineficientes, repetitivos e manuais. Uma arquitetura de malha de dados estabelece a lacuna entre as fontes e fornece dados prontos para o negócio para suportar as necessidades de sua empresa. Você pode trabalhar com dados de vários tipos de fontes através de uma paisagem híbrida e multicloud, enquanto você mantém esses dados seguros e confiáveis com a amplitude total das capacidades integradas de gerenciamento de dados.

Imagem mostrando um tecido de dados com várias fontes de dados

Seus engenheiros de dados precisam de ferramentas para preparar, transformar e virtualizar dados. Seus analistas de qualidade de dados precisam de ferramentas para medir a qualidade dos dados. Sua equipe de governança precisa de ferramentas para controlar, proteger e enriquecer seus dados. Seus consumidores de dados, como analistas de negócios e cientistas de dados, precisam de ferramentas para desenvolver, de forma colaborativa, insights e modelos. Com a plataforma Cloud Pak for Data de ferramentas integradas, sua organização pode trabalhar eficientemente em conjunto para usar seus dados para melhorar o seu negócio.

Uma arquitetura de malha de dados implementa gerenciamento de metadados ativo, que usa aprendizado de máquina para automatizar o processamento de metadados. Os resultados da análise de metadados facilitam a descoberta automatizada de dados, aumentam a confiança nos dados e permitem a proteção de dados e o controle de dados em escala.

Para obter mais informações sobre a solução de malha de dados, consulte Casos de uso Para experimentar implementar o tecido de dados, leve os tutoriais de malha de dados.

Serviços e arquitetura de plataforma

Inclua recursos e ferramentas no Cloud Pak for Data as a Service por serviços de fornecimento. Um conjunto de serviços principais é integrado à plataforma comum. Outros serviços associados trabalham com a plataforma, mas são executados fora dela. Dependendo de como você se inscrever para Cloud Pak for Data como um Service, você pode começar com um subconjunto dos principais serviços que representam um caso de uso de solução de malha de dados único.

Arquitetura de serviços

Você pode fornecer esses tipos de serviços a partir do catálogo de serviços do Cloud Pak for Data as a Service:

  • Serviços principais
    Os serviços principais são perfeitamente integrados e incluem ferramentas, áreas de trabalho ou energia de cálculo na IU da plataforma:

    • watsonx.ai Studio para análise de dados
    • tempo de execução watsonx.ai para criar e implantar modelos
    • Watson OpenScale para avaliação de modelos
    • IBM watsonx.data intelligence para controlar e catalogar dados e outros ativos
    • DataStage para integração de dados
    • Data Virtualization para virtualização e consulta de dados
    • Master Data Management para criar dados mestre
    • Data Replication para replicar dados
  • Serviços associados
    IBM Cloud que podem ser usados para acessar dados de dentro da plataforma, mas armazenar e gerenciar os dados fora da plataforma.

    Serviços Watson que têm suas próprias UIs ou fornecem APIs para analisar dados.

Espaços de trabalho e ativos

Cloud Pak for Data as a Service é organizado como um conjunto de espaços de trabalho colaborativos onde você pode trabalhar com sua equipe ou organização. Cada área de trabalho possui um conjunto de membros com funções que fornecem permissões para executar ações. A maioria dos usuários trabalha com ativos, que são os itens incluídos pelos usuários na plataforma. Os ativos de dados contêm metadados que representam dados, enquanto os ativos criados em ferramentas, como pipelines e modelos de dados, executam código para trabalhar com dados. O diagrama a seguir mostra as principais áreas de trabalho, seus propósitos e como os ativos e outros itens se movimentam pela plataforma.

Os principais espaços de trabalho são projetos, catálogos, espaços de implantação e categorias. Os ativos se movimentam entre projetos, espaços de implementação e catálogos. Os artefatos de governança são criados em categorias e são adicionados como metadados para ativos em catálogos.

Projetos

Os projetos são onde suas equipes de ciência de dados, engenharia de dados ou curadoria de dados trabalham com dados para criar ativos, como notebooks, modelos, pipelines de dados ou ativos de dados enriquecidos. As ferramentas de projeto são fornecidas pela maioria dos serviços principais:

  • watsonx.ai O Studio oferece as ferramentas Data Refinery, Jupyter, editor de notebooks, SPSS Modeler, Decision Optimization, Pipelines e RStudio
  • IBM watsonx.data intelligence fornece as ferramentas Data Refinery, Metadata import, enriquecimento de metadados e fluxos de mascaramento
  • O DataStage fornece o editor de pipelines de dados do DataStage
  • Data Replication fornece a ferramenta Data Replication
  • Master Data Management fornece a ferramenta de configuração de dados mestres

A imagem a seguir mostra como é a aparência da página Visão geral de um projeto.

Um projeto contém ativos e colaboradores.

Catálogos

Os catálogos são onde sua organização encontra e armazena dados de alta qualidade, confiáveis e outros ativos, como fichas técnicas de modelos. É possível localizar ativos de dados em um catálogo e movê-los para um projeto para trabalhar com os dados. Ou é possível curar dados em projetos e publicar os ativos de dados de alta qualidade em um catálogo para outros utilizarem. Os catálogos exigem o serviço IBM watsonx.data intelligence.

A imagem a seguir mostra como é a aparência da página Ativos de um catálogo.

Um catálogo contém uma visão de ativos.

Espaços de implementação

Espaços de implementação são onde sua equipe do ModelOps implementa modelos e outros ativos implementáveis para produção e, em seguida, testa e gerencia implementações na produção. Após construir modelos e ativos implementáveis em projetos, você os promove para espaços de implementação.

A imagem a seguir mostra como é a aparência da página Visão geral de um espaço de implementação.

Um espaço de implementação contém ativos e colaboradores.

Categorias

As categorias são onde sua equipe de governança cria e gerencia artefatos de governança que enriquecem ativos de dados nos catálogos. As categorias exigem o serviço IBM watsonx.data intelligence.

A imagem a seguir mostra como é a aparência dos resultados da procura.

Uma categoria contém artefatos de governança.

Outras áreas de trabalho

Você pode criar ativos de dados especializados em outras áreas de trabalho e movê-los para projetos e catálogos:

  • O serviço Data Virtualization oferece um espaço de trabalho para virtualizar ativos de dados em várias fontes de dados.
  • O serviço Match360 fornece uma área de trabalho para configurar e explorar uma visualização em 360 graus dos dados do cliente.

O hub de recursos

A plataforma inclui um hub de Recursos integrado que fornece ativos de dados de amostra, blocos de notas e projetos Os blocos de notas de amostra fornecem exemplos de ciência de dados e código de aprendizado de máquina. Os projetos de amostra, incluindo aceleradores da indústria, contêm conjuntos de dados, modelos, outros ativos e instruções detalhadas sobre como resolver um determinado problema de negócios. O hub de Recursos também fornece Knowledge Accelerators, que contêm conjuntos de artefatos de controle que podem ser importados para fornecer vocabulários de negócios para segmentos de mercado específicos.

A imagem a seguir mostra a aparência do hub de Recursos.

O hub de Recurso contém amostras

Assista a este vídeo para ver um tour do hub de Recursos

Este vídeo fornece um método visual para aprender os conceitos e tarefas nesta documentação.

Saiba Mais