Daten zu Data Refinery hinzufügen

Nachdem Sie ein Projekt erstellt und Verbindungen eingerichtet oder Datenbestände zum Projekt hinzugefügt haben, können Sie Daten zu „ Data Refinery “ hinzufügen und mit der Aufbereitung dieser Daten für die Analyse beginnen.

Zum Hinzufügen von Daten *zu Data Refinery steht Ihnen eine der folgenden Vorgehensweisen zur Verfügung:

  • Wählen Sie Daten vorbereiten im Symbol Überlauf Überlaufmenü eines Datenassets in der Liste Alle Assets für das Projekt aus.
  • Vorschau eines Datenassets im Projekt anzeigen und anschließend auf Daten vorbereiten klicken
  • Sie navigieren zuerst zu Data Refinery und fügen dann Daten hinzu.

Wenn in Ihrem Projekt Ordner aktiviert sind, können Sie beim Hinzufügen von Daten zu „ Data Refinery “ Datenelemente aus jedem beliebigen Ordner auswählen. Die Ordnerstruktur wird im Asset-Browser angezeigt, damit Sie Ihre Daten leichter finden können.

  1. Greifen Sie aus einem Projekt heraus auf Data Refinery zu. Klicken Sie auf die Registerkarte Assets.

  2. Klicken Sie auf Neues Asset > Daten vorbereiten und visualisieren.

    • Klicken Sie auf Vom lokalen Standort aus durchsuchen , um ein neues Datenasset hochzuladen.
    • Klicken Sie auf Aus Projekt auswählen , um ein zuvor hochgeladenes Datenasset oder eine Verbindung auszuwählen.

    Datenasset:

    • Wählen Sie eine Datendatei aus (die Auswahl umfasst auch Datendateien, die bereits mit „ Data Refinery “ aufbereitet wurden)
    • Wählen Sie eine verbundene Datenquelle aus

    Verbindung:

    • Wählen Sie eine Verbindung und eine Datei aus.
    • Wählen Sie eine Verbindung, einen Ordner und eine Datei aus.
    • Wählen Sie eine Verbindung, ein Schema sowie eine Tabelle oder eine Ansicht aus.

    Data Refinery unterstützt folgende Dateiformate: Avro, CSV, textbasierte Dateien mit Trennzeichen, JSON, Microsoft Excel (xls- und xlsx-Formate). Nur erstes Arbeitsblatt, mit Ausnahme von Verbindungen und verbundenen Datenassets. Parquet, SAS mit der Erweiterung „ sas7bdat “ (schreibgeschützt), TSV (schreibgeschützt)

    Jede. Data Refinery arbeitet mit einem Beispielsubset von Zeilen des Datasets. Die Datenmenge beträgt 1 MB oder 10.000 Zeilen, je nachdem, was zuerst eintritt. Wenn Sie jedoch einen Job für den „ Data Refinery “-Ablauf ausführen, wird der gesamte Datensatz verarbeitet. Wenn der Data Refinery -Ablauf mit einem großen Datenasset fehlschlägt, finden Sie weitere Informationen unter Fehlerbehebung für Data Refinery.

    Datenverbindungen, die mit einem Schlüsselsymbol (Schlüsselsymbol für private Verbindungen) gekennzeichnet sind, sind gesperrt. Wenn Sie zum Zugriff auf die Datenquelle berechtigt sind, werden Sie beim ersten Aufruf aufgefordert, Ihre persönlichen Anmeldedaten einzugeben. Mit diesem einmaligen Schritt wird die Verbindung dauerhaft für Sie freigeschaltet. Nachdem Sie die Verbindung entsperrt haben, wird das Schlüsselsymbol nicht mehr angezeigt. Siehe „Verbindungen zu Projekten hinzufügen “.

  3. Geben Sie einen Namen und optional eine Beschreibung ein.

  4. Klicken Sie auf Erstellen , um die Daten in Data Refineryzu laden.

Weitere Schritte