Erste Schritte mit Spark-Anwendungen

Sie können Spark-Anwendungen auf einer Instanz von „ Analytics Engine powered by Apache Spark “ ausführen.

So fangen Sie mit Spark-Anwendungen an:

  1. Eine Instanz von „ Analytics Engine powered by Apache Spark “ bereitstellen. Sie benötigen die Rolle Administrator im Projekt oder im Bereitstellungsbereich, um eine Instanz bereitzustellen. Siehe „Bereitstellung einer Instanz “.
  2. Die Instanz verwalten. Sie benötigen die Rolle Administrator im Projekt, um das Ressourcenkontingent und den Benutzerzugriff zu verwalten.
    • Passen Sie die Ressourcenquote für die Instanz so an, dass sie den Anforderungen der Spark-Jobs entspricht, die auf der Instanz ausgeführt werden sollen. Siehe „Ändern der Ressourcenkontingente für Instanzen “.
    • Weisen Sie den Benutzern die Entwicklerrolle für die Instanz zu, damit sie Spark-Jobs einreichen können. Siehe „Benutzerzugriff verwalten “.
  3. Erstellen Sie ein Zugriffstoken, um die Spark-Jobs-API zu nutzen. Siehe API-Berechtigungstoken generieren.
  4. Wählen Sie aus, wie die Jobdateien Ihrer Spark-Anwendung gespeichert werden sollen. Siehe „Persistente Spark-Anwendungen “.
  5. Führen Sie Ihren Spark-Anwendungsjob aus. Siehe „Spark-Jobs einreichen “.
  6. Den Auftragsstatus anzeigen. Siehe „Anzeigen des Spark-Jobstatus “.
  7. Jobprotokolle anzeigen. Siehe „Zugriff auf die Protokolle des Spark-Job-Drivers “.
  8. Sie können Spark-Anwendungen auch interaktiv ausführen. Siehe Spark-Anwendungen interaktiv ausführen.
  9. Debuggen Sie Ihre Anwendungen mithilfe des Spark-History-Servers. Siehe „Zugriff auf den Spark-History-Server “.
  10. Greifen Sie in Ihrer Spark-Anwendung mithilfe der „ IBM Cloud Pak for Data “-Volume-API auf Daten aus Speichervolumes zu. Siehe „Zugriff auf Daten aus dem Speicher “.