Erste Schritte mit Spark-Anwendungen
Sie können Spark-Anwendungen auf einer Instanz von „ Analytics Engine powered by Apache Spark “ ausführen.
So fangen Sie mit Spark-Anwendungen an:
- Eine Instanz von „ Analytics Engine powered by Apache Spark “ bereitstellen. Sie benötigen die Rolle Administrator im Projekt oder im Bereitstellungsbereich, um eine Instanz bereitzustellen. Siehe „Bereitstellung einer Instanz “.
- Die Instanz verwalten. Sie benötigen die Rolle Administrator im Projekt, um das Ressourcenkontingent und den Benutzerzugriff zu verwalten.
- Passen Sie die Ressourcenquote für die Instanz so an, dass sie den Anforderungen der Spark-Jobs entspricht, die auf der Instanz ausgeführt werden sollen. Siehe „Ändern der Ressourcenkontingente für Instanzen “.
- Weisen Sie den Benutzern die Entwicklerrolle für die Instanz zu, damit sie Spark-Jobs einreichen können. Siehe „Benutzerzugriff verwalten “.
- Erstellen Sie ein Zugriffstoken, um die Spark-Jobs-API zu nutzen. Siehe API-Berechtigungstoken generieren.
- Wählen Sie aus, wie die Jobdateien Ihrer Spark-Anwendung gespeichert werden sollen. Siehe „Persistente Spark-Anwendungen “.
- Führen Sie Ihren Spark-Anwendungsjob aus. Siehe „Spark-Jobs einreichen “.
- API-Konfigurationen für Jobs verwalten. Siehe Syntax der Spark-Jobs-API und Jobparameter.
- Überprüfen Sie die unterstützten Sprachen und Spark-Versionen. Siehe Spark-Anwendungstypen.
- Den Auftragsstatus anzeigen. Siehe „Anzeigen des Spark-Jobstatus “.
- Jobprotokolle anzeigen. Siehe „Zugriff auf die Protokolle des Spark-Job-Drivers “.
- Sie können Spark-Anwendungen auch interaktiv ausführen. Siehe Spark-Anwendungen interaktiv ausführen.
- Debuggen Sie Ihre Anwendungen mithilfe des Spark-History-Servers. Siehe „Zugriff auf den Spark-History-Server “.
- Greifen Sie in Ihrer Spark-Anwendung mithilfe der „ IBM Cloud Pak for Data “-Volume-API auf Daten aus Speichervolumes zu. Siehe „Zugriff auf Daten aus dem Speicher “.