What you can do
- Submit a job to a Dataproc cluster (pyspark, spark, hive, spark-sql, pig, or presto), optionally waiting for completion
- List all Dataproc clusters in a project and region
Prerequisites
GCP_SERVICE_ACCOUNT_KEY_FILE: path to a GCP service account JSON key file with permissions to submit Dataproc jobs and list clustersGCP_PROJECT_ID: your GCP project IDGCP_LOCATION: GCP region (e.g. ‘us-central1’)