# File location and type file_location = "/FileStore/tables/household_power_consumption.csv" file_type = "csv" # CSV options schema = "Date STRING, Time STRING, Global_active_power DOUBLE, Global_reactive_power DOUBLE, Voltage DOUBLE, Global_intensity DOUBLE, Sub_metering_1 DOUBLE, Sub_metering_2 DOUBLE, Sub_metering_3 DOUBLE" first_row_as_header = "true" delimiter = ";" # Read CSV files org_df = spark.read.format(file_type) .schema(schema) .option("header", first_row_as_header) .option("delimiter", delimiter) .load(file_location) display(org_df)