How can we compute statistical summary metrics (count, mean, stddev, min, max) for numeric columns?
describe() computes fundamental summary statistics including count, mean, standard deviation, min, and max.
Exploratory data analysis, detecting anomalous outliers in financial data, and data profiling.
df.describe(["salary"]).show()Practice typing production-grade PySpark code for Summary Statistics with describe().