How do we normalize customer email addresses to lowercase to prevent case-sensitive duplicates?
lower() converts all alphabetic characters in a string Column to lowercase.
Email address deduplication, username normalization, and search query tokenization.
from pyspark.sql.functions import col, lower
df = df.withColumn("clean_email", lower(col("email")))Practice typing production-grade PySpark code for Lowercase Conversion with lower().