How do we configure trigger(processingTime='10 seconds') to control micro-batch execution intervals?
trigger() controls the frequency at which micro-batches are planned, processed, and committed.
Balancing latency SLAs against cluster resource consumption in continuous data pipelines.
query = streaming_df.writeStream \
.format("parquet") \
.trigger(processingTime="10 seconds") \
.option("checkpointLocation", "checkpoints/orders") \
.option("path", "lakehouse/silver_orders") \
.start()Practice typing production-grade PySpark code for Controlling Micro-Batch Timing with trigger().