- Runs analytical queries in parallel across many machines
- Scales to query datasets far larger than one server could handle
- Often queries data in place across multiple sources
- Delivers interactive performance on big data
It breaks a query into tasks executed in parallel across many nodes, then combines their partial results.
Engines like Trino, Presto, and Spark SQL distribute query processing across clusters.
They scale to data volumes and query complexity that exceed what a single machine can process in acceptable time.
Hello popup window