Apache Spark
Unified compute-engine för stor data — Matei Zaharia (UC Berkeley AMPLab) 2009, donerat till ASF 2013. Mycket snabbare än MapReduce genom in-memory caching och DAG-execution.
Fyra delar: Spark SQL (DataFrames + Catalyst optimizer), Structured Streaming (micro-batch streams), MLlib (machine learning), GraphX (graphs). Skriven i Scala, första-klass-API:er i Python (PySpark), R, Java.
Kommersialiserad av Databricks. Konkurrenter: Trino (interaktivt SQL), Flink (stream-first), Snowflake (managed SQL warehouse), DuckDB (single-node). Spark dominerar fortfarande "industriell big data".