An open-source engine for fast, distributed processing of large-scale data.
Formally Apache Spark. By processing data in memory wherever possible, it achieves major speedups over the older Hadoop MapReduce. It handles everything from batch and stream processing to machine learning.
© 2026 ITBGM