Apache Spark 是一个分布式数据处理引擎,适用于大规模批处理和流处理工作负载。它基于内存跨集群处理数据,因此在许多工作负载下比 MapReduce 快得多。Spark 支持 Python、Scala、Java 和 R,并提供用于 SQL、流处理、机器学习和图处理的 API。
登录查看节点详情
首阶段节点可试读;登录后解锁全部路线图节点正文与进度同步。