---
title: 介绍
description: "Apache Spark是用于大规模数据处理的统一分析引擎，具有可伸缩、基于内存计算等特点，已经成为轻量级大数据快速处理的统一平台，各种不同的应用，如实时流处理、机器学习、交互式查询等，都可以通过Spark建立在不同的存储和运行系统上。更多关于Spark信息请参见官网Spark官方文档(https://spark.apache.org/)。"
url: https://www.hikunpeng.com/document/detail/zh/kunpengbds/appAccelFeatures/algorithmaccelf_ml/kunpengbdssparkml_16_0001.html
sourcePath: /source/zh/kunpengbds/appAccelFeatures/algorithmaccelf_ml/kunpengbdssparkml_16_0001.html
indexId: b7b6a2b56e898d16f52595d90c480f8f4a432b88918de5d17b6b73b167592c1188
---
# 介绍

Apache Spark是用于大规模数据处理的统一分析引擎，具有可伸缩、基于内存计算等特点，已经成为轻量级大数据快速处理的统一平台，各种不同的应用，如实时流处理、机器学习、交互式查询等，都可以通过Spark建立在不同的存储和运行系统上。更多关于Spark信息请参见官网Spark官方文档(https://spark.apache.org/)。

鲲鹏BoostKit 机器学习算法加速库 （以下简称为机器学习算法加速库/机器学习算法库）是经过优化的算法库，兼容Spark开源版本API，对机器学习算法进行了性能优化，大幅提升了大数据算法场景的计算性能，该库支持鲲鹏处理器的体系架构。
