---
title: 简介
description: "鲲鹏BoostKit机器学习算法库兼容Spark开源版本API，对算法进行了性能优化，大幅提升了大数据算法场景的计算性能。本文用于指导用户安装并使能机器学习算法加速库特性。"
url: https://www.hikunpeng.com/document/detail/zh/kunpengbds/appAccelFeatures/algorithmaccelf_ml/kunpengbdssparkml_20_0002.html
sourcePath: /source/zh/kunpengbds/appAccelFeatures/algorithmaccelf_ml/kunpengbdssparkml_20_0002.html
indexId: 70e60537c5438f132a3b615ac81edcef26cefb318850ad130cd55dd07b86ffd188
---
# 简介

鲲鹏BoostKit机器学习算法库兼容Spark开源版本API，对算法进行了性能优化，大幅提升了大数据算法场景的计算性能。本文用于指导用户安装并使能机器学习算法加速库特性。

- 您同意在使用鲲鹏BoostKit机器学习算法加速库时，遵守国家法律法规、社会公共道德。您不得利用机器学习算法加速库从事任何违法、侵犯他人权益等扰乱社会秩序、破坏社会稳定的行为，亦不得利用机器学习算法加速库从事任何危害或试图危害计算机系统及网络安全的活动。

- 您知悉并确认，对于依赖机器学习算法加速库处理结果所作出的判断需您自行承担相关风险。机器学习算法加速库按现状提供，在适用法律允许的范围内，华为对机器学习算法加速库不作任何类型的担保，不论是明示的或暗示的，包括但不限于其真实性、适用性、非侵权性和安全性。
- 您同意华为不应对间接、附带、特殊或任何形式的惩罚性赔偿承担任何责任，也不应对任何利润、收入、数据、数据使用的损失承担任何责任。
- 您应知悉并同意，对于使用鲲鹏BoostKit机器学习算法加速库软件包而依赖的开源及第三方软件，需要您自行下载集成，华为不对该部分的软件漏洞和安全问题承担任何责任。


Apache Spark是用于大规模数据处理的统一分析引擎，具有可伸缩、基于内存计算等特点，已经成为轻量级大数据快速处理的统一平台，各种不同的应用，如实时流处理、机器学习、交互式查询等，都可以通过Spark建立在不同的存储和运行系统上。更多关于Spark信息请参见官网Spark官方文档(https://spark.apache.org/)。

鲲鹏BoostKit 机器学习算法加速库 （以下简称为机器学习算法加速库/机器学习算法库）是经过优化的算法库，兼容Spark开源版本API，对机器学习算法进行了性能优化，大幅提升了大数据算法场景的计算性能，该库支持鲲鹏处理器的体系架构，目前提供的机器学习算法如下：

- SVM（Support Vector Machines，支持向量机）
- DBSCAN（Density-Based Spatial Clustering of Applications with Noise，具有噪声的基于密度的聚类方法）
- DTB（Decision Tree Bucket，决策树分箱）
- Word2Vec（词向量）
