---
title: OmniAdvisor配置文件说明
description: "**表1 common_config.cfg文件配置项说明**"
url: https://www.hikunpeng.com/document/detail/zh/kunpengboostkithistory/2400/bds/kunpengbds_omniruntime_20_0529.html
sourcePath: /source/zh/kunpengboostkithistory/2400/bds/kunpengbds_omniruntime_20_0529.html
indexId: afc16100488595bf5ffe6dfbbd2e1a3e63c883d38fbceeafadeac101d79e22c978
---
# OmniAdvisor配置文件说明

#### common_config.cfg


**表1 common_config.cfg文件配置项说明**

| 模块名称 | 参数名称 | 缺省值 | 含义 |
| --- | --- | --- | --- |
| workload | workload\_name | tpcds\_bin\_partitioned\_decimal\_orc\_2 | 测试执行的数据库名称。 |
| workload | log\_analyzer\_path | /opt/OmniAdvisor/boostkit\-omniadvisor\-log\-analyzer\-1.1.0\-aarch64 | 日志解析模块解压存放的路径。 |
| workload | identification\_type | job\_hash | 指定任务运行的唯一标识；如果为“application\_name”，则通过匹配任务的名称的Hash值来匹配查找数据库中该任务的最佳参数；如果为默认值“job\_hash”，则匹配任务的query的Hash值（Spark或Hive的SQL任务）或者application\-jar的Hash值（Spark App任务）来匹配查找数据库中该任务的最佳参数。 |
| database | db\_name | test | MySQL的数据库名称，如果不存在会自动创建。 |
| database | db\_host | localhost | 连接MySQL的主机名。 |
| database | db\_port | 3306 | 连接MySQL的端口号。 |
| spark | log\_start\_time | \- | Spark运行日志的起始时间，可以从Hadoop UI上查看日期。 |
| spark | log\_end\_time | \- | Spark运行日志的终止时间。 |
| spark | spark\_default\_config | \-\-conf spark.sql.orc.impl=native \-\-conf spark.locality.wait=0 \-\-conf spark.sql.broadcastTimeout=300 | Spark默认参数，一般默认参数不参与参数采样过程。 |
| hive | log\_start\_time | \- | Tez运行日志的起始时间，可以从Hadoop UI上查看日期。 |
| hive | log\_end\_time | \- | Tez运行日志的终止时间。 |
| hive | hive\_default\_config | \-\-hiveconf hive.cbo.enable=true \-\-hiveconf tez.am.container.reuse.enabled=true \-\-hiveconf hive.merge.tezfiles=true | Hive默认参数，一般默认参数不参与参数采样过程。 |


#### omniAdvisorLogAnalyzer.properties


**表2 omniAdvisorLogAnalyzer.properties文件配置项说明**

| 配置模块 | 配置项 | 缺省值 | 含义 |
| --- | --- | --- | --- |
| log analyzer | log.analyzer.thread.count | 3 | 日志解析并发进程数，即同时分析的任务数。 |
| kerberos | kerberos.principal | \- | 安全模式下，用于kerberos认证的用户。 |
| kerberos | kerberos.keytab.file | \- | 安全模式下，用于kerberos认证的keytab文件路径。 |
| datasource | datasource.db.driver | com.mysql.cj.jdbc.Driver | 日志分析后，用于保存分析结果的数据库的Driver。 |
| datasource | datasource.db.url | \- | 日志分析后，用于保存分析结果的数据库的URL。 |
| spark fetcher | spark.enable | false | 是否启用Spark Fetcher。 |
| spark fetcher | spark.workload | default | Spark任务的DataBase。 |
| spark fetcher | spark.eventLogs.mode | \- | Spark Fetcher的模式，目前支持log以及rest两种模式。 |
| spark fetcher | spark.timeout.seconds | 30 | Spark Fetcher分析任务超时时间，单位：s。 |
| spark fetcher | spark.rest.url | http://localhost:18080 | Spark History Server的URL，仅用于rest模式。 |
| spark fetcher | spark.log.directory | \- | Spark日志存放目录，仅用于log模式。 |
| spark fetcher | spark.log.maxSize.mb | 500 | Spark分析日志文件的最大大小，单位：MB，超出该大小的日志文件将会被忽略，仅用于log模式。 |
| tez fetcher | tez.enable | false | Tez Fetcher是否开启。 |
| tez fetcher | tez.workload | default | Tez任务的DataBase。 |
| tez fetcher | tez.timeline.url | http://localhost:8188 | Timeline server的URL。 |
| tez fetcher | tez.timeline.timeout.ms | 6000 | Timeline server访问超时时间，单位：ms。 |


#### 数据库表


**表3 history_config和best_config表字段含义说明**

| 表名 | 字段名称 | 含义 |
| --- | --- | --- |
| history\_config | application\_id | 在Yarn上执行任务的application id。 |
| history\_config | application\_name | 在Yarn上执行任务的application name，一般也是同一个任务的标识。 |
| history\_config | application\_workload | 执行SQL任务使用的数据库名称，一般用\-\-database在参数中指定。 |
| history\_config | start\_time | 执行任务的开始时间。 |
| history\_config | finish\_time | 执行任务的结束时间。 |
| history\_config | duration\_time | 执行该任务的耗时，单位为：ms。 |
| history\_config | job\_type | 执行的任务类型，当前支持两种类型：Spark和Tez。 |
| history\_config | submit\_method | Spark提交任务的方法，“spark\-sql”代表采用该任务为spark\-sql提交的SQL任务，“spark\-submit”代表该任务为采用spark\-submit提交的Application任务。 |
| history\_config | deploy\_mode | Spark任务使用的部署模式，“client”代表该任务采用了Yarn的Client模式，“cluster”代表该任务采用了Yarn的Cluster模式。 |
| history\_config | submit\_cmd | Spark任务的提交命令。 |
| history\_config | parameters | 执行该任务使用的参数。 |
| history\_config | execution\_status | 执行任务的状态，0表示失败，1表示成功。 |
| history\_config | query | 执行任务的query语句（SQL任务）。 |
| history\_config | identification | 任务运行的唯一标识。 |
| best\_config | application\_id | 在Yarn上执行任务的application id。 |
| best\_config | application\_name | 在Yarn上执行任务的application name，一般也是同一个任务的标识。 |
| best\_config | application\_workload | 执行该任务使用的数据库名称，一般用\-\-database在参数中指定。 |
| best\_config | duration\_time | 执行该任务的耗时，单位：ms。 |
| best\_config | parameters | 执行该任务时使用的参数。 |
| best\_config | submit\_cmd | 提交该Spark任务的提交命令。 |
| best\_config | job\_type | 执行的任务类型，当前支持两种类型：Spark和Tez。 |
| best\_config | query\_hash | 对执行该任务的SQL进行SHA256计算，得到的Hash值。 |
