Hive常见属性配置
1 Hive数据仓库位置配置
1)Default 数据仓库的最原始位置是在 hdfs 上的:/user/hive/warehouse 路径下。
2)在仓库目录下,没有对默认的数据库 default 创建文件夹。如果某张表属于 default
数据库,直接在数据仓库目录下创建一个文件夹。
3)修改 default 数据仓库原始位置(将 hive-default.xml.template 如下配置信息拷贝到
hive-site.xml 文件中)。
<property>
<name>hive.metastore.warehouse.dir</name>
<value>/user/hive/warehouse</value>
<description>location of default database for the warehouse</description>
</property>
配置同组用户有执行权限:
bin/hdfs dfs -chmod g+w /user/hive/warehouse
2 查询后信息显示配置
1)显示当前数据库,表头信息等
在hive-site.xml中添加如下内容:
<property>
<name>hive.cli.print.header</name>
<value>true</value>
</property>
<property>
<name>hive.cli.print.current.db</name>
<value>true</value>
</property>
配置前:
配置后:
3 hive运行日志信息配置
1)Hive 的 log 默认存放在/tmp/code1997/hive.log 目录下(当前用户名下)
2)修改 hive 的 log 存放日志到/opt/module/hive/logs
- 修改/opt/module/hive/conf/hive-log4j.properties.template 文件名称为
hive-log4j.properties - hive.log.dir=/opt/module/hive/logs
4 参数配置方式
1)查看当前配置信息
hive>set;
2)参数的配置三种方式:
- 配置文件方式
- 默认的配置文件:hive-default.xml
- 用户自定义配置文件:hive-site.xml
- 用户自定义配置会覆盖默认配置。Hive 也会读入 Hadoop 的配置,因为 Hive 是作为 Hadoop 的客户端启动的,Hive 的配置会覆盖 Hadoop 的配置。配置文件的设定对本机启动的所有 Hive 进程都有效。
- 命令行参数方式:
- 启动 Hive 时,可以在命令行添加-hiveconf param=value 来设定参数:[code1997@hadoop02 hive]$ bin/hive -hiveconf
mapred.reduce.tasks=10; - 查看:hive (default)> set mapred.reduce.tasks
- 启动 Hive 时,可以在命令行添加-hiveconf param=value 来设定参数:[code1997@hadoop02 hive]$ bin/hive -hiveconf
- 参数声明方式:可以在 HQL 中使用 SET 关键字设定参数
- 设置:hive (default)> set mapred.reduce.tasks=100; //注意:仅对本次 hive 启动有效。
- 查看:hive (default)> set mapred.reduce.tasks;
asks=100; //注意:仅对本次 hive 启动有效。
- 查看:hive (default)> set mapred.reduce.tasks;
优先级:配置文件<命令行参数<参数声明