core-site.xml

最新推荐文章于 2025-10-11 11:36:17 发布

翻译最新推荐文章于 2025-10-11 11:36:17 发布 · 803 阅读

文章标签：

#hadoop

hadoop 专栏收录该内容

12 篇文章

订阅专栏

本文详细介绍了Hadoop配置的各项参数及其作用，包括fs.defaultFS、fs.checkpoint.dir等关键配置项，帮助读者理解如何正确配置Hadoop集群。

                    
                        
                    
                    namevalueDescription
fs.defaultFShdfs://hadoopmaster:9000定义HadoopMaster的URI和端口
fs.checkpoint.dir/opt/data/hadoop1/hdfs/namesecondary1定义hadoop的name备份的路径，官方文档说是读取这个，写入dfs.name.dir
hadoop.tmp.dirfile:/opt/hadoop_tmp临时存放工作目录：放到data盘上，因为tmp会定期清理 目录。
file.replication1备份，
fs.checkpoint.period1800定义name备份的备份间隔时间，秒为单位，只对snn生效，默认一小时
fs.checkpoint.size33554432以日志大小间隔做备份间隔，只对snn生效，默认64M
io.compression.codecsorg.apache.hadoop.io.compress.DefaultCodec,  com.hadoop.compression.lzo.LzoCodec,          com.hadoop.compression.lzo.LzopCodec, org.apache.hadoop.io.compress.BZip2Codec (排版调整，实际配置不要回车)Hadoop所使用的编解码器，gzip和bzip2为自带，lzo需安装hadoopgpl或者kevinweil，逗号分隔，snappy也需要单独安装
io.compression.codec.lzo.classcom.hadoop.compression.lzo.LzoCodecLZO所使用的压缩编码器 用于压缩文件
topology.script.file.name/hadoop/bin/RackAware.py机架感知脚本位置
topology.script.number.args1000机架感知脚本管理的主机数，IP地址
fs.trash.interval10800HDFS垃圾箱设置，可以恢复误删除，分钟数，0为禁用，添加该项无需重启hadoop
hadoop.http.filter.initializersorg.apache.hadoop.security.AuthenticationFilterInitializer (排版调整，实际配置不要回车)需要jobtracker,tasktrackernamenode,datanode等http访问端口用户验证使用，需配置所有节点
hadoop.http.authentication.typesimple - kerberos - #AUTHENTICATION_HANDLER_CLASSNAME#验证方式，默认为简单，也可自己定义class,需配置所有节点
hadoop.http.authentication.token.validity (排版调整，实际配置不要回车)36000验证令牌的有效时间,需配置所有节点
hadoop.http.authentication.signature.secret (排版调整，实际配置不要回车)默认可不写参数默认不写在hadoop启动时自动生成私密签名,需配置所有节点
hadoop.http.authentication.cookie.domaindomian.tldhttp验证所使用的cookie的域名，IP地址访问则该项无效，必须给所有节点都配置域名才可以。
hadoop.http.authentication.simple.anonymous.allowed (排版调整，实际配置不要回车)true - false简单验证专用，默认允许匿名访问，true
hadoop.http.authentication.kerberos.principal (排版调整，实际配置不要回车)HTTP/localhost@$LOCALHOSTKerberos验证专用，参加认证的实体机必须使用HTTP作为K的Name
hadoop.http.authentication.kerberos.keytab (排版调整，实际配置不要回车)/home/xianglei/hadoop.keytabKerberos验证专用，密钥文件存放位置
hadoop.security.authorizationtrue-falseHadoop服务层级验证安全验证，需配合hadoop-policy.xml使用，配置好以后用dfsadmin,mradmin -refreshServiceAcl刷新生效
io.file.buffer.size131072用作序列化文件处理时读写buffer的大小
hadoop.security.authenticationsimple - kerberoshadoop本身的权限验证，非http访问，simple或者kerberos
hadoop.logfile.size1000000000设置日志文件大小，超过则滚动新日志
hadoop.logfile.count20最大日志数
io.bytes.per.checksum1024每校验码所校验的字节数，不要大于io.file.buffer.size
io.skip.checksum.errorstrue - false处理序列化文件时跳过校验码错误，不抛异常。默认false
io.serializationsorg.apache.hadoop.io.serializer.WritableSerialization (排版需要。实际配置不要回车)序列化的编解码器
io.seqfile.compress.blocksize1024000块压缩的序列化文件的最小块大小，字节
webinterface.private.actionstrue - false设为true，则JT和NN的tracker网页会出现杀任务删文件等操作连接，默认是false

                

name	value	Description
fs.defaultFS	hdfs://hadoopmaster:9000	定义HadoopMaster的URI和端口
fs.checkpoint.dir	/opt/data/hadoop1/hdfs/namesecondary1	定义hadoop的name备份的路径，官方文档说是读取这个，写入dfs.name.dir
hadoop.tmp.dir	file:/opt/hadoop_tmp	临时存放工作目录：放到data盘上，因为tmp会定期清理目录。
file.replication	1	备份，
fs.checkpoint.period	1800	定义name备份的备份间隔时间，秒为单位，只对snn生效，默认一小时
fs.checkpoint.size	33554432	以日志大小间隔做备份间隔，只对snn生效，默认64M
io.compression.codecs	org.apache.hadoop.io.compress.DefaultCodec, com.hadoop.compression.lzo.LzoCodec, com.hadoop.compression.lzo.LzopCodec, org.apache.hadoop.io.compress.BZip2Codec (排版调整，实际配置不要回车)	Hadoop所使用的编解码器，gzip和bzip2为自带，lzo需安装hadoopgpl或者kevinweil，逗号分隔，snappy也需要单独安装
io.compression.codec.lzo.class	com.hadoop.compression.lzo.LzoCodec	LZO所使用的压缩编码器用于压缩文件
topology.script.file.name	/hadoop/bin/RackAware.py	机架感知脚本位置
topology.script.number.args	1000	机架感知脚本管理的主机数，IP地址
fs.trash.interval	10800	HDFS垃圾箱设置，可以恢复误删除，分钟数，0为禁用，添加该项无需重启hadoop
hadoop.http.filter.initializers	org.apache.hadoop.security.AuthenticationFilterInitializer (排版调整，实际配置不要回车)	需要jobtracker,tasktrackernamenode,datanode等http访问端口用户验证使用，需配置所有节点
hadoop.http.authentication.type	simple - kerberos - #AUTHENTICATION_HANDLER_CLASSNAME#	验证方式，默认为简单，也可自己定义class,需配置所有节点
hadoop.http.authentication.token.validity (排版调整，实际配置不要回车)	36000	验证令牌的有效时间,需配置所有节点
hadoop.http.authentication.signature.secret (排版调整，实际配置不要回车)	默认可不写参数	默认不写在hadoop启动时自动生成私密签名,需配置所有节点
hadoop.http.authentication.cookie.domain	domian.tld	http验证所使用的cookie的域名，IP地址访问则该项无效，必须给所有节点都配置域名才可以。
hadoop.http.authentication.simple.anonymous.allowed (排版调整，实际配置不要回车)	true - false	简单验证专用，默认允许匿名访问，true
hadoop.http.authentication.kerberos.principal (排版调整，实际配置不要回车)	HTTP/localhost@$LOCALHOST	Kerberos验证专用，参加认证的实体机必须使用HTTP作为K的Name
hadoop.http.authentication.kerberos.keytab (排版调整，实际配置不要回车)	/home/xianglei/hadoop.keytab	Kerberos验证专用，密钥文件存放位置
hadoop.security.authorization	true-false	Hadoop服务层级验证安全验证，需配合hadoop-policy.xml使用，配置好以后用dfsadmin,mradmin -refreshServiceAcl刷新生效
io.file.buffer.size	131072	用作序列化文件处理时读写buffer的大小
hadoop.security.authentication	simple - kerberos	hadoop本身的权限验证，非http访问，simple或者kerberos
hadoop.logfile.size	1000000000	设置日志文件大小，超过则滚动新日志
hadoop.logfile.count	20	最大日志数
io.bytes.per.checksum	1024	每校验码所校验的字节数，不要大于io.file.buffer.size
io.skip.checksum.errors	true - false	处理序列化文件时跳过校验码错误，不抛异常。默认false
io.serializations	org.apache.hadoop.io.serializer.WritableSerialization (排版需要。实际配置不要回车)	序列化的编解码器
io.seqfile.compress.blocksize	1024000	块压缩的序列化文件的最小块大小，字节
webinterface.private.actions	true - false	设为true，则JT和NN的tracker网页会出现杀任务删文件等操作连接，默认是false