Hadoop core-site.xml 配置项列表

最新推荐文章于 2024-06-28 09:37:28 发布

weixin_30492047

最新推荐文章于 2024-06-28 09:37:28 发布

阅读量461

点赞数 1

文章标签：大数据 python

原文链接：http://www.cnblogs.com/yinchengzhe/p/5000217.html

版权

core-default.xml与core-site.xml的功能是一样的，如果在core-site.xml里没有配置的属性，则会自动会获取core-default.xml里的相同属性的值

官方文档：http://hadoop.apache.org/docs/current/hadoop-project-dist/hadoop-common/core-default.xml

以下表格中专业词简称：

NN:NameNode

DN:DataNode

SNN:SecondaryNameNode

属性	值	说明
fs.default.name	hdfs://master:9000	定义master的URI和端口
fs.checkpoint.dir	${hadoop.tmp.dir}(默认) /dfs/namesecondary	SNN的元数据以,号隔开,hdfs会把元数据冗余复制到这些目录，一般这些目录是不同的块设备，不存在的目录会被忽略掉
fs.checkpoint.period	1800	定义ND的备份间隔时间，秒为单位，只对SNN效，默认一小时
fs.checkpoint.size	33554432	以日志大小间隔做备份间隔，只对SNN生效，默认64M
fs.checkpoint.edits.dir	${fs.checkpoint.dir}(默认)	SNN的事务文件存储的目录,以,号隔开,hdfs会把事务文件冗余复制到这些目录
fs.trash.interval	10800	HDFS垃圾箱设置，可以恢复误删除，分钟数，0为禁用，添加该项无需重启hadoop
hadoop.tmp.dir	/tmp/hadoop	临时文件夹，指定后需将使用到的所有子级文件夹都要手动创建出来，否则无法正常启动服务。
hadoop.http.filter.initializers	org.apache.hadoop.security. AuthenticationFilterInitializer (排版调整，实际配置不要回车)	需要jobtracker,tasktracker NN,DN等http访问端口用户验证使用，需配置所有节点
hadoop.http.authentication.type	simple \| kerberos \| #AUTHENTICATION_HANDLER_CLASSNAME#	验证方式，默认为简单，也可自己定义class,需配置所有节点
hadoop.http.authentication.token.validity	36000	验证令牌的有效时间,需配置所有节点
hadoop.http.authentication.signature.secret	默认可不写参数	默认不写在hadoop启动时自动生成私密签名,需配置所有节点
hadoop.http.authentication.cookie.domain	domian.tld	http验证所使用的cookie的域名，IP地址访问则该项无效，必须给所有节点都配置域名才可以。
hadoop.http.authentication. simple.anonymous.allowed	true \| false	简单验证专用，默认允许匿名访问，true
hadoop.http.authentication.kerberos.principal	HTTP/localhost@$LOCALHOST	Kerberos验证专用，参加认证的实体机必须使用HTTP作为K的Name
hadoop.http.authentication.kerberos.keytab	/home/hadoop/hadoop.keytab	Kerberos验证专用，密钥文件存放位置
hadoop.security.authorization	true\|false	Hadoop服务层级验证安全验证，需配合hadoop-policy.xml使用，配置好以后用dfsadmin,mradmin -refreshServiceAcl刷新生效
hadoop.security.authentication	simple \| kerberos	hadoop本身的权限验证，非http访问，simple或者kerberos
hadoop.logfile.size	1000000000	设置日志文件大小，超过则滚动新日志
hadoop.logfile.count	20	最大日志数
io.bytes.per.checksum	1024	每校验码所校验的字节数，不要大于io.file.buffer.size
io.skip.checksum.errors	true \| false	处理序列化文件时跳过校验码错误，不抛异常。默认false
io.serializations	org.apache.hadoop.io.serializer.WritableSerialization	序列化的编解码器
io.seqfile.compress.blocksize	1024000	块压缩的序列化文件的最小块大小，字节
io.compression.codecs	org.apache.hadoop.io.compress.DefaultCodec, com.hadoop.compression.lzo.LzoCodec, com.hadoop.compression.lzo.LzopCodec, org.apache.hadoop.io.compress.GzipCodec, org.apache.hadoop.io.compress.BZip2Codec, org.apache.hadoop.io.compress.SnappyCodec (排版调整，实际配置不要回车)	Hadoop所使用的编解码器，gzip、bzip2为自带，lzo需安装hadoopgpl或者kevinweil，逗号分隔。 snappy需要单独安装并修改hadoop-env.sh配置LD_LIBRARY_PATH=snappy类库位置
io.compression.codec.lzo.class	com.hadoop.compression.lzo.LzoCodec	LZO所使用的压缩编码器
io.file.buffer.size	131072	用作序列化文件处理时读写buffer的大小
webinterface.private.actions	true \| false	设为true，则JT和NN的tracker网页会出现杀任务删文件等操作连接，默认是false
topology.script.file.name	/hadoop/bin/RackAware.py	机架感知脚本位置
topology.script.number.args	1000	机架感知脚本管理的主机数，IP地址