core-site.xml参数配置详情

来源:互联网 发布:统计师的python日记 编辑:程序博客网 时间:2024/06/06 03:32
fs.default.name hdfs://master:9000定义master的URI和端口fs.checkpoint.dir${hadoop.tmp.dir}(默认)
/dfs/namesecondary
SNN的元数据以,号隔开,hdfs会把元数据冗余复制到这些目录,一般这些目录是不同的块设备,不存在的目录会被忽略掉fs.checkpoint.period1800定义ND的备份间隔时间,秒为单位,只对SNN效,默认一小时fs.checkpoint.size33554432以日志大小间隔做备份间隔,只对SNN生效,默认64Mfs.checkpoint.edits.dir${fs.checkpoint.dir}(默认)SNN的事务文件存储的目录,以,号隔开,hdfs会把事务文件冗余复制到这些目录fs.trash.interval10800HDFS垃圾箱设置,可以恢复误删除,分钟数,0为禁用,添加该项无需重启hadoophadoop.tmp.dir

/tmp/Hadoop

临时文件夹,指定后需将使用到的所有子级文件夹都要手动创建出来,否则无法正常启动服务。

hadoop.http.filter.initializersorg.apache.hadoop.security.
AuthenticationFilterInitializer
(排版调整,实际配置不要回车)
需要jobtracker,tasktracker
NN,DN等http访问端口用户验证使用,需配置所有节点
hadoop.http.authentication.typesimple | kerberos | #AUTHENTICATION_HANDLER_CLASSNAME#验证方式,默认为简单,也可自己定义class,需配置所有节点hadoop.http.authentication.token.validity36000验证令牌的有效时间,需配置所有节点hadoop.http.authentication.signature.secret
默认可不写参数默认不写在hadoop启动时自动生成私密签名,需配置所有节点hadoop.http.authentication.cookie.domaindomian.tldhttp验证所使用的cookie的域名,IP地址访问则该项无效,必须给所有节点都配置域名才可以。hadoop.http.authentication. simple.anonymous.allowedtrue | false简单验证专用,默认允许匿名访问,truehadoop.http.authentication.kerberos.principalHTTP/localhost@$LOCALHOSTKerberos验证专用,参加认证的实体机必须使用HTTP作为K的Namehadoop.http.authentication.kerberos.keytab/home/xianglei/hadoop.keytabKerberos验证专用,密钥文件存放位置hadoop.security.authorizationtrue|falseHadoop服务层级验证安全验证,需配合hadoop-policy.xml使用,配置好以后用dfsadmin,mradmin -refreshServiceAcl刷新生效hadoop.security.authenticationsimple | kerberoshadoop本身的权限验证,非http访问,simple或者kerberoshadoop.logfile.size1000000000设置日志文件大小,超过则滚动新日志hadoop.logfile.count20最大日志数io.bytes.per.checksum1024每校验码所校验的字节数,不要大于io.file.buffer.sizeio.skip.checksum.errorstrue | false处理序列化文件时跳过校验码错误,不抛异常。默认falseio.serializationsorg.apache.hadoop.io.serializer.WritableSerialization序列化的编解码器io.seqfile.compress.blocksize1024000块压缩的序列化文件的最小块大小,字节io.compression.codecs

org.apache.hadoop.io.compress.DefaultCodec,
com.hadoop.compression.lzo.LzoCodec,
com.hadoop.compression.lzo.LzopCodec,
org.apache.hadoop.io.compress.GzipCodec,
org.apache.hadoop.io.compress.BZip2Codec,

org.apache.hadoop.io.compress.SnappyCodec
(排版调整,实际配置不要回车)

Hadoop所使用的编解码器,gzip、bzip2为自带,lzo需安装hadoopgpl或者kevinweil,逗号分隔。
snappy需要单独安装并修改hadoop-env.sh配置LD_LIBRARY_PATH=snappy类库位置
io.compression.codec.lzo.classcom.hadoop.compression.lzo.LzoCodecLZO所使用的压缩编码器 io.file.buffer.size131072用作序列化文件处理时读写buffer的大小webinterface.private.actionstrue | false设为true,则JT和NN的tracker网页会出现杀任务删文件等操作连接,默认是falsetopology.script.file.name/hadoop/bin/RackAware.py机架感知脚本位置 topology.script.number.args1000机架感知脚本管理的主机数,IP地址