ubuntu 13.04 hadoop伪分布式环境的搭建

来源:互联网 发布:软件定义网络sdn 编辑:程序博客网 时间:2024/06/03 10:18

1.分三种模式,单机模式,配置为空,调试用,伪分布式,所有的daemon进程在一台机器上,完全分布式,多台机器布署hadoop
2.先安装jdk,再下载hadoop,我下载的是1.2.1
wget http://mirrors.tuna.tsinghua.edu.cn/apache/hadoop/common/hadoop-1.2.1/hadoop-1.2.1.tar.gz
3.创建hadoop的用户和用户组
4.ssh免登录,命令
ssh-keygen -t rsa -P “”
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
为什么这样就能免登录?

5.解压hadoop到/home/hadoop/目录下的hadoop-1.2.1,然后建hadooop符号链接指向hadoop-1.2.1
6.修改conf/的hadoop-env.sh,设置JAVA_HOME HADOOP_HOME PATH环境变量
export JAVA_HOME=/usr/lib/jvm/java-7-openjdk-amd64/
export HADOOP_HOME=/home/hadoop/hadoop/
export PATH=$PATH:/home/hadoop/hadoop/bin/

修改conf/下的core-site.xml

<configuration>
<property>
<name>fs.default.name</name>
<value>hdfs://localhost:9000</value>
</property>
<property>
<name>hadoop.tmp.dir</name>
<value>/home/hadoop/tmp</value>
</property>
</configuration>

hdfs-site.xml
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.name.dir</name>
<value>/home/hadoop/hdfs/name</value>
</property>
<property>
<name>dfs.data.dir</name>
<value>/home/hadoop/hdfs/data</value>
</property>
</configuration>

mapred-site.xml
<configuration>
<property>
<name>mapred.job.tracker</name>
<value>localhost:9001</value>
</property>
</configuration>

7.在/home/hadoop下建tmp/ hdfs/data hdfs/name三个目录
hadoop namenode -format
格式化hdfs

8.bash start_all.sh启动hadoop进程和监控进程
可以在50030 50060 50070监听jobtraker tasktraker hdfs
监控的端口和实际hdfs的端口不是同一个。

0 0