Hadoop伪分布式搭建操作步骤指南

Hadoop伪分布式搭建操作步骤指南

作者:imxintian 2017-10-25 18:25:40

数据库

大数据

分布式

Hadoop 本文主要分享Hadoop伪分布式搭建的操作步骤,包括准备工作、Hadoop环境部署-JDK部分和Hadoop伪分布式环境部署-Hadoop部分,希望对大家有所帮助。

[[207661]]

一、准备工作

  • 在 /opt/目录下创建文件夹modules,和softwares
    • 修改操作权限(切换至root用户下)
  1. chown -R wxt:wxt /opt/ 
  • 然后切换至普通用户
  1. mkdir softwares 
  2.  
  3. mkdir modules  
  • 安装lrzsz (在linux里可代替ftp上传和下载。)

首先安装lrzsz

  1. yum -y install lrzsz 
  • 上传文件,执行命令rz,会跳出文件选择窗口,选择好文件,点击确认即可。
  1. rz 
  • 下载文件,执行命令sz
  1. sz 

二、Hadoop环境部署-JDK部分

1.

  • 上传jdk 至softwares

2.

  • 解压jdk 至modules
    • tar -zxvf jdk-7u67-linux-x64.tar.gz -C /opt/modules/

3.

  • 修改环境变量
    • 切换至 root 用户修改 vi /etc/profile 文件,配置jdk环境变量
  1. #JAVA_HOME 
  2. export JAVA_HOME=/opt/modules/jdk1.7.0_67 
  3. export PATH=$PATH:$JAVA_HOME/bin  

4.

  •  source /etc/profile 使文件生效
  • 验证是否配置成功
    • java -version
  1. java version "1.7.0_09-icedtea" 
  2. OpenJDK Runtime Environment (rhel-2.3.4.1.el6_3-x86_64) 
  3. OpenJDK 64-Bit Server VM (build 23.2-b09, mixed mode)  
  • jps命令可以查看java 进程
  • echo $JAVA_HOME

三、Hadoop伪分布式环境部署-Hadoop部分

1.

  • 上传文件hadoop-2.5.0.tar.gz,至softwares
  • 解压文件至modules
    • tar -zxvf hadoop-2.5.0.tar.gz -C /opt/modules/

2.

  • 清理Hadoop的目录,将hadoop/share/doc目录删除,节省磁盘空间, 通过这个命令查看df -h

3.

  • 修改hadoop/etc/hadoop/hadoop-env.sh文件
  • 修改hadoop/etc/hadoop/mapred-env.sh文件
  • 修改hadoop/etc/hadoop/yarn-env.sh文件
  • 指定Java安装路径
    • export JAVA_HOME=/opt/modules/jdk1.7.0_67

4.

  • 注意:
    • Hadoop中的四个核心模块对应四个默认配置文件
    • HDFS,Hadoop默认的文件系统,是文件系统的访问入口
    • Namenode,所在的机器9000端口是早期Hadoop 1.x使用的,现在 Hadoop 2.x使用的是8020端口号用于节点直接内部通信,使用RPC通信机制

5.

  • 修改hadoop/etc/hadoop/core-site.xml文件
  1. <property> 
  2.     <name>fs.defaultFS</name
  3.     <!--bigdata-4 为我的localhost 名字--> 
  4.     <value>hdfs://bigdata-4:8020</value> 
  5. </property> 
  6. <property> 
  7.     <name>hadoop.tmp.dir</name
  8.     <value>/opt/modules/hadoop-2.5.0/data/tmp</value> 
  9. </property>  

6.

  • 注意:
    • /tmp表示临时存储目录,系统每次重启会按照脚本预先设置好的删 除 里面的文件重新自定义系统生成的文件路径,/tmp会被清空,无法保证数据文件安全性。

7.

  • 修改hadoop/etc/hadoop/hdfs-site.xml文件
    • 指定HDFS文件存储的副本数个数,默认是3个,这里是单台机器就设置为1,这个数字要小于datanode的节点数。
  1. <property> 
  2.     <name>dfs.replication</name
  3.     <value>1</value> 
  4. </property>  

8.

  • 修改hadoop/etc/hadoop/slaves文件
    • 指定从节点的机器位置,添加主机名即可 
  1. bigdata-4 

9.

  • 格式化namenode
  1. bin/hdfs namenode -format 

10.

  • 启动命令
    • sbin/hadoop-daemon.sh start namenode
    • sbin/hadoop-daemon.sh start datanode

11.

  • 查看HDFS外部UI界面
    • bigdata-04或者IP地址 跟上50070端口号,外部通信http dfs.namenode.http-address 50070
    • http://bigdata-4:50070 (如果windows本地没有配置hosts,需要配置)
    • 如果不能正确打开页面,请检查防火墙是否关闭
      • 切换至root 用户,service iptables status
      • 关闭防火墙 chkconfig iptables off

12.

  • 测试HDFS环境
    • 创建文件夹,HDFS中有用户主目录的概念,和Linux一样
    • bin/hdfs dfs -mkdir -p wxt_test/iuput

13.

  • 上传文件到HDFS(随便找一个文件上传就行)
    • bin/hdfs dfs -put /opt/modules/hadoop-2.5.0/etc/hadoop/core-site.xml wxt_test/input/core-site.xml
    • 上传成功,HDFS外部UI界面,会有上传的文件显示

14.

  • 读取HDFS的文件
    • bin/hdfs dfs -text /core-site.xml
    • 终端会显示上传文件的内容。

15.

  • 下载文件到本地(指定下载到哪里,同时可以重命名成get-site.xml)bin/hdfs dfs -get /core-site.xml /home/wxt/Desktop/get-site.xml然后你会看到这个文件,并且重命名于桌面。

Hadoop 伪分布式搭建至此结束。 

文章来源网络,作者:运维,如若转载,请注明出处:https://shuyeidc.com/wp/298544.html<

(0)
运维的头像运维
上一篇2025-05-22 23:57
下一篇 2025-05-22 23:58

相关推荐

  • 个人主题怎么制作?

    制作个人主题是一个将个人风格、兴趣或专业领域转化为视觉化或结构化内容的过程,无论是用于个人博客、作品集、社交媒体账号还是品牌形象,核心都是围绕“个人特色”展开,以下从定位、内容规划、视觉设计、技术实现四个维度,详细拆解制作个人主题的完整流程,明确主题定位:找到个人特色的核心主题定位是所有工作的起点,需要先回答……

    2025-11-20
    0
  • 社群营销管理关键是什么?

    社群营销的核心在于通过建立有温度、有价值、有归属感的社群,实现用户留存、转化和品牌传播,其管理需贯穿“目标定位-内容运营-用户互动-数据驱动-风险控制”全流程,以下从五个维度展开详细说明:明确社群定位与目标社群管理的首要任务是精准定位,需明确社群的核心价值(如行业交流、产品使用指导、兴趣分享等)、目标用户画像……

    2025-11-20
    0
  • 香港公司网站备案需要什么材料?

    香港公司进行网站备案是一个涉及多部门协调、流程相对严谨的过程,尤其需兼顾中国内地与香港两地的监管要求,由于香港公司注册地与中国内地不同,其网站若主要服务内地用户或使用内地服务器,需根据服务器位置、网站内容性质等,选择对应的备案路径(如工信部ICP备案或公安备案),以下从备案主体资格、流程步骤、材料准备、注意事项……

    2025-11-20
    0
  • 如何企业上云推广

    企业上云已成为数字化转型的核心战略,但推广过程中需结合行业特性、企业痛点与市场需求,构建系统性、多维度的推广体系,以下从市场定位、策略设计、执行落地及效果优化四个维度,详细拆解企业上云推广的实践路径,精准定位:明确目标企业与核心价值企业上云并非“一刀切”的方案,需先锁定目标客户群体,提炼差异化价值主张,客户分层……

    2025-11-20
    0
  • PS设计搜索框的实用技巧有哪些?

    在PS中设计一个美观且功能性的搜索框需要结合创意构思、视觉设计和用户体验考量,以下从设计思路、制作步骤、细节优化及交互预览等方面详细说明,帮助打造符合需求的搜索框,设计前的规划明确使用场景:根据网站或APP的整体风格确定搜索框的调性,例如极简风适合细线条和纯色,科技感适合渐变和发光效果,电商类则可能需要突出搜索……

    2025-11-20
    0

发表回复

您的邮箱地址不会被公开。必填项已用 * 标注