ubuntu docker搭建Hadoop集群环境的方法

来自：网络

时间：2020-11-27

阅读：

spark要配合Hadoop的hdfs使用，然而Hadoop的特点就是分布式，在一台主机上搭建集群有点困难，百度后发现可以使用docker构建搭建，于是开搞：

github项目：https://github.com/kiwenlau/hadoop-cluster-docker

参考文章：https://www.freexyz.cn/article/109698.htm

docker安装

文章中安装的是docker.io

但是我推荐安装docker-ce，docker.io版本太老了,步骤如下：

1、国际惯例更新下APT软件包的源

sudo apt-get update

2、安装软件包以允许apt通过HTTPS使用存储库

sudo apt-get install \

apt-transport-https \

ca-certificates \

curl \

software-properties-common

3、因为被墙使用教育网镜像：

复制代码代码如下:curl -fsSL https://mirrors.ustc.edu.cn/docker-ce/linux/ubuntu/gpg | sudo apt-key add

4、同样

sudo add-apt-repository \

"deb [arch=amd64] https://mirrors.ustc.edu.cn/docker-ce/linux/ubuntu \

$(lsb_release -cs) \

stable"

5、更新下我们的软件源

sudo apt-get update

6、安装docker

sudo apt-get install docker-ce

7、启动docker服务

sudo service docker start

sudo systemctl start docker

8、觉得有必要可以设置开机自带启动

sudo systemctl enable docker

9、关闭自启动

sudo systemctl disable docker

10、国内访问docker会受限制，可以使用加速服务，阿里云、网易云、DaoCloud

11、运行 docker run hello-world 测试是否安装成功

12、想要安装其他image 可以到docker hub上找

https://hub.docker.com/

或是直接在github上搜索相应docker

搭建Hadoop集群

搭建过程很简单
https://github.com/kiwenlau/hadoop-cluster-docker

上步骤说明很详细：

1、pull镜像，速度慢的换国内镜像源

sudo docker pull kiwenlau/hadoop:1.0

200多m不算大，我下过jupyter官方pyspark的docker 5g…

2、克隆项目到本地

git clone https://github.com/kiwenlau/hadoop-cluster-docker

其实只用到里面的 start-container.sh 文件也可以单独下，复制粘贴啥的

3、start-container.sh 需要修改一下 cd 到文件目录

sudo gedit start-container.sh 修改如下

ubuntu docker搭建Hadoop集群环境的方法

开放9000端口还有创建共享文件夹方便以后使用

4、保存之后，创建docker-Hadoop网络

sudo docker network create --driver=bridge hadoop

5、开启容器

sudo ./start-container.sh

ubuntu docker搭建Hadoop集群环境的方法

6、开启Hadoop集群

./start-hadoop.sh

ubuntu docker搭建Hadoop集群环境的方法

7、测试一下Hadoop，在hdfs上创建 test/input 目录

hadoop fs -mkdir -p /test/input
hadoop fs -ls /test

ubuntu docker搭建Hadoop集群环境的方法

8、运行word-count程序

./run-wordcount.sh

结果如下

ubuntu docker搭建Hadoop集群环境的方法

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持免费资源网。

服务器是企业和个人重要的存储设备之一，而数据是企业和个人的珍贵财富，一旦服务器出现故障，会导致数据丢失或者受损，对公司或个人造成巨大的损失。因此，服务器备份和恢复数据备受

2024-10-21 20:49:48

目录一：证书配置二：Tomcat配置 http自动跳转 https 总结一：证书配置下载已签发的证书、选择 Tomcat 版本进入 Tomcat 目录创建个 cert 文件夹将下载好的 SSL证书压缩包里的

2024-10-20 21:52:57

目录一、引言二、基本概念三、修改密码的步骤 3.1 登录到 CentOS 服务器 3.2 修改当前用户的密码 3.3 修改其他用户的密码 3.4 密码复杂性检查四、解决密码复杂性

2024-10-20 21:52:48

目录引言 1. Nginx简介 2. 跨域问题简介 3. 解决跨域问题的方法步骤一：安装和配置Nginx 步骤二：测试跨域访问结论总结引言在现代的Web开发中，跨域访问是一种常见的

2024-10-18 23:19:22

目录方法 1：直接从服务器上抓取并查看证书方法 2：通过 openssl 抓取并查看证书方法 3：下载并查看证书文件证书信息解析总结查看服务器端的证书时，可以通过导入服务器

2024-10-18 23:19:14

目录一、找到位于 /etc/netplan 的 netplan 目录二、修改或创建配置文件三、配置与本机相符的网络适配器四、禁用DHCP 五、配置静态IP、子网掩码、网关六、配置DNS服务

2024-10-18 23:19:06

目录方法一第一步：查看当前主机网络信息第二步：修改配置文件进入配置文件夹第三步：使配置生效且检查网络连接状况方法二第一步：查看当前主机网络信息第二步：修改

2024-10-18 23:18:57

目录 LINUX使用rsync命令 Rsync 命令语法 Rsync 命令选项 Rsync 命令命令示例 Rsync命令的基本语法使用 Rsync 命令传输文件和目录使用 Rsync 命令镜像数据

2024-10-18 23:18:22

目录首先重来就没有设置过ROOT用户 1.使用普通用户登录后输入以下命 2.设置root用户密码 3.输入“su”切换为root用户登录 4.输入“Visudo”命令

2024-10-18 23:18:14

目录 Linux解决「Unknown filesystem」遇到这种情况应该如何修复总结Linux解决「Unknown filesystem」不知道大家在使用 Linux 系统的时候有没有遇见过「Unknown filesys

2024-10-18 23:18:02

目录下载nginx 配置启动总结下载nginx下载地址https://nginx.org/en/download.htmldownload > Stable version 可选择稳定版的nginxnginx压缩包解压后的目录配置1.将打

2024-10-18 23:17:53

目录 1、VScode扩展安装与配置（1）vscode扩展安装（2）vscode远程配置 2、vscode-server离线下载（1）Commit ID查看（2）安装包下载 3、文件解压缩 4、移动文件到指定位置

2024-10-18 23:17:27

目录 Linux中监控系统重启的重要性深入探究：Linux 重启日志使用last命令 uptime 命令利用journalctl获取重启历史记录 who -b 命令总结借其强大的架构和无与伦比的灵活性

2024-10-18 23:17:06

目录 MKDIR 命令的语法 mkdir 命令可用的选项深入了解 MKDIR 命令示例使用 mkdir 创建简单目录在以其绝对功能和灵活性而闻名的 Linux 操作系统的动态世界中，有大量

2024-10-18 23:16:52

目录如何通过 Nginx 只允许 www 域名访问并禁止裸域名访问步骤 1：配置 Nginx 处理 www 域名步骤 2：禁止裸域名访问步骤 3：重定向裸域名到 www 域名（可选）步骤 4：重启 Ng

2024-10-18 23:16:32

从日志信息来看，确实是权限问题（Permission denied）。我们可以重新检查并设置权限，确保 Nginx 用户有权限访问这些文件。检查 Nginx 用户：首先确认 Nginx 使用的用户，一般是 www-d

2024-10-14 19:52:38

目录一、telnet简述二、telnet Connection refused不通处理思路一般对应上面的后两种情况排查目的主机服务总结一、telnet简述telnet一般用于测试本机到目的主机

2024-10-14 19:52:29

目录在linux下图形界面和命令行界面的切换 1. 图形界面和命令行界面的切换 2. 修改系统开机进入的界面总结在linux下图形界面和命令行界面的切换我估计好多喜欢用li

2024-10-14 19:52:19

目录 telnet nc命令返回“连接失败” 1、端口没有被监听 2、防火墙策略 3、目标主机不接受外部连接总结 telnet nc命令返回“连接失败”当使用n

2024-10-14 19:52:12

目录 1、问题描述 2、问题解决1、问题描述在命令行输入命令按Tab键时出现如下报错：很明显，设备上没有空间，即磁盘空间不足。通过命令查看具体情况如下：df -h2、问题解决首先想到

2024-10-14 19:52:02

本文主要介绍了nginx配置history模式的使用小结，具体如下：worker_processes 1; events { worker_connections 1024;} http { include mime.types; default_t

2024-10-14 19:51:41

目录一、配置 Nginx 获取客户端真实 IP 1、基本配置说明 2、set_real_ip_from详解 3、log_format 配置（参考）二、调试与测试三、Lua 中使用客户端真实 IP（参考）四

2024-10-14 19:51:32

目录官方文档代理样例 Linux 查看安装文件命令手册 Nginx 日志配置方案成功解决问题–使用 Nginx 代理 WebSocket 可能出现的问题 Nginx 官方文档网址 nginx d

2024-10-14 19:50:51

目录方法1: 使用 netstat 命令方法2: 使用 lsof 命令方法3: 使用 ss 命令方法4: 直接从Java进程读取注意事项在Linux系统中，如果你已经知道了Java应用程序的进程ID（PID），你

2024-10-14 19:50:44

目录 logrotate 简介 logrotate 配置文件日志回滚原理 sshd 日志回滚实战修改配置文件重启rsyslog 强制切割测试和运行 logrotate debug 模式 v

2024-10-14 19:50:35

目录利用Linux自带的logrotate管理日志 1. logrotate简介 2. logrotate配置参数 3. nginx日志切割实例 4. 其他配置示例总结利用Linux自带的logrotate管理日志日

2024-10-14 19:50:22

是一种常见的命令行工具，用于从远程服务器下载整个目录及其子目录中的文件。它可以通过递归方式下载目录中的所有文件，并保持目录结构的完整性。wget是一个开源的非交互式命令

2024-10-14 14:17:31

目录 linux开启关闭防火墙 1.关闭防火墙 2.设置开机不启动 3.查看防火墙状态不同系统常见防火墙相关命令下面是red hat/CentOs7关闭防火墙的命令 firewalld 总结

2024-10-12 00:18:20

目录第一种：Nginx自己的错误页面第二种：反向代理的错误页面一个网站项目，肯定是避免不了404页面的，通常使用Nginx作为Web服务器时，有以下集中配置方式，一起来看看。第一种：Nginx

2024-09-30 00:10:50

目录问题原因解决方法 1. 查看 Nginx 错误日志 2. 检查 Nginx 配置文件 3. 检查应用程序日志 4. 检查文件权限 5. 检查后端服务示例 Nginx 配置检查步骤检查步

2024-09-30 00:09:29

2020-07-31

2019-11-21

2019-08-07

2018-09-24

2020-03-22

2019-02-16

2019-11-17

2018-10-07

2018-10-04

ubuntu docker搭建Hadoop集群环境的方法

如何恢复linux和windows服务器被误删除文件

Tomcat服务器如何配置ssl证书

CentOS修改服务器登录密码的详细指南

Nginx解决跨域访问的完整实例

linux查看服务端证书方式(keytool和openssl)

Ubuntu设置静态IP地址的方法步骤(亲测有效)

Ubuntu配置静态IP的两种方法

在LINUX系统上使用rsync命令详解

Linux系统中如何将普通用户权限提升至root权限

Linux解决Unknown filesystem问题

nginx部署前端dist包详细图文教程

VScode连接远程服务器踩坑实战记录(新版离线vscode-server安装)

Linux系统中检查系统重启记录方案

LINUX中关于mkdir命令语法和实例解读

Nginx 只允许 www 域名访问并禁止裸域名访问的实现步骤

Nginx设置目录的访问权限实现访问静态资源

telnet Connection refused端口不通如何处理

linux下图形界面和命令行界面的切换方式

telnet nc命令返回“连接失败”问题及解决

Linux无法为立即文档创建临时文件：设备上没有空间的问题解决

nginx配置history模式的使用小结

Nginx获取客户端真实IP(real_ip_header)的实现

Nginx配置WebSocket代理的示例代码

Linux系统下通过jar包进程号查询jar程序占用端口的常用方法

linux日志轮询方案

Linux自带的logrotate管理日志用法

使用wget递归下载目录内容

linux如何开启关闭防火墙

Nginx实现404页面的配置方法的两种方法

nginx出现500 Internal Server Error错误的解决方法

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道