--认识与安装CentOS7操作系统)
文章目录0. 相关视频1. 引子2. 大数据为什么必须基于 Linux2.1 系统性能优势2.2 开源生态完全适配2.3 权限与集群管理3. 主流 Linux 发行版本概述3.1 Ubuntu乌班图3.2 CentOS3.3 RedHatRHEL3.4 Debian3.5 SUSE3.6 Kali Linux4. 大数据学习为什么选 CentOS74.1 极致稳定适配所有大数据框架4.2 超长生命周期教学场景成熟4.3 企业通用性极高4.4 命令统一、学习成本最低4.5 资源占用低适合虚拟机学习5. VMware 虚拟机安装 CentOS7 完整步骤5.1 前期准备5.2 新建虚拟机5.3 配置虚拟机硬件5.4 挂载 ISO 镜像5.5 开机安装系统5.6 设置 root 密码与用户5.7 开机验证6. 小结0. 相关视频视频实操安装CentOS7操作系统1. 引子很多初学大数据的同学都会有一个疑惑我学的是大数据、Hadoop、Spark、Flink为什么还要先学 LinuxWindows 不能跑大数据组件吗刚开始学的时候我也有这个疑问。Windows 系统简单、可视化强、上手快日常娱乐、办公、写代码都很舒服。但真正接触大数据集群部署后才明白大数据的底层几乎全部依赖 Linux 操作系统。不学 Linux你的大数据学习永远只能停留在“理论阶段”。今天这篇文章我们通俗讲清楚大数据和 Linux 的关系、主流 Linux 发行版区别、为什么学习大数据首选 CentOS7以及完整的虚拟机安装步骤。2. 大数据为什么必须基于 Linux很多新手以为大数据是一套独立软件其实大数据是一整套分布式服务集群。Hadoop、Spark、Flink、Kafka、HBase 等所有主流大数据框架全部原生适配 Linux 环境。2.1 系统性能优势大数据需要持续读写海量数据、长期后台运行服务。Windows 偏向桌面交互后台服务稳定性、资源占用控制不如 Linux。Linux 占用资源低、运行稳定、长期不宕机非常适合服务器、集群环境。2.2 开源生态完全适配大数据技术全部是开源技术而开源技术的原生开发、测试、部署环境都是 Linux。Windows 运行大数据组件会出现各种兼容报错、路径问题、权限问题几乎无法搭建正式集群。2.3 权限与集群管理大数据集群涉及多节点通信、文件权限配置、进程启停、脚本调度。Linux 完善的权限机制、命令行管理、Shell 脚本能力是大数据运维、开发的基础。简单总结Windows 适合学习编程Linux 适合学习服务、集群、大数据。3. 主流 Linux 发行版本概述Linux 只是系统内核我们日常安装使用的是基于内核封装的「发行版本」。不同版本定位不同适合的场景也完全不一样。3.1 Ubuntu乌班图最热门的桌面 Linux 系统界面美观、软件丰富、适合新手入门、适合开发、人工智能、日常学习。优点生态丰富、教程多、可视化友好缺点服务器稳定性不如企业级系统不适合大数据集群生产环境3.2 CentOS基于 RedHat 源码编译完全免费、企业级稳定、主打服务器场景。CentOS 分为 CentOS7、CentOS8、CentOS9 Stream。是互联网、大数据、云计算企业最主流的服务器系统。3.3 RedHatRHEL商业版企业 Linux稳定性极强、官方有技术支持。企业生产环境大量使用需要付费授权学生学习不推荐。3.4 Debian极其稳定、更新保守适合服务器生态不如 Ubuntu、CentOS 丰富。3.5 SUSE多用于传统政企、金融服务器国内大数据行业使用极少。3.6 Kali Linux专门为网络安全、渗透测试打造和大数据学习毫无关系不要选错系统。4. 大数据学习为什么选 CentOS7既然有这么多 Linux 版本为什么全网大数据教程、高校教学、企业实训很多都是使用 CentOS74.1 极致稳定适配所有大数据框架CentOS7 版本成熟、bug 极少Hadoop、Spark、Flink、Kafka 所有版本完美兼容。新版本 CentOS8/9 迭代太快部分旧版大数据组件会出现兼容问题。4.2 超长生命周期教学场景成熟CentOS7 拥有十年长期维护周期积累了全网最全的大数据教程、踩坑方案、问题解决案例。学习过程中遇到任何报错网上基本都有现成解决方案。4.3 企业通用性极高市面很多大数据生产集群底层都是 CentOS7。学生阶段学会 CentOS7毕业入职可以直接无缝适配企业环境不需要重新适应系统。4.4 命令统一、学习成本最低CentOS7 采用 yum 包管理器命令统一、简单好记。大数据学习需要频繁安装软件、配置环境、启停服务CentOS7 的操作方式最适合新手。4.5 资源占用低适合虚拟机学习学生基本都是用 VMware 虚拟机搭建学习环境。CentOS7 配置要求低、运行流畅低配电脑也能轻松跑通单节点、伪分布式、完全分布式集群。一句话总结学大数据选 CentOS7随大流稳妥5. VMware 虚拟机安装 CentOS7 完整步骤新手学习大数据不建议直接装物理机系统虚拟机是最安全、最方便、可反复重装的学习环境。5.1 前期准备安装好 VMware Workstation 虚拟机软件下载 CentOS7 DVD 标准镜像文件.iso电脑内存至少 8G4G 也能跑容易卡顿5.2 新建虚拟机打开 VMware点击「创建新的虚拟机」选择「典型(推荐)」模式下一步选择「稍后安装操作系统」客户机操作系统选择Linux → CentOS7 64位自定义虚拟机名称、存放路径建议纯英文路径不要中文、不要空格5.3 配置虚拟机硬件处理器核心数推荐 2核及以上内存推荐 2G~4G硬盘分配 20G 以上默认存储为单个文件完成创建不要立即开机5.4 挂载 ISO 镜像选中新建的虚拟机点击「编辑虚拟机设置」CD/DVD 选项中选择「使用 ISO 镜像文件」选中下载好的 CentOS7 镜像确定5.5 开机安装系统开启虚拟机选择第一项「Install CentOS 7」等待加载完成选择语言推荐英文避免中文乱码问题进入安装界面只需配置三项时间时区Asia/Shanghai 上海软件安装最小化安装Minimal大数据学习够用、占用资源少安装位置选中磁盘自动分区5.6 设置 root 密码与用户点击开始安装设置 root 超级管理员密码务必记住后续所有操作都需要可创建普通用户可选等待安装完成重启虚拟机5.7 开机验证重启后输入账号密码成功进入命令行界面即代表安装成功。后续我们所有的大数据环境搭建、集群配置、命令练习都在这个系统中完成。6. 小结Linux 是大数据的地基没有 Linux 基础根本无法开展大数据实战学习。市面上 Linux 发行版众多但CentOS7 凭借稳定、兼容、通用、资料多成为大数据学习的推荐操作系统。建议大家跟着教程亲手安装一遍虚拟机系统熟悉命令行环境为后续 Hadoop、Spark 学习打好基础。