阿里云-云小站(无限量代金券发放中)
【腾讯云】云服务器、云数据库、COS、CDN、短信等热卖云产品特惠抢购

Hive0.13.1介绍及安装部署

482次阅读
没有评论

共计 4160 个字符,预计需要花费 11 分钟才能阅读完成。

一、简介

hive 由 Facebook 开源用于解决海量结构化日志的数据统计。hive 是基于 Hadoop 的一个数据仓库工具,是基于 Hadoop 之上的,文件是存储在 HDFS 上的,底层运行的是 MR 程序。hive 可以将结构化的数据文件映射成一张表,并提供类 SQL 查询功能。

二、HIVE 特点

  • 构建在 Hadoop 之上的数据仓库
    • 使用 HQL 作为查询接口
    • 使用 HDFS 存储
    • 使用 MapReduce 计算
  • 本质:将 HQL 转化成 MapReduce 程序
  • 灵活性和扩展性比较好:支持 UDF、自定义存储格式等
  • 适合离线数据处理
  • hive 在 Hadoop 生态系统中的位置:

Hive0.13.1 介绍及安装部署

 三、hive 体系结构

Hive0.13.1 介绍及安装部署

    • 用户接口:
      • ClientCLI(hive shell)、JDBC/ODBC(java 访问 hive),WEBUI(浏览器访问 hive)
    • 元数据:Metastore
      • 元数据包括:表名、表所属数据库、表的拥有者、列 / 分区字段、表的类型(是否外部表)、表数据所在目录等
    • Hadoop
      • 使用 HDFS 存储,使用 MR 计算
    • 驱动器:Driver
      • 包含:解析器、编译器、优化器、执行器
      • 解析器
        • 将 SQL 字符串转换成抽象语法书 AST,这一步一般都用第三方工具库完成,比如 antlr;对 AST 进行语法分析,比如表是否存在、字段是否存在、SQL 语义是否有误等
      • 编译器
        • 将 AST 编译生成逻辑执行计划
      • 优化器
        • 对逻辑执行计划进行优化
      • 执行器
        • 把逻辑执行计划转化成可以运行的物理计划。对 hive 来说,就是 MR/TEZ/SPARK

四、hive 优点

  1. 操作接口采用类 SQL 语法,提供快速开发的能力(简单、容易上手)
  2. 避免了去写 MR,减少开发人员的学习成本
  3. 统一的元数据管理,可以与 impala/spark 等共享元数据
  4. 易扩展(HDFS+MR:可以扩展集群规模;支持 UDF、UDAF、UDTF 等自定义函数)

五、使用场景

  1. 数据的离线处理,比如:日志分析,海量结构化数据离线分析 …
  2. Hive 的执行延迟比较高,因此 hive 常用于数据分析的,对实时性要求不高的场合
  3. Hive 的优势在于处理大数据,对于小数据没有优势,因为 Hive 的执行延迟比较高

六、hive 部署安装

* 注意:安装部署 hive 之前,首先要安装完成 jdk 和 hadoop。如有需要,可以查看博客:Haoop2.5.0 伪分布式环境搭建。

step1:解压安装包

 

tar -xzvf apache-hive-0.13.1-bin.tar.gz -C /opt/software/

step2:在 hdfs 上创建 hive 所需要的目录及权限修改

hdfs dfs -mkdir /tmp
hdfs dfs -mkdir -p /user/hive/warehouse
hdfs dfs -chmod g+w /tmp
hdfs dfs -chmod g+w /user/hive/warehouse

step3:修改 hive-env.sh 中 HADOOP_HOME 及 HIVE_CONF_DIR 属性值,注意改名

# Set HADOOP_HOME to point to a specific hadoop install directory
HADOOP_HOME=/opt/software/hadoop-2.5.0

# Hive Configuration Directory can be controlled by:
export HIVE_CONF_DIR=/opt/software/hive-0.13.1-bin/conf

step4:hive 元数据信息默认是使用的 Derby 数据库,derby 数据库只支持一个 hive 连接,修改为使用关系型数据库 mysql 存储 hive 元数据信息。

1. 安装 mysql 数据库

# 查询系统中没有 mysql
sudo rpm -qa | grep mysql
# 卸载自带的 mysql 库
sudo rpm -e –nodeps mysql-libs-5.1.66-2.el6_3.x86_64
# 使用 yum 进行 mysql 的安装
sudo yum -y install mysql-server
# 查看 mysqld 服务是否开启
sudo service mysqld status
# 启动 mysql 服务
sudo service mysqld start
# 设置开机启动 mysqld
sudo chkconfig mysqld on
# 设置 mysql 管理员 root 的密码
mysqladmin -u root password ‘123456’

2. 设置 mysql 的连接权限
mysql -uroot -p # 进入 mysql 命令行
grant all privileges on *.* to ‘root’@’%’ identified by ‘123456’ with grant option;
flush privileges; # 刷新
quit; # 退出
sudo service mysqld restart # 重启 mysql 服务

3. 自定义 hive 的配置文件,从默认的文件(hive-default.xml.template)拷贝一份过来,重命名为 hive-site.xml,然后删除其中的内容,添加以下内容:

<?xml version=”1.0″ encoding=”UTF-8″ standalone=”no”?>
<?xml-stylesheet type=”text/xsl” href=”https://www.linuxidc.com/Linux/2019-04/configuration.xsl”?>

<!–
  Licensed to the Apache Software Foundation (ASF) under one or more
  contributor license agreements.  See the NOTICE file distributed with
  this work for additional information regarding copyright ownership.
  The ASF licenses this file to You under the Apache License, Version 2.0
  (the “License”); you may not use this file except in compliance with
  the License.  You may obtain a copy of the License at

      http://www.apache.org/licenses/LICENSE-2.0

  Unless required by applicable law or agreed to in writing, software
  distributed under the License is distributed on an “AS IS” BASIS,
  WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
  See the License for the specific language governing permissions and
  limitations under the License.
–>

<configuration>
    <property>
        <name>hive.exec.mode.local.auto</name>
        <value>true</value>
    </property>
    <property>
        <name>hive.exec.mode.local.auto.input.files.max</name>
        <value>100</value>
    </property>
    <property>
        <name>hive.exec.mode.local.auto.inputbytes.max</name>
        <value>13421772800000</value>
    </property>
    <property>
        <name>hive.cli.print.header</name>
        <value>true</value>
    </property>
    <property>
        <name>hive.cli.print.current.db</name>
        <value>true</value>
    </property>
    <property>
        <name>javax.jdo.option.ConnectionDriverName</name>
        <value>com.mysql.jdbc.Driver</value>
    </property>
    <property>
        <name>javax.jdo.option.ConnectionURL</name>
        <value>jdbc:mysql://bigdata01:3306/hive?createDatabaseIfNotExist=true&amp;useSSL=true&amp;useUnicode=true&amp;characterEncoding=UTF-8</value>
    </property>
    <property>
        <name>javax.jdo.option.ConnectionUserName</name>
        <value>hive</value>
    </property>
    <property>
        <name>javax.jdo.option.ConnectionPassword</name>
        <value>hive</value>
    </property>
    <property>
        <name>hive.metastore.uris</name>
        <value>thrift://bigdata01:9083</value>
    </property>
    <property>
        <name>hive.server2.thrift.port</name>
        <value>10013</value>
    </property>
</configuration>

4. 拷贝 mysql 驱动到 /opt/software/hive-0.13.1-bin/lib/ 目录下

至此,hive 部署完成,即可通过命令行输入 hive 进入 hive 环境。

正文完
星哥玩云-微信公众号
post-qrcode
 0
星锅
版权声明:本站原创文章,由 星锅 于2022-01-22发表,共计4160字。
转载说明:除特殊说明外本站文章皆由CC-4.0协议发布,转载请注明出处。
【腾讯云】推广者专属福利,新客户无门槛领取总价值高达2860元代金券,每种代金券限量500张,先到先得。
阿里云-最新活动爆款每日限量供应
评论(没有评论)
验证码
【腾讯云】云服务器、云数据库、COS、CDN、短信等云产品特惠热卖中

星哥玩云

星哥玩云
星哥玩云
分享互联网知识
用户数
4
文章数
19351
评论数
4
阅读量
7979952
文章搜索
热门文章
星哥带你玩飞牛NAS-6:抖音视频同步工具,视频下载自动下载保存

星哥带你玩飞牛NAS-6:抖音视频同步工具,视频下载自动下载保存

星哥带你玩飞牛 NAS-6:抖音视频同步工具,视频下载自动下载保存 前言 各位玩 NAS 的朋友好,我是星哥!...
星哥带你玩飞牛NAS-3:安装飞牛NAS后的很有必要的操作

星哥带你玩飞牛NAS-3:安装飞牛NAS后的很有必要的操作

星哥带你玩飞牛 NAS-3:安装飞牛 NAS 后的很有必要的操作 前言 如果你已经有了飞牛 NAS 系统,之前...
我把用了20年的360安全卫士卸载了

我把用了20年的360安全卫士卸载了

我把用了 20 年的 360 安全卫士卸载了 是的,正如标题你看到的。 原因 偷摸安装自家的软件 莫名其妙安装...
再见zabbix!轻量级自建服务器监控神器在Linux 的完整部署指南

再见zabbix!轻量级自建服务器监控神器在Linux 的完整部署指南

再见 zabbix!轻量级自建服务器监控神器在 Linux 的完整部署指南 在日常运维中,服务器监控是绕不开的...
飞牛NAS中安装Navidrome音乐文件中文标签乱码问题解决、安装FntermX终端

飞牛NAS中安装Navidrome音乐文件中文标签乱码问题解决、安装FntermX终端

飞牛 NAS 中安装 Navidrome 音乐文件中文标签乱码问题解决、安装 FntermX 终端 问题背景 ...
阿里云CDN
阿里云CDN-提高用户访问的响应速度和成功率
随机文章
多服务器管理神器 Nexterm 横空出世!NAS/Win/Linux 通吃,SSH/VNC/RDP 一站式搞定

多服务器管理神器 Nexterm 横空出世!NAS/Win/Linux 通吃,SSH/VNC/RDP 一站式搞定

多服务器管理神器 Nexterm 横空出世!NAS/Win/Linux 通吃,SSH/VNC/RDP 一站式搞...
浏览器自动化工具!开源 AI 浏览器助手让你效率翻倍

浏览器自动化工具!开源 AI 浏览器助手让你效率翻倍

浏览器自动化工具!开源 AI 浏览器助手让你效率翻倍 前言 在 AI 自动化快速发展的当下,浏览器早已不再只是...
在Windows系统中通过VMware安装苹果macOS15

在Windows系统中通过VMware安装苹果macOS15

在 Windows 系统中通过 VMware 安装苹果 macOS15 许多开发者和爱好者希望在 Window...
如何安装2026年最强个人助理ClawdBot、完整安装教程

如何安装2026年最强个人助理ClawdBot、完整安装教程

如何安装 2026 年最强个人助理 ClawdBot、完整安装教程 一、前言 学不完,根本学不完!近期,一款名...
星哥带你玩飞牛NAS-1:安装飞牛NAS

星哥带你玩飞牛NAS-1:安装飞牛NAS

星哥带你玩飞牛 NAS-1:安装飞牛 NAS 前言 在家庭和小型工作室场景中,NAS(Network Atta...

免费图片视频管理工具让灵感库告别混乱

一言一句话
-「
手气不错
Prometheus:监控系统的部署与指标收集

Prometheus:监控系统的部署与指标收集

Prometheus:监控系统的部署与指标收集 在云原生体系中,Prometheus 已成为最主流的监控与报警...
星哥带你玩飞牛NAS硬件02:某鱼6张左右就可拿下5盘位的飞牛圣体NAS

星哥带你玩飞牛NAS硬件02:某鱼6张左右就可拿下5盘位的飞牛圣体NAS

星哥带你玩飞牛 NAS 硬件 02:某鱼 6 张左右就可拿下 5 盘位的飞牛圣体 NAS 前言 大家好,我是星...
150元打造低成本NAS小钢炮,捡一块3865U工控板

150元打造低成本NAS小钢炮,捡一块3865U工控板

150 元打造低成本 NAS 小钢炮,捡一块 3865U 工控板 一块二手的熊猫 B3 工控板 3865U,搭...
让微信公众号成为 AI 智能体:从内容沉淀到智能问答的一次升级

让微信公众号成为 AI 智能体:从内容沉淀到智能问答的一次升级

让微信公众号成为 AI 智能体:从内容沉淀到智能问答的一次升级 大家好,我是星哥,之前写了一篇文章 自己手撸一...
星哥带你玩飞牛NAS-16:飞牛云NAS换桌面,fndesk图标管理神器上线!

星哥带你玩飞牛NAS-16:飞牛云NAS换桌面,fndesk图标管理神器上线!

  星哥带你玩飞牛 NAS-16:飞牛云 NAS 换桌面,fndesk 图标管理神器上线! 引言 哈...