4大数据实战系列-hive安装配置优化

1 基础环境

1.1 版本预览

    Cnetos 6.5    已安装

    Hadoop 2.8   已安装集群

    Hive 2.3      待安装

    Mysql 5.6     已安装

    Spark 2.1.1    已安装

1.2 机器环境

机192.168.0.251 slave
192.168.0.252 master
Hadoop：hadoop已做双机无密码登录1.3 工作路径

*Hadoop：/home/data/app/hadoop/hadoop-2.8.0/etc/hadoop
Spark：/home/data/app/hadoop/spark-2.1.1-bin-hadoop2.7
Hive数据路径： /user/hive/warehouse/*

2安装

2.1 下载hive

http://hive.apache.org/downloads.html

2.2 下载mysql-connector

http://dev.mysql.com/downloads/connector/j/

2.3 安装

Hive:

Cd /data/software

Rz apache-hive-2.3.0-bin.tar.gz

Tar -zxvf apache-hive-2.3.0-bin.tar.gz

Mv apache-hive-2.3.0-bin /home/data/app/hadoop/

Mysql-connector:

/home/data/app/hadoop/hive-2.3.0/lib

Tar -zxvf mysql-connector-java-5.1.44.tar.gz

Cd mysql-connector-java-5.1.44

Mv mysql-connector-java-5.1.44-bin.jar ../

3 配置

3.1 初始配置

Vim /etc/profile

export HIVE_HOME=/home/data/app/hadoop/hive-2.3.0

export PATH=$PATH:$HIVE_HOME/bin

cp hive-env.sh.template hive-env.sh

cp hive-default.xml.template hive-site.xml

cp hive-log4j2.properties.template hive-log4j2.properties

cp hive-exec-log4j2.properties.template hive-exec-log4j2.properties

3.2 hive-env.sh环境配置

export JAVA_HOME=/home/data/software/jdk1.8.0_121   ##Java路径

export HADOOP_HOME=/home/data/app/hadoop/hadoop-2.8.0   ##Hadoop安装路径

export HIVE_HOME=/home/data/app/hadoop/hive-2.3.0    ##Hive安装路径

export HIVE_CONF_DIR=/home/data/app/hadoop/hive-

2.3.0 /conf    ##Hive配置文件路径

3.3 创建配置路径

hdfs dfs -mkdir -p /user/hive/warehouse

hdfs dfs -mkdir -p /user/hive/tmp

hdfs dfs -mkdir -p /user/hive/log

hdfs dfs -chmod -R 777 /user/hive/warehouse

hdfs dfs -chmod -R 777 /user/hive/tmp

hdfs dfs -chmod -R 777 /user/hive/log

3.4 hive-site.xml配置
2.4.1 配置连接mysql

<!--hive临时数据 -->

<property>

    <name>hive.exec.scratchdir</name>

    <value>/user/hive/tmp</value>

</property>

<!--hive数据库的数据文件-->

<property>

    <name>hive.metastore.warehouse.dir</name>

    <value>/user/hive/warehouse</value>

</property>

<!--hive日志-->

<property>

    <name>hive.querylog.location</name>

    <value>/user/hive/log</value>

</property>

<!--hive连接mysql，mysql存储hive数据库配置信息-->

<property>

    <name>javax.jdo.option.ConnectionURL</name>

<value>jdbc:mysql://192.168.0.2513306/hive?createDatabaseIfNotExist=true&amp;characterEncoding=UTF-8&amp;useSSL=false</value>

  </property>

  <property>

    <name>javax.jdo.option.ConnectionDriverName</name>

    <value>com.mysql.jdbc.Driver</value>

  </property>

  <property>

    <name>javax.jdo.option.ConnectionUserName</name>

    <value>hive</value>

  </property>

  <property>

    <name>javax.jdo.option.ConnectionPassword</name>

    <value>hive</value>

  </property>

3.4.2 配置tmp路径

mkdir /home/data/app/hadoop/hive-2.3.0/tmp

把{system:java.io.tmpdir} 改成 /home/data/app/hadoop/hive-2.3.0/tmp/

把 {system:user.name} 改成 {user.name}

4 初始化hive

schematool -dbType mysql -initSchema hive hive

5 启动测试

5.1 hive启动
5.1.1 hiveserver

Cd /home/data/app/hadoop/hive-2.3.0/bin

Nohup ./hiveserver2 &

ps -ef|grep hive|grep -v grep

5.1.2 hive

./hive

Debug 模式：hive -hiveconf hive.root.logger=DEBUG,console

Show databases;

Create database hive_data;

请检查 mysql->hive->dbs表

hadoop fs -ls /user/hive/warehouse

5.2 beeline启动
5.2.1同上先启动hiveserver
5.2.2 hadoop core-site.xml添加配置：

<property>

  <name>hadoop.proxyuser.root.groups</name>

  <value>*</value>

</property>

<property>

  <name>hadoop.proxyuser.root.hosts</name>

  <value>*</value>

</property>

./beeline

6 任务运行分析webUI

总结：hive运行在hadoop上，数据库文件存储hdfs，job task是mapreduce执行,所以数据库存储是分布式，任务执行也是多节点并行执行
http://192.168.0.252:8088

4大数据实战系列-hive安装配置优化的更多相关文章

《OD大数据实战》Hive环境搭建
一.搭建hadoop环境 <OD大数据实战>hadoop伪分布式环境搭建二.Hive环境搭建 1. 准备安装文件下载地址: http://archive.cloudera.com/cd ...
【大数据】Hadoop单机安装配置
1.解压缩hadoop-2.7.6.tar.gz到/home/hadoop/Soft目录中 2.创建软链接,方便hadoop升级 ln -s /home/hadoop/Soft/hadoop-2.7 ...
吴裕雄--天生自然 HADOOP大数据分布式处理：安装配置MYSQL数据库
安装之前先安装基本环境:yum install -y perl perl-Module-Build net-tools autoconf libaio numactl-libs # 下载mysql源安 ...
《OD大数据实战》Hive入门实例
官方参考文档:https://cwiki.apache.org/confluence/display/Hive/LanguageManual 一.命令行和客户端 1. 命令窗口 1)进入命令窗口 hi ...
InfluxDB+Grafana大数据监控系列之数据源配置（二）
一.Grafana 配置 InfluxDB 数据源 1.1 登录 Granfana 界面选择 InfluxDB 数据源在前面我们已经部署好相应监控环境,登录Grafana:http://10.223 ...
吴裕雄--天生自然 HADOOP大数据分布式处理：安装配置Tomcat服务器
下载链接:https://tomcat.apache.org/download-80.cgi tar -zxvf apache-tomcat-8.5.42.tar.gz -C /usr/local/s ...
吴裕雄--天生自然 HADOOP大数据分布式处理：安装配置JAVA
tar -xzvf jdk-8u151-linux-x64.tar.gz -C /usr/local/src sudo vim /etc/profile .编辑/etc/profile # JAVA ...
《OD大数据实战》驴妈妈旅游网大型离线数据电商分析平台
一.环境搭建 1. <OD大数据实战>Hadoop伪分布式环境搭建 2. <OD大数据实战>Hive环境搭建 3. <OD大数据实战>Sqoop入门实例 4. &l ...
大数据学习系列之四 ----- Hadoop+Hive环境搭建图文详解(单机)
引言在大数据学习系列之一 ----- Hadoop环境搭建(单机) 成功的搭建了Hadoop的环境,在大数据学习系列之二 ----- HBase环境搭建(单机)成功搭建了HBase的环境以及相关使用 ...
大数据学习系列之七 ----- Hadoop+Spark+Zookeeper+HBase+Hive集群搭建图文详解
引言在之前的大数据学习系列中,搭建了Hadoop+Spark+HBase+Hive 环境以及一些测试.其实要说的话,我开始学习大数据的时候,搭建的就是集群,并不是单机模式和伪分布式.至于为什么先写单 ...

随机推荐

Python常见部分内置方法与操作
Python常见内置方法与操作整型int 类型转换 int(其它数据类型),但只支持数字类型和小数类型 >>> num1 = input('Your age>>> ...
【入门排坑】Windows之间使用OpenSSH的ssh免密登录，排坑
安装安装OpenSSH 需要安装OpenSSH客户端和服务器,win10自带客户端,我们安装服务器即可. 设置 -- 应用 -- 可选功能 -- 添加 -- 添加 OpenSSH 服务器配置公钥 ...
[Java]【异常处理】在项目开发中的通用规范
这一问题,已苦恼多日,上述答案系近整整2日广泛阅读书籍.博客.网络问答后,归纳并苦思而成. 本博文仅罗列总的观点,各观点的具体解释,可私信Word笔记. 如需转载or复制时,请注明出处. 本博文同步发 ...
基于DotNetCoreNPOI封装特性通用导出excel
基于DotNetCoreNPOI封装特性通用导出excel 目前根据项目中的要求,支持列名定义,列索引排序,行合并单元格,EXCEL单元格的格式也是随着数据的类型做对应的调整. 效果图: 调用方式可 ...
ASP.NET Core - 缓存之分布式缓存
分布式缓存是由多个应用服务器共享的缓存,通常作为访问它的应用服务器的外部服务进行维护. 分布式缓存可以提高 ASP.NET Core 应用的性能和可伸缩性,尤其是当应用由云服务或服务器场托管时. 与其 ...
设计模式之[构建者模式(Builder)]-C#
说明:构建一个大对象时,可以分解成一个部分一个部分的构建,比如一台电脑由CUP.内存.主板.屏幕等,这些配件本身就是一个复杂的制造过程,一个一个构建后然后才组装成一台新的电脑. 步骤 1.定义要构建的 ...
R的基本用法2
title: "Lectures" author: '01' date: "2022-09-23" output: pdf_document knitr::op ...
Rust -- 模式与匹配
1. 模式用来匹配类型中的结构(数据的形状),结合模式和match表达式提供程序控制流的支配权模式组成内容字面量解构的数组.枚举.结构体.元祖变量通配符占位符流程:匹配值 --&g ...
js对象方法大全
JavaScript中Object构造函数的方法 Object构造函数的方法节 Object.assign() 通过复制一个或多个对象来创建一个新的对象. Object.create() 使用指定的原 ...
[Pytorch框架] 2.1.1 PyTorch 基础 : 张量
文章目录 PyTorch 基础 : 张量张量(Tensor) 基本类型 Numpy转换设备间转换初始化常用方法 PyTorch 基础 : 张量在第一章中我们已经通过官方的入门教程对PyTor ...

4大数据实战系列-hive安装配置优化

1 基础环境

2安装

3 配置

4 初始化hive

5 启动测试

6 任务运行分析webUI

4大数据实战系列-hive安装配置优化的更多相关文章

随机推荐

热门专题