hive官网(hive与mysql有什么不同)

本文目录
hive与mysql有什么不同
当然不是,hive支持jdbc和odbc数据源连接,可以连接很多种数据库,mysql、oracle等等等等,它自己的metastore用的就是derbyDB。 具体的连接方法在官网上有说明,使用odbc需要重新编译相关组件。hive通过jdbc连接其他数据库的教程在google上一搜
应该是Hadoop在hbase和Hive中的作用吧。 hbase与hive都是架构在hadoop之上的。都是用hadoop作为底层存储。而hbase是作为分布式数据库,而hive是作为分布式数据仓库。当然hive还是借用hadoop的MapReduce来完成一些hive中的命令的执行。
如何在hadoop 环境下安装hive
不行。 安装 vm 下载:去官网下 VMware-player-5.0.1-894247.zip 安装和配置ubanto 下载:去官网下 ubuntu-12.10-desktop-i386.iso 打开vm,载入ubanto iso文件,进行安装更新 进入ubanto,如果是第一个进入,则需要设置root的密码
局域网其他人对于hadoop伪分布式上的hive怎么连接hive
熟悉了Sqlserver的sqlserver management studio、Oracle的PL/SQL可视化数据库查询分析工具,在刚开始使用hive、phoenix等类sql组件时,一直在苦苦搜寻是否也有类似的工具,不负所望,SQuirrel Sql client 可视化数据库工具基本可满足要求。 SQuirrel Sql client是一个用Java写的数据库客户端,用JDBC统一数据库访问接口以后,可以通过一个统一的用户界面来操作MySQL、MSSQL、Hive、Phoenix等支持JDBC访问的数据库。
可直接从官网下载,最新版本3.7.1
hive driver 配置:
下载基于windows的软件包: squirrel-sql-3.7.1-standard.jar
运行SQuirrel Sql Client 程序,增加 hive driver, 如图
在弹出对话框中的参数配置如下图
Example URL: jdbc:hive2://192.168.2.89:10000/default (意思是通过jdbc连接hiveServer2,后面是数据库地址及端口)
Class Name: org.apache.hive.jdbc.HiveDriver
重点是加载Extra Class Path, 需要增加的文件如下,从 hadoop、hive安装目录的 lib目录下能找着
commons-configuration-1.6.jar
hadoop-common-2.7.1.2.4.2.0-258.jar
hive-common-1.2.1000.2.4.2.0-258.jar
hive-contrib-1.2.1000.2.4.2.0-258.jar
hive-jdbc-1.2.1000.2.4.2.0-258.jar
hive-metastore-1.2.1000.2.4.2.0-258.jar
hive-service-1.2.1000.2.4.2.0-258.jar
httpclient-4.4.jar
httpcore-4.4.jar
libthrift-0.9.2.jar
log4j-1.2.16.jar
slf4j-api-1.7.10.jar
slf4j-log4j12-1.7.10.jar配置完成后,在已经注册的Driver列表里面,如果新建的myhive驱动显示如下,则OK
安装完驱动后,切换至上面的Aliases页,配置hive server连接,如图,Test 成功则OK
双击别名,打开 Sql 查询窗口,创建一个表,Sql如下:
CREATE TABLE web_log(viewTime INT, userid BIGINT, url STRING, referrer STRING, ip STRING)
ROW FORMAT DELIMITED FIELDS TERMINATED BY ’\t’;执行:show tables; 能正确显示刚才创建的 web_log 表即ok.
测试:
hive安装必须有hadoop吗
是的。
安装 vm
下载:去官网下 VMware-player-5.0.1-894247.zip
安装和配置ubanto
下载:去官网下 ubuntu-12.10-desktop-i386.iso
打开vm,载入ubanto iso文件,进行安装更新
进入ubanto,如果是第一个进入,则需要设置root的密码
apache hive 是什么意思
Hive最初是应Facebook每天产生的海量新兴社会网络数据进行管理和机器学习的需求而产生和发展的。那么,到底什么是Hive,我们先看看Hive官网Wiki是如何介绍Hive的
The Apache HiveTM data warehouse software facilitates querying and
managing large datasets residing in distributed storage. Built on top of
Apache HadoopTM, it provides:
(1)、Tools to enable easy data extract/transform/load (ETL)
(2)、A mechanism to impose structure on a variety of data formats
(3)、Access to files stored either directly in Apache HDFSTM or in other
data storage systems such as Apache HBaseTM
(4)、Query execution via MapReduce
上面英文的大致意思是:Apache Hive数据仓库软件提供对存储在分布式中的大型数据集的查询和管理,它本身是建立在Apache
Hadoop只上,主要提供以下功能:它提供了一系列的工具,可用来对数据进行提取/转化/加载(ETL);是一种可以存储、查询和分析存储在HDFS(或者HBase)中的大规模数据的机制;查询是通过MapReduce来完成的(并不是所有的查询都需要MapReduce来完成,比如select
* from XXX就不需要;在Hive0.11对类似select a,b from
XXX的查询通过配置也可以不通过MapReduce来完成,具体怎么配置请参见本博客《Hive:简单查询不启用Mapreduce

更多文章:
turtles歌曲(哪位大神有turtles(乌龟组合)的<谢谢>的歌词中文翻译 感激不尽)
2026年10月11日 10:00
金山铁路22号线(请问现在轨道交通22号线金山铁路是个什么情况据说9月28日就开通了啊~~~)
2026年10月11日 09:10
repercussions(都是余波,repercussions和aftermath有什么区别啊)
2026年10月11日 09:00
dropdownlist 绑定(DropDownList 绑定所有项 并 显示指定项)
2026年10月11日 08:50
易语言网页api接口怎么调用(易语言,怎么读取网页json的api)
2026年10月11日 08:00
majority of(the majority of 和 a majority of的区别以及用法例句)
2026年10月11日 07:40





