hive 备忘录 - 逆域录 - ITeye博客

`

085567

浏览: 213988 次
性别:
来自: 北京

最近访客更多访客>>

zouhuiying

isy

zzr1000

bianqi

博主相关

博客

微博

相册

收藏

留言

关于我

文章分类

社区版块

存档分类

最新评论

yugouai：下载不了啊。。。
如何获取hive建表语句
help： [root@hadoop-namenode 1 5 /usr/ ...
Sqoop
085567： lvshuding 写道请问，sqoop 安装时不用配置什么吗 ...
Sqoop
085567： lvshuding 写道请问，导入数据时，kv1.txt的文件 ...
hive与hbase整合
lvshuding：请问，sqoop 安装时不用配置什么吗？
Sqoop

hive 备忘录

博客分类：

hive

阅读更多

1 hive结果用gzip压缩输出

在运行查询命令之前，设置下面参数：

set mapred.output.compress=true;

set hive.exec.compress.output=true;

set mapred.output.compression.codec=org.apache.hadoop.io.compress.GzipCodec;

set io.compression.codecs=org.apache.hadoop.io.compress.GzipCodec;

INSERT OVERWRITE DIRECTORY 'hive_out' select * from tables limit 10000;

2 应用cloudera 的cdh3进行 hive left outer join，并且两个表都有分区的时候：

方法一：用子查询

方法二：select a.*,b.* from table a left outer join table b on(a.uid=b.uuid and b.dt='2011-08-21') where a.dt='2011-08-21'；

3 hive写sql的时候注意数据类型：

当uid是string的时候

select count(distinct uid) from table where dt = '2011-08-28' and type=2 and loginflag='3' and (uid<'23000000' or (uid>'50000000' and uid<'1500000000'))

select count(distinct uid) from newbehavior_table where dt='2011-08-28' and type=2 and (uid<23000000 or (uid<1500000000 and uid>50000000)) and loginflag='3';

两个sql的结果是不一样的。。。。。

4 在hive建立一个存储apache 日志的表

add jar ../build/contrib/hive_contrib.jar;

CREATE TABLE apachelog (

host STRING,

identity STRING,

user STRING,

time STRING,

request STRING,

status STRING,

size STRING,

referer STRING,

agent STRING)

ROW FORMAT SERDE 'org.apache.hadoop.hive.contrib.serde2.RegexSerDe'

WITH SERDEPROPERTIES (

"input.regex" = "([^ ]*) ([^ ]*) ([^ ]*) (-|\\[[^\\]]*\\]) ([^ \"]*|\"[^\"]*\") (-|[0-9]*) (-|[0-9]*)(?: ([^ \"]*|\"[^\"]*\") ([^ \"]*|\"[^\"]*\"))?",

"output.format.string" = "%1$s %2$s %3$s %4$s %5$s %6$s %7$s %8$s %9$s"

)

STORED AS TEXTFILE;

hive相关函数：http://www.karmasphere.net/Karmasphere-Analyst/hive-user-defined-functions.html

分享到：

sqoop could not find any valid local dir ... | Hive User Defined Functions

2011-08-24 14:56
浏览 1258
评论(0)
分类:行业应用
查看更多

评论

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

hivecrypt:一个用于Hive备忘录加密和解密的小型JavaScript模块: 蜂巢用于Hive备忘录加密和解密的小型JavaScript模块。适应了从未合并到。使用实施，使其与所有JavaScript环境（包括Electron JS应用程序）兼容。为什么创建这个？我需要一种在Electron应用程序中使用Hive发布密钥...

Hive学习记录: Hive学习记录，一些关于hive分桶、分区的知识。有需要自己下载。

hive登录用户名密码校验包: hive登录用户名密码校验包

hive: hive hive hive hive hive hive hive hive hive hive hive hive

Hive3.1.2编译源码: 使用hive3.1.2和spark3.0.0配置hive on spark的时候，发现官方下载的hive3.1.2和spark3.0.0不兼容，hive3.1.2对应的版本是spark2.3.0，而spark3.0.0对应的hadoop版本是hadoop2.6或hadoop2.7。所以，如果想要使用高...

Hive表生成工具，Hive表生成工具Hive表生成工具: Hive表生成工具，Hive表生成工具Hive表生成工具

hive-jdbc hive jdbc驱动: hive-jdbc

Hive使用手册Hive使用手册: 1 Hive 概念与连接使用: 2 2 Hive支持的数据类型： 2 2.1原子数据类型： 2 2.2复杂数据类型： 2 2.3 Hive类型转换： 3 3 Hive创建/删除数据库 3 3.1创建数据库: 3 3.2 删除数据库: 3 4 Hive 表相关语句 3 4.1 Hive ...

《Hive数据仓库案例教程》教学课件第5章 Hive数据操作.pdf: 《Hive数据仓库案例教程》教学课件第5章 Hive数据操作.pdf《Hive数据仓库案例教程》教学课件第5章 Hive数据操作.pdf《Hive数据仓库案例教程》教学课件第5章 Hive数据操作.pdf《Hive数据仓库案例教程》教学课件第...

Hive 口袋手册: 这就注定了这本小册子并不是一本 “全面”、“详尽” 的书籍，它是一个对常用知识点的概括性总结，或者也可以称之为 “备忘录”。它适合于对 Hive 已经有一定了解的人群，亦或是作为面试前的知识回顾手册。写这本...

hive-3.1.1安装包: Hive是一个基于Hadoop的数据仓库工具，它本身并不存储数据，部署在Hadoop集群上，数据是存储在HDFS上的. Hive所建的表在HDFS上对应的是一个文件夹，表的内容对应的是一个文件。它不仅可以存储大量的数据而且可以对...

Hive新手学习资料之Hive入门与实战.+Hive用户手册+hive函数大全中文版资源合集: Hive是基于Hadoop的一个数据仓库工具，可以将结构化的数据文件映射为一张数据库表，并提供类SQL查询功能。 hive是基于Hadoop的一个数据仓库工具，用来进行数据提取、转化、加载，这是一种可以存储、查询和分析存储...

Hive.sql，hive的元数据: Hive.sql

hivesql语句练习: 5.安装hive和mysq完成后，将mysql的连接jar包拷贝到$HIVE_HOME/lib目录下如果出现没有权限的问题，在mysql授权(在安装mysql的机器上执行) mysql -uroot -p #(执行下面的语句 *.*:所有库下的所有表 %：任何IP地址...

Ambari下Hive3.0升级到Hive4.0: Ambari下Hive3.0升级到Hive4.0，验证自测；

Hive总结.docx: Hive原理/Hive SQL/Hive 函数/数据仓库分层和建模/Hive sql优化/数据倾斜

利用Hive进行复杂用户行为大数据分析及优化案例: 利用Hive进行复杂用户行为大数据分析及优化案例（全套视频+课件+代码+讲义+工具软件），具体内容包括： 01_自动批量加载数据到hive 02_Hive表批量加载数据的脚本实现（一） 03_Hive表批量加载数据的脚本实现（二） ...

hive学习总结思维导图.xmind: 由于 Hive 采用了类似SQL 的查询语言 HQL(Hive Query Language)，因此很容易将 Hive 理解为数据库。其实从结构上来看，Hive 和数据库除了拥有类似的查询语言，再无类似之处。本文将从多个方面来阐述 Hive ...

hbase和hive常用命令记录总结: hbase和hive常用命令总结

Global site tag (gtag.js) - Google Analytics