搜索关键字：hive 认证类，搜索到5967个结果！码迷,mamicode.com！

hive select查询语句底层实现的某些细微差别

最近，由于工作的需要，学习了基于Hadoop的一个数据仓库工具hive。遇到并解决了一些问题，但是有个select语句的细微差别值得注意。首先来看两条hql语句： SELECT * FROM MY_TABLE where dt=2014031205 limit 10 SELECT ID,NAM.....

分类：其他好文时间：2014-06-28 23:54:20 阅读次数：400

为什么要使用Spark？

现有的hadoop生态系统中存在的问题1）使用mapreduce进行批量离线分析；2）使用hive进行历史数据的分析；3）使用hbase进行实时数据的查询；4）使用storm进行实时的流处理；5）。。。。。。导致：维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷，使用spar...

分类：其他好文时间：2014-06-28 14:08:46 阅读次数：306

hive的查询注意事项以及优化总结 .

一、控制Hive中Map和reduce的数量Hive中的sql查询会生成执行计划，执行计划以MapReduce的方式执行，那么结合数据和集群的大小，map和reduce的数量就会影响到sql执行的效率。除了要控制Hive生成的Job的数量，也要控制map和reduce的数量。1、map的数量，通常情...

分类：其他好文时间：2014-06-23 07:48:43 阅读次数：288

Hive sql 语法解读

一、创建表在官方的wiki里，example是这种：Sql代码 CREATE[EXTERNAL]TABLE[IFNOTEXISTS]table_name[(col_namedata_type[COMMENTcol_comment],...)][COMMENTtable_comment][PARTI...

分类：数据库时间：2014-06-21 08:34:09 阅读次数：287

hive 学习之异常篇

一、刚装上hive在执行hive启动的过程中出现[hadoop@localhost hive-0.6.0]$ hiveInvalid maximum heap size: -Xmx4096mThe specified size exceeds the maximum representable si...

分类：其他好文时间：2014-06-20 22:17:04 阅读次数：278

sqoop往hive中导入数据报找不到数据库错误

sqoop版本为1.4.4，hadoop版本为2.2.0，hive版本为0.11.0，hive元数据存放位置为mysql，当使用sqoop 从mysql往hive中导入数据时，总是提示找不到所指定的hive数据库，事实上hive中已存在该数据库，sqoop中也设置了hive路径，/etc/pro....

分类：数据库时间：2014-06-18 15:06:57 阅读次数：248

Shark集群搭建配置

Shark是基于Spark与Hive之上的一种SQL查询引擎。...

分类：其他好文时间：2014-06-18 06:54:00 阅读次数：286

Hadoop生态系统学习路线

主要介绍Hadoop家族产品，常用的项目包括Hadoop, Hive, Pig, HBase, Sqoop, Mahout, Zookeeper, Avro, Ambari, Chukwa，新增加的项目包括，YARN, Hcatalog, Oozie, Cassandra, Hama, Whirr, Flume, Bigtop, Crunch, Hue等。从2011年开始，中国进入大数据风起云...

分类：其他好文时间：2014-06-17 16:44:25 阅读次数：310

详细总结 Hive VS 传统关系型数据库

本文思路，看图说话，一张图，清晰总结二者区别下面对图中的各条做详细总结 1、查询语言不做赘述 2、数据存储位置不做赘述 3、数据格式 Hive：Hive 中没有定义专门的数据格式，数据格式可以由用户指定，用户定义数据格式需要指定三个属性：列分隔符（通常为空格、”\t”、”\x001″）、行分隔符（”\n”）以及读取文件数据的方法（Hive 中默认有三个文件格式...

分类：数据库时间：2014-06-16 19:54:26 阅读次数：376

简要总结数据仓库VS数据库

本文简要总结以下两个问题，旨在快速理解“数据仓库” 1、什么是“数据仓库”？ 2、“数据仓库”与“数据库”的区别？下面做详细阐述： 1、什么是“数据仓库”？ “一个数据仓库通常是一个面向主题的、集成的、与时间相关且不可修改的（可以添加）数据集合，它用于对管理决策过程的支持。” 此句话包含几个关键点：面向主题的、集成的、与时间相关的、不可修改的，具体含义欢迎留言交流。 2、数据仓...

分类：数据库时间：2014-06-16 19:05:04 阅读次数：259

共5967条上一页 1 ... 588 589 590 591 592 ... 597 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)