搜索关键字：spark on hive，搜索到12366个结果！码迷,mamicode.com！

Apache Spark源码走读之16 -- spark repl实现详解

之所以对spark shell的内部实现产生兴趣全部缘于好奇代码的编译加载过程，scala是需要编译才能执行的语言，但提供的scala repl可以实现代码的实时交互式执行，这是为什么呢？既然scala已经提供了repl，为什么spark还要自己单独搞一套spark repl，这其中的缘由到底何在？...

分类：其他好文时间：2014-07-07 21:40:04 阅读次数：367

Apache Spark源码走读之13 -- hiveql on spark实现详解

欢迎转载，转载请注明出处，徽沪一郎概要在新近发布的spark 1.0中新加了sql的模块，更为引人注意的是对hive中的hiveql也提供了良好的支持，作为一个源码分析控，了解一下spark是如何完成对hql的支持是一件非常有趣的事情。Hive简介Hive的由来以下部分摘自Hadoop defini...

分类：其他好文时间：2014-07-07 14:45:58 阅读次数：224

Apache Spark源码走读之4 -- DStream实时流数据处理

欢迎转载，转载请注明出处，徽沪一郎。Spark Streaming能够对流数据进行近乎实时的速度进行数据处理。采用了不同于一般的流式数据处理模型，该模型使得Spark Streaming有非常高的处理速度，与storm相比拥有更高的吞能力。本篇简要分析Spark Streaming的处理模型，Spa...

分类：其他好文时间：2014-07-07 14:44:43 阅读次数：213

Apache Spark源码走读之5 -- DStream处理的容错性分析

欢迎转载，转载请注明出处，徽沪一郎，谢谢。在流数据的处理过程中，为了保证处理结果的可信度(不能多算，也不能漏算)，需要做到对所有的输入数据有且仅有一次处理。在Spark Streaming的处理机制中，不能多算，比较容易理解。那么它又是如何作到即使数据处理结点被重启，在重启之后这些数据也会被再次处理...

分类：其他好文时间：2014-07-07 14:36:48 阅读次数：275

Hive2MySQL初步架构

一个Hive向MySQL导出框架...

分类：数据库时间：2014-06-30 09:30:07 阅读次数：272

Hive的安装与使用

hive是一个SQL解析引擎，可以在hive中创建表，执行sql语句。创建的表是存储在hdfs中，执行的sql语句是通过MapReduce执行的。可以通过执行sql语句来代替编写MapReduce作业，太方便了！1.解压缩、设置环境hive使用的版本是hive-0.9.0.tar.gz。我们在/.....

分类：其他好文时间：2014-06-27 19:59:49 阅读次数：179

hive 采用JDBC编码方式获取外部分区表数据

由于最近项目的需求，仔细研究了下采用hive JDBC编码的方式来实现命令行模式执行hql语句的功能。期间遇到了不少问题，并一一进行了分析解决。但是时间匆忙，本人并未能将遇到的问题逐一记录在案。凭借零零稀稀的记忆希望将这些问题和经验进行总结以备后用。项目中有个需求就是实现通过hql条件查询语句查....

分类：数据库时间：2014-06-27 19:26:52 阅读次数：275

hive-hbase-handler方式导入hive表数据到hbase表中

Hive与HBase的整合功能的实现是利用两者本身对外的API接口互相进行通信，相互通信主要是依靠hive-hbase-handler.jar工具类；hive-hbase-handler.jar在hive的lib包中而不是在hbase的lib中，hive0.6版本以后；创建hive表的同时创建hb...

分类：其他好文时间：2014-06-27 14:06:14 阅读次数：288

Spark SQL Hive Support Demo

前提：1、spark1.0的包编译时指定支持hive：./make-distribution.sh --hadoop 2.3.0-cdh5.0.0 --with-yarn--with-hive--tgz2、安装完spark1.0；3、安装与hadoop对应的CDH版本的hive；Spark SQL ...

分类：数据库时间：2014-06-26 11:24:11 阅读次数：564

hive 常用命令

1、查看表结构信息 desc formatted table_name; desc table_name; 查看关联文件： desc extended f_tblog_online_mds; 2、查看分区 show partitions table_name; 3、根据分区查询，提高速度 select table_coulm from table_name whe...

分类：其他好文时间：2014-06-26 08:09:25 阅读次数：261

共12366条上一页 1 ... 1219 1220 1221 1222 1223 ... 1237 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)