搜索关键字：spark 大数据 hadoop spark-sql，搜索到29965个结果！码迷,mamicode.com！

[Apache Spark源码阅读]天堂之门——SparkContext解析

稍微了解Spark源码的人应该都知道SparkContext，作为整个Project的程序入口，其重要性不言而喻，许多大牛也在源码分析的文章中对其做了很多相关的深入分析和解读。这里，结合自己前段时间的阅读体会，与大家共同讨论学习一下Spark的入口对象—天堂之门—SparkContex。SparkC...

分类：其他好文时间：2014-06-28 19:27:40 阅读次数：338

2504（多项式求和）

明明很简单，我却错了N++遍，主要原因是在于自己，给自己测试数据时，忘了测大数据，因为只保留小数点后两位，而200以后的数都是0.69.#include #include #include #include using namespace std;int main(){ double a[10...

分类：其他好文时间：2014-06-28 17:00:57 阅读次数：174

为什么要使用Spark？

现有的hadoop生态系统中存在的问题1）使用mapreduce进行批量离线分析；2）使用hive进行历史数据的分析；3）使用hbase进行实时数据的查询；4）使用storm进行实时的流处理；5）。。。。。。导致：维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷，使用spar...

分类：其他好文时间：2014-06-28 14:08:46 阅读次数：306

Spark Standalone模式环境搭建

前提：安装好jdk1.7，hadoop安装步骤：1、安装scala下载地址：http://www.scala-lang.org/download/配置环境变量：export SCALA_HOME=/..../scalaexport PATH=.:$SCALA_HOME/bin ....验证：sca....

分类：其他好文时间：2014-06-28 14:08:09 阅读次数：404

hadoop家族之mahout安装

步骤一、下载mahout http://www.apache.org/dyn/closer.cgi/mahout/我下载的是mahout-distribution-0.9.tar.gz 16-Feb-2014 08:31 66M 步骤二、下载完成后放到Linux中并解压解压命令：tar -zxvf ...

分类：其他好文时间：2014-06-20 21:09:06 阅读次数：178

二、Ubuntu14.04下安装Hadoop2.4.0 （伪分布模式）

在Ubuntu14.04下安装Hadoop2.4.0 （单机模式）基础上配置一、配置core-site.xml/usr/local/hadoop/etc/hadoop/core-site.xml 包含了hadoop启动时的配置信息。编辑器中打开此文件sudo gedit /usr/local/had...

分类：其他好文时间：2014-06-20 20:25:13 阅读次数：270

安装hadoop2.4.0遇到的问题

一、执行start-dfs.sh后，datenode没有启动查看日志如下： 2014-06-18 20:34:59,622 FATAL org.apache.hadoop.hdfs.server.datanode.DataNode: Initialization failed for bloc.....

分类：其他好文时间：2014-06-20 19:51:18 阅读次数：160

Hadoop学习资料整理

hadoop 0.18文档（详细介绍Hadoop，MapReduce，FS Shell，Streaming等）hadoop资料汇总（XX搜集的，还没看）streaming（非java程序员的福音）Hadoop Streaming编程实例Hadoop Streaming编程Hadoop Streami...

分类：其他好文时间：2014-06-20 18:33:43 阅读次数：160

开源日志系统比较：scribe、chukwa、kafka、flume

1. 背景介绍许多公司的平台每天会产生大量的日志（一般为流式数据，如，搜索引擎的pv，查询等），处理这些日志需要特定的日志系统，一般而言，这些系统需要具有以下特征：（1）构建应用系统和分析系统的桥梁，并将它们之间的关联解耦；（2）支持近实时的在线分析系统和类似于Hadoop之类的离线分析系统；（...

分类：其他好文时间：2014-06-20 16:18:14 阅读次数：294

Spark运行调试方法与学习资源汇总

最近，在学习和使用Spark的过程中，遇到了一些莫名其妙的错误和问题，在逐个解决的过程中，体会到有必要对解决上述问题的方法进行总结，以便能够在短时间内尽快发现问题来源并解决问题，现与各位看官探讨学习如下：解决spark运行调试问题的四把“尖刀”：1、Log包括控制台日志、主从节点日志、HDFS日志等...

分类：其他好文时间：2014-06-20 15:16:41 阅读次数：161

共29965条上一页 1 ... 2933 2934 2935 2936 2937 ... 2997 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)