搜索关键字：hadoop yarn，搜索到15103个结果！码迷,mamicode.com！

为什么要使用Spark？

现有的hadoop生态系统中存在的问题1）使用mapreduce进行批量离线分析；2）使用hive进行历史数据的分析；3）使用hbase进行实时数据的查询；4）使用storm进行实时的流处理；5）。。。。。。导致：维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷，使用spar...

分类：其他好文时间：2014-06-28 14:08:46 阅读次数：306

Spark Standalone模式环境搭建

前提：安装好jdk1.7，hadoop安装步骤：1、安装scala下载地址：http://www.scala-lang.org/download/配置环境变量：export SCALA_HOME=/..../scalaexport PATH=.:$SCALA_HOME/bin ....验证：sca....

分类：其他好文时间：2014-06-28 14:08:09 阅读次数：404

Hadoop与HBase中遇到的问题

1. Hadoop中遇到的问题曾经所遇到的问题因为没有记录,所以忘了(1)NameNode没有启动成功, 是因为你对HDFS多次格式化,导致datanode中与namenode中的VERSION文件里的namespaceID不一致(对于NameNode节点,该文件位于hdfs-site配置文件里df...

分类：其他好文时间：2014-06-28 12:47:08 阅读次数：394

Hadoop技术内幕——Hadoop配置信息处理

配置系统是复杂软件必不可少的一部分，org.apache.hadoop.conf.Configuration在Hadooop各个子项目中发挥着重要作用。 windows系统广泛使用一种特殊批的ASCII文件.ini作为其主要配置文件标准，被称为（Initialization File）或概要文...

分类：其他好文时间：2014-06-24 09:11:43 阅读次数：248

HBase的常用Java API

1. 创建HBase表的对象HBase表的对项名字叫HTable，创建它的方法有很多，常见的有如下：org.apache.hadoop.hbase.client.HTable hTable = new HTable(org.apache.hadoop.hbase.HBaseConfiguration...

分类：编程语言时间：2014-06-23 08:32:23 阅读次数：386

hadoop家族之mahout安装

步骤一、下载mahout http://www.apache.org/dyn/closer.cgi/mahout/我下载的是mahout-distribution-0.9.tar.gz 16-Feb-2014 08:31 66M 步骤二、下载完成后放到Linux中并解压解压命令：tar -zxvf ...

分类：其他好文时间：2014-06-20 21:09:06 阅读次数：178

二、Ubuntu14.04下安装Hadoop2.4.0 （伪分布模式）

在Ubuntu14.04下安装Hadoop2.4.0 （单机模式）基础上配置一、配置core-site.xml/usr/local/hadoop/etc/hadoop/core-site.xml 包含了hadoop启动时的配置信息。编辑器中打开此文件sudo gedit /usr/local/had...

分类：其他好文时间：2014-06-20 20:25:13 阅读次数：270

安装hadoop2.4.0遇到的问题

一、执行start-dfs.sh后，datenode没有启动查看日志如下： 2014-06-18 20:34:59,622 FATAL org.apache.hadoop.hdfs.server.datanode.DataNode: Initialization failed for bloc.....

分类：其他好文时间：2014-06-20 19:51:18 阅读次数：160

Hadoop学习资料整理

hadoop 0.18文档（详细介绍Hadoop，MapReduce，FS Shell，Streaming等）hadoop资料汇总（XX搜集的，还没看）streaming（非java程序员的福音）Hadoop Streaming编程实例Hadoop Streaming编程Hadoop Streami...

分类：其他好文时间：2014-06-20 18:33:43 阅读次数：160

开源日志系统比较：scribe、chukwa、kafka、flume

1. 背景介绍许多公司的平台每天会产生大量的日志（一般为流式数据，如，搜索引擎的pv，查询等），处理这些日志需要特定的日志系统，一般而言，这些系统需要具有以下特征：（1）构建应用系统和分析系统的桥梁，并将它们之间的关联解耦；（2）支持近实时的在线分析系统和类似于Hadoop之类的离线分析系统；（...

分类：其他好文时间：2014-06-20 16:18:14 阅读次数：294

共15103条上一页 1 ... 1468 1469 1470 1471 1472 ... 1511 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)