一 、 Hadoop 集群架构设计 二 、 搭建集群 修改IP地址与hostname以及部署zookeeper、hadoop见上一篇博文《Hadoop 完全分布式搭建》。 三 、修改配置文件 修改nna上的core-site.xml <configuration> <!-- 指定hdfs的names ...
                            
                            
                                分类:
其他好文   时间:
2021-01-19 12:16:24   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    前言: 端口号:21881 ZooKeeper是一个分布式的,开放源码的分布式应用程序协调服务,是Google的Chubby一个开源的实现,是Hadoop和Hbase的重要组件。它是一个为分布式应用提供一致性服务的软件,提供的功能包括:配置维护、域名服务、分布式同步、组服务等。 本质:主要作用是注册 ...
                            
                            
                                分类:
其他好文   时间:
2021-01-19 12:08:39   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    文章目录 5.1 HBase简介 什么是HBase BigTable 面向列的数据库 什么是非结构化数据存储 HBase在Hadoop生态中的地位 HBase与HDFS HBase使用场景 5.1 HBase简介 1 什么是HBase HBase是一个分布式的、面向列的开源数据库 HBase是Goo ...
                            
                            
                                分类:
数据库   时间:
2021-01-19 12:02:43   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    我们学习hadoop,最常见的编程是编写mapreduce程序,但是,有时候我们也会利用java程序做一些常见的hdfs操作。比如删除一个目录,新建一个文件,从本地上传一个文件到hdfs等,甚至是追加内容到hdfs文件中。 这里介绍一些常见的hdfs操作的java示例,帮助我们加深对hdfs的理解。 ...
                            
                            
                                分类:
编程语言   时间:
2021-01-19 11:58:35   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                # 先定义dataframe各列的数据类型 from pyspark.sql.types import *schema = StructType([ StructField("a", NullType(), True), StructField("b", AtomicType(), True), S ...
                            
                            
                                分类:
其他好文   时间:
2021-01-18 11:29:36   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    1. 设置执行引擎 set hive.execution.engine=mr;set hive.execution.engine=spark; 如果设置执行引擎为MR,那么调用Hadoop的maprecude来运行需要执行的job的程序; 如果设置执行引擎为spark,那么就会调用spark来执行任 ...
                            
                            
                                分类:
其他好文   时间:
2021-01-15 12:15:21   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    解决Hadoop HA集群 NameNode 无法自动故障转移(切换active) 在学习 HA 自动化配置,按照hadoop官网:https://hadoop.apache.org/docs/stable/hadoop-project-dist/hadoop-hdfs/HDFSHighAvaila ...
                            
                            
                                分类:
其他好文   时间:
2021-01-15 12:13:12   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                虚拟机克隆 a. vim /etc/udev/rules.d/70-persistent-net.rules 更改网卡名 b. vim /etc/sysconfig/network-scripts/ifcfg-eth0 更新网卡 c. vim /etc/sysconfig/network 更改主机名 ...
                            
                            
                                分类:
其他好文   时间:
2021-01-12 10:50:26   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                搭建在单一服务器 基于官方文档 http://hadoop.apache.org/docs/r2.7.2/hadoop-project-dist/hadoop-common/SingleCluster.html#Pseudo-Distributed_Operation 1、配置:hadoop-env ...
                            
                            
                                分类:
其他好文   时间:
2021-01-11 11:23:14   
                                阅读次数:
0
                             
                    
                        
                            
                            
                                
                    概述:Spark 程序开发,调试和运行,intellij idea开发Spark java程序。分两部分,第一部分基于intellij idea开发Spark实例程序并在intellij IDEA中运行Spark程序.第二部分,将开发程序提交到Spark local或者hadoop YARN集群运行 ...
                            
                            
                                分类:
编程语言   时间:
2021-01-08 10:56:23   
                                阅读次数:
0