码迷,mamicode.com
首页 >  
搜索关键字:大数据 hadoop ccah ccdh 培训    ( 31278个结果
Hadoop使用实例
1.词频统计 a.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 b.编写map与reduce函数 c.本地测试map和reduce d.将文本数据上传到HDFS上 e.用hadoop streaming提交任务 f.查看运行结果 g.计算结果取回本地 ...
分类:其他好文   时间:2020-11-07 16:36:45    阅读次数:33
Hadoop使用实例
1.下载喜欢的电子书或大量文本数据,并保存在本地文件夹中 2.编写map与reduce函数 3.本地测试map与reduce 4.将文本数据上传至HDFS上 5.用hadoop streaming提交任务 6.查看运行结果 7.计算结果取回到本地 ...
分类:其他好文   时间:2020-11-07 16:32:22    阅读次数:17
Hadoop实例
1.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 2编写map与reduce函数 3本地测试map与reduce 4将文本数据上传至HDFS上 5.用hadoop streaming提交任务 6.查看运行结果 7.计算结果取回到本地 ...
分类:其他好文   时间:2020-11-07 16:17:20    阅读次数:18
机器学习平台痛点与模型提升方法:基于Spark的机器学习平台在点融网风控应用介绍
机器学习平台痛点与模型提升方法:基于Spark的机器学习平台在点融网风控应用介绍编者按:大数据和机器学习是近年来快速增长的热门领域,各个领域的数据量和数据规模都以惊人的速度增长。本文是近期举行的架构实践日点融网刘利就“机器学习平台在点融网业务的应用介绍”这一话题的精彩分享。作者简介:刘利,点融网DataScientistTeam负责人,从事互联网数据分析和数据挖掘近十年。现任点融网DataScie
分类:其他好文   时间:2020-11-07 15:58:21    阅读次数:20
css与javascript重难点,学前端,基础不好一切白费!
JavaScript是一种属于网络的脚本语言,已经被广泛用于Web应用开发,常用来为网页添加各式各样的动态功能,为用户提供更流畅美观的浏览效果。通常JavaScript脚本是通过嵌入在HTML中来实现自身的功能的。 ...
分类:编程语言   时间:2020-11-07 15:47:31    阅读次数:13
微博广告Hubble系统:秒级大规模分布式智能监控平台架构实践
微博广告Hubble系统:秒级大规模分布式智能监控平台架构实践关键词:微博广告Hubble监控平台D+大数据机器学习LSTMTensorflow业务背景Hubble(哈勃,其含义是数据如浩瀚宇宙之大,Hubble如太空望远镜,能窥见璀璨的星辰,发现数据的真正价值)平台定位为微博广告智能全景监控、数据透视和商业洞察。计算广告系统是集智能流量分发、投放、结算、CTR预估、客户关系管理等为一体的大型互联
分类:其他好文   时间:2020-11-07 15:41:51    阅读次数:19
创业过5家大数据公司,Kaggle竞赛冠军:互联网深度学习误区—花大力气在那些影响力很小的事情上
创业过5家大数据公司,Kaggle竞赛冠军:互联网深度学习误区—花大力气在那些影响力很小的事情上本文作者:GregoryPiatetsky,KDnuggets.我对有着“摇滚明星”美誉的数据科学家杰里米·霍华德进行了独家采访,他谈到了自己最新出品的深度学习网络课程,Kaggle因何获得行业领先地位,以及数据科学家的价值所在。杰里米·霍华德(@jeremyphoward),是数据科学领域的“摇滚明星
分类:其他好文   时间:2020-11-07 15:39:15    阅读次数:23
TXT格式文件插入Hbase
将.txt格式文件插入Hbase中,代码如下 package addHbase; import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.hbase.HBaseConfiguration; import org.ap ...
分类:其他好文   时间:2020-11-06 02:49:19    阅读次数:37
Flink从入门到真香(Flink介绍)
关于概念的东西,其实官网说的很全,对于个人理解就是,flink、spark等等大数据处理平台就是把原来需要我们自己实现的功能,全部框架封装好,像是跨机器的大规模计算、内存/cpu等等资源管理、状态管理(锁还有恢复机制等等)框架全部封装好了,作为开发来说就只需要关心自己要实现的业务就可以了以下内容来自官网,从3个方面介绍Flink:架构ApacheFlink是一个框架和分布式处理引擎,用于在无边界和
分类:其他好文   时间:2020-11-06 02:27:17    阅读次数:21
Flink从入门到真香(1-分别使用流模式和批模式运行第一个demo)
基本概念部分,批处理和流处理的区别批处理在大数据世界有着悠久的历史,比较典型的就是spark。批处理主要操作大容量静态数据集,并在计算过程完成后返回结果。批处理模式中使用的数据集通常符合下列特征:(1)有界:批处理数据集代表数据的有限集合(2)持久:数据通常始终存储在某种类型的持久存储位置中(3)大量:批处理操作通常是处理极为海量数据集的唯一方法批处理非常适合需要访问全套记录才能完成的计算工作。例
分类:其他好文   时间:2020-11-06 02:26:18    阅读次数:29
31278条   上一页 1 ... 30 31 32 33 34 ... 3128 下一页
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!