首页
Web开发
Windows程序
编程语言
数据库
移动开发
系统相关
微信
其他好文
会员
首页
>
其他好文
> 详细
hadoop大数据研发平台
时间:
2018-06-08 12:09:20
阅读:
155
评论:
0
收藏:
0
[点我收藏+]
标签:
Hadoop
平台
大数据
一.开发平台:
?Hadoop是Apache软件基金会旗下的一个开源分布式计算平台
?以分布式文件系统(Hadoop Distributed File Syste, HDFS)和MapReduce为核心的Hadoop为用户提供了系统底层细节透明分布式基础架构
?HDFS的高容错、高伸缩的优点允许用户将Hadoop部署在低廉的硬件上
?MapReduce则允许用户在不了解分布式系统底层细节的情况下开发并行应用程序
二.优势:
?高可靠性 ---因为Hadoop假设计算元素和存储会出现故障,因为它维护多个工作数据副本,在出现故障时可以对失败的节点重新分布处理
?高扩展性 --- 在集群间分配任务数据,可方便的扩展数以千计的节点
?高效性 ---在MapReduce的思想下,Hadoop是并行工作的,以加快任务处理速度
?高容错性 --- 自动保存多份副本数据,并且能够自动将失败的任务重新分配
三.应用及发展趋势:
?Yahoo :通过集群运行Hadoop,以支持广告系统和Web搜索
?FaceBook: (Hive贡献者)借助Hadoop来支持其数据分析和机器学习
?淘宝:国内使用Hadoop最深入的公司,整个淘宝和阿里都是数据驱动的
?华为:云计算平台
?优酷:日志分析、推荐等
?奇虎360:存储软件管家中的软件,日志分析和数据挖掘
?百度: 国内使用Hadoop最早的公司,存储、日志分析、推荐、机器学习等
hadoop大数据研发平台
标签:
Hadoop
平台
大数据
原文地址:http://blog.51cto.com/13792382/2126250
踩
(
0
)
赞
(
0
)
举报
评论
一句话评论(
0
)
登录后才能评论!
分享档案
更多>
2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)
周排行
更多
分布式事务
2021-07-29
OpenStack云平台命令行登录账户
2021-07-29
getLastRowNum()与getLastCellNum()/getPhysicalNumberOfRows()与getPhysicalNumberOfCells()
2021-07-29
【K8s概念】CSI 卷克隆
2021-07-29
vue3.0使用ant-design-vue进行按需加载原来这么简单
2021-07-29
stack栈
2021-07-29
抽奖动画 - 大转盘抽奖
2021-07-29
PPT写作技巧
2021-07-29
003-核心技术-IO模型-NIO-基于NIO群聊示例
2021-07-29
Bootstrap组件2
2021-07-29
友情链接
兰亭集智
国之画
百度统计
站长统计
阿里云
chrome插件
新版天听网
关于我们
-
联系我们
-
留言反馈
© 2014
mamicode.com
版权所有 联系我们:gaon5@hotmail.com
迷上了代码!