码迷,mamicode.com
首页 >  
搜索关键字:kafka 集群 大数据    ( 36201个结果
2014年书单
计划:1. 番茄工作法图解:简单易行的时间管理方法 (完成)2. 大数据:互联网大规模数据挖掘与分布式处理3. 量化:大数据时代的企业管理5. 黑客与画家:来自计算机时代的高见 6. 倾听的力量:如何掌握沟通中的关键商业技巧 7. 失控 凯文·凯利8. 罗辑思维 罗振宇9. 说服力让你...
分类:其他好文   时间:2014-05-10 00:36:52    阅读次数:289
LVS 负载均衡解决方案 (windows IIS)
LVS 负载均衡解决方案 因为我们的产品运行的主流平台是WINDOWS+IIS+SQLSERVER(2000以上版本),而LVS+KEEPALIVED是LINUX下的四层负载均衡软件。其有如下特点: LVS集群采用IP负载均衡技术和基于内容请求分发技术。调度器具有很好的吞吐率(在DR模式下),将请....
分类:Windows程序   时间:2014-05-10 00:09:45    阅读次数:676
Linux下SSH免密码登录(转)
搭建hadoop集群的时候一定会用到的就是SSH免密码登录[hadoop@hadoop1 ~]$ ssh-keygen -t rsaGenerating public/private rsa key pair.Enter file in which to save the key (/home/ha...
分类:系统相关   时间:2014-05-09 23:10:11    阅读次数:471
在Form域中Post大于100K的数据
在Form域中Post大于100K的数据 当表单发送的数据量很大时,就会报错。查阅MSDN了解到,原因是微软对用Request.Form()可接收的最大数据有限制,IIS4中为80K字节,IIS5中为100K字节。   下面是微软提供的几个解决方法: 1、用Request.BinaryRead 代替 Request.Form方法 来解析表单数据; 2、使用文件上传方案,比如:Microso...
分类:其他好文   时间:2014-05-09 22:13:58    阅读次数:348
Hive ERROR: Out of memory due to hash maps used in map-side aggregation
当hive在执行大数据量的统计查询语句时,经常会出现下面OOM错误,具体错误提示如下: Possible error: Out of memory due to hash maps used in map-side aggregation. Solution: Currently hive.map.aggr.hash.percentmemory is set to 0.5. Try set...
分类:其他好文   时间:2014-05-09 21:08:27    阅读次数:366
大数据:互联网大规模数据挖掘与分布式处理 电子书 PDF 下载 制作 定制 服务
大数据 大规模 数据挖掘 分布式处理
分类:其他好文   时间:2014-05-09 15:43:11    阅读次数:249
数据挖掘:概念与技术(原书第3版) 电子书 PDF 下载 制作 定制 服务
Hadoop大数据处理
分类:其他好文   时间:2014-05-09 15:42:46    阅读次数:315
【甘道夫】Win7环境下Eclipse连接Hadoop2.2.0
准备: 确保hadoop2.2.0集群正常运行 1.eclipse中建立java工程,导入hadoop2.2.0相关jar包 2.在src根目录下拷入log4j.properties,通过log4j查看详细日志 log4j.rootLogger=debug, stdout, R log4j.appender.stdout=org.apache....
分类:Windows程序   时间:2014-05-09 15:03:44    阅读次数:689
Linux双网卡绑定
一、概念Linux双网卡绑定实现就是使用两块网卡虚拟成为一块网卡,这个聚合起来的设备看起来是一个单独的以太网接口设备,通俗点讲就是两块网卡具有相同的IP地址而并行链接聚合成一个逻辑链路工作。在Linux的2.4.x的内核中采用bonding技术实现。bonding技术的最早应用是在集群—..
分类:系统相关   时间:2014-05-09 14:19:40    阅读次数:345
Hadoop-2.2.0中文文档—— MapReduce 下一代--容量调度器
目的 这份文档描述 CapacityScheduler,一个为Hadoop能允许多用户安全地共享一个大集群的插件式调度器,如他们的应用能适时被分配限制的容量。 概述 CapacityScheduler 被设计成以分享的、多用户集群运行 Hadoop 应用并最大化利用集群的机制。 传统上,每一个组织都会有它自己的私有电脑资源,在顶峰或接近顶峰状态有充足的容量来面对组织的SLA...
分类:其他好文   时间:2014-05-09 13:59:54    阅读次数:424
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!