码迷,mamicode.com
首页 >  
搜索关键字:flume spark sparkflumeprotocol    ( 7976个结果
数据写入文本文件并读出到浏览器的PHP代码
gwbjx123 Item Quantity Tires oil Spark Plugs Address 以下是PHP文件:eg1.php"; $fp = fopen("egtext.txt","ab");//a是追加 fl...
分类:Web程序   时间:2014-06-28 23:53:40    阅读次数:409
Spark Streaming之旅
1. 打开spark-shell2. 建立StreamingContextimport org.apache.spark.streaming._import org.apache.spark.streaming.StreamingContext._import org.apache.spark.ap...
分类:其他好文   时间:2014-06-28 23:07:17    阅读次数:324
[Apache Spark源码阅读]天堂之门——SparkContext解析
稍微了解Spark源码的人应该都知道SparkContext,作为整个Project的程序入口,其重要性不言而喻,许多大牛也在源码分析的文章中对其做了很多相关的深入分析和解读。这里,结合自己前段时间的阅读体会,与大家共同讨论学习一下Spark的入口对象—天堂之门—SparkContex。SparkC...
分类:其他好文   时间:2014-06-28 19:27:40    阅读次数:338
为什么要使用Spark?
现有的hadoop生态系统中存在的问题1)使用mapreduce进行批量离线分析;2)使用hive进行历史数据的分析;3)使用hbase进行实时数据的查询;4)使用storm进行实时的流处理;5)。。。。。。导致:维护成本高、学习成本高Spark的出现弥补了Hadoop生态系统中的缺陷,使用spar...
分类:其他好文   时间:2014-06-28 14:08:46    阅读次数:306
Spark Standalone模式环境搭建
前提:安装好jdk1.7,hadoop安装步骤:1、安装scala下载地址:http://www.scala-lang.org/download/配置环境变量:export SCALA_HOME=/..../scalaexport PATH=.:$SCALA_HOME/bin ....验证:sca....
分类:其他好文   时间:2014-06-28 14:08:09    阅读次数:404
Spark源码系列(三)作业运行过程
导读看这篇文章的时候,最好是能够跟着代码一起看,我是边看代码边写的,所以这篇文章的前进过程也就是我看代码的推进过程。作业执行上一章讲了RDD的转换,但是没讲作业的运行,它和Driver Program的关系是啥,和RDD的关系是啥?官方给的例子里面,一执行collect方法就能出结果,那我们就从co...
分类:其他好文   时间:2014-06-28 13:54:31    阅读次数:257
Flume监听文件目录sink至hdfs配置
一:flume介绍 Flume是一个分布式、可靠、和高可用的海量日志聚合的系统,支持在系统中定制各类数据发送方,用于收集数据;同时,Flume提供对数据进行简单处理,并写到各种数据接受方(可定制)的能力。,Flume架构分为三个部分 源-Source,接收器-Sink,通道-Channel。二:配置...
分类:其他好文   时间:2014-06-21 08:59:50    阅读次数:245
Flume概述和简单实例
##Flume概述[Flume](http://flume.apache.org/)是一个分布式、可靠、和高可用的海量日志采集、聚合和传输的系统。支持在日志系统中定制各类数据发送方,用于收集数据;同时,Flume提供对数据进行简单处理,并写到各种数据接受方(比如文本、HDFS、Hbase等)的能力 ...
分类:其他好文   时间:2014-06-20 22:18:57    阅读次数:309
HAProxy + Keepalived + Flume 构建高性能高可用分布式日志系统
一、HAProxy简介 HAProxy提供高可用性、负载均衡以及基于TCP和HTTP应用的代 理,支持虚拟主机,它是免费、快速并且可靠的一种解决方案。HAProxy特别适用于那些负载特大的web站点,这些站点通常又需要会话保持或七层处理。 HAProxy运行在当前的硬件上,完全可以支持数以万计的并发...
分类:其他好文   时间:2014-06-20 15:54:21    阅读次数:196
Spark运行调试方法与学习资源汇总
最近,在学习和使用Spark的过程中,遇到了一些莫名其妙的错误和问题,在逐个解决的过程中,体会到有必要对解决上述问题的方法进行总结,以便能够在短时间内尽快发现问题来源并解决问题,现与各位看官探讨学习如下:解决spark运行调试问题的四把“尖刀”:1、Log包括控制台日志、主从节点日志、HDFS日志等...
分类:其他好文   时间:2014-06-20 15:16:41    阅读次数:161
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!