码迷,mamicode.com
首页 > 其他好文 > 详细

Spark Streaming的工作机制

时间:2018-10-14 14:15:29      阅读:206      评论:0      收藏:0      [点我收藏+]

标签:park   吞吐量   tcp   获取   存储   win   map   spark   取数   

 1. Spark Streaming的工作机制

     Spark Streaming 是Spark核心API的一个扩展,可以实现高吞吐量的、具备容错机制的实时流数据的处理。

     支持从多种数据源获取数据,包括Kafk、Flume、Twitter、ZeroMQ、Kinesis 以及TCP sockets,

     从数据源获取数据之后,可以使用诸如map、reduce、join和window等高级函数进行复杂算法的处理。

     最后还可以将处理结果存储到文件系统,数据库和现场仪表盘。

 技术分享图片

2.编写Spark Streaming程序的基本步骤:

 

     技术分享图片

      技术分享图片

技术分享图片

 

Spark Streaming的工作机制

标签:park   吞吐量   tcp   获取   存储   win   map   spark   取数   

原文地址:https://www.cnblogs.com/sevenyang/p/9785438.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!