1. 首页
  2. 数据库
  3. 其它
  4. Spark入门实战系列(上) 实时流计算SparkStreaming原理介绍

Spark入门实战系列(上) 实时流计算SparkStreaming原理介绍

上传者: 2021-02-01 15:08:05上传 PDF文件 527.43KB 热度 22次
SparkStreaming是Spark核心API的一个扩展,可以实现高吞吐量的、具备容错机制的实时流数据的处理。支持从多种数据源获取数据,包括Kafk、Flume、Twitter、ZeroMQ、Kinesis 以及TCPsockets,从数据源获取数据之后,可以使用诸如map、reduce、join和window等高级函数进行复杂算法的处理。最后还可以将处理结果存储到文件系统,数据库和现场仪表盘。在“One
下载地址
用户评论