大数据教育平台数仓实时计算实现 附安装包与脚本

阅读: 评论:0

大数据教育平台数仓实时计算实现 附安装包与脚本

大数据教育平台数仓实时计算实现 附安装包与脚本

一、Spark Streaming

Spark Streaming 是核心Spark API的扩展,可实现实时数据的可扩展,高吞吐量,容错处理。数据可以从许多来源(如Kafka,Flume,Kinesis,或TCP套接字)中获取,并可以使用高级函数进行处理,处理完后的数据可以推送到文件系统,数据库和实时仪表板。

在内部,他的工作原理如下,Spark Streaming接收实时输入数据流并将数据分成批处理,然后由Spark引擎处理以批处理生成最终结果流。 

二、实时项目需求架构设计

1、项目需求分析

  • 数据采集平台搭建
  • Kafka、Zookeeper中间件准备
  • 下游Spark Streaming对接Kafka接收数据,实现vip个数统计、栏目打标签功能、做题正确率与掌握度的实时计算功能。

2、技术选型

  • 数据存储:Kafka、MySql
  • 数据处理:Spark

本文发布于:2024-01-28 15:45:30,感谢您对本站的认可!

本文链接:https://www.4u4v.net/it/17064279338497.html

版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系,我们将在24小时内删除。

标签:脚本   实时   安装包   数据   平台
留言与评论(共有 0 条评论)
   
验证码:

Copyright ©2019-2022 Comsenz Inc.Powered by ©

网站地图1 网站地图2 网站地图3 网站地图4 网站地图5 网站地图6 网站地图7 网站地图8 网站地图9 网站地图10 网站地图11 网站地图12 网站地图13 网站地图14 网站地图15 网站地图16 网站地图17 网站地图18 网站地图19 网站地图20 网站地图21 网站地图22/a> 网站地图23