赞
踩
本博客内容出自尚硅谷b站公开课,如有侵权,请联系博主删除
在之前介绍实时数仓概念时讨论过,建设实时数仓的目的,主要是增加数据计算的复用性。每次新增加统计需求时,不至于从原始数据进行计算,而是从半成品继续加工而成。
我们这里从 Kafka 的 ODS 层读取用户行为日志以及业务数据,并进行简单处理,写回到 Kafka 作为 DWD 层。
分层 | 数据描述 | 生成计算工具 | 存储媒介 |
---|---|---|---|
ODS | 原始数据,日志和业务数据 | 日志服务器,FlinkCDC | Kafka |
DWD | 根据数据对象为单位进行分流,比如订单、页面访问等等。 | Flink | Kafka |
DWM | 对于部分数据对象进行进一步加工,比如独立访问、跳出行为。依旧是明细数据。 | Flink | Kafka |
DIM | 维度数据 | Flink | HBase |
DWS | 根据某个维 |
Copyright © 2003-2013 www.wpsshop.cn 版权所有,并保留所有权利。