Kudu、ClickHouse、Doris、Druid、Hbase_doris hbase
私有资源;
横向扩展;
Shared Nothing架构。
- 属于MPP架构的数据库
- Druid
- Doris
- ClickHouse
- Greenplum
主要进行OLAP多维分析
- Kudu和Hbase
都属于列式存储的数据库,架构上,Hbase使用HDFS存储,Kudu使用自己的方式进行存储,性能更好。
Kudu和Hbase区别 - ClickHose
clickHouse介绍 - Kudu和Hbase和ClickHouse区别
三者区别 - Doris
Doris介绍
实时数仓:
1.数据存储:
数据存储采用什么存储介质,主要取决于数据在哪些应用场景,主要方案有:
Kafka、HDFS、Kudu、 Clickhouse、Hbase
2. 数据计算
计算层主要使用 Flink、Spark、Presto 以及 ClickHouse 自带的计算能力等四种计算引擎,Flink 计算引擎主要用于实时数据同步、 流式 ETL、关键系统秒级实时指标计算场景,Spark SQL 主要用于复杂多维分析的准实时指标计算需求场景,Presto 和 ClickHouse 主要满足多维自助分析、对查询响应时间要求不太高的场景。
3.app层
面向实时数据场景需求构建的高度汇总层,可以根据不同的数据应用场景决定使用存储介质或者引擎;例如面向业务历史明细、BI 支持等 Olap 分析场景,可以使用 Druid、Greenplum,面向实时监控大屏、高并发汇总指标等需求,可以使用 KV 模式的 HBase;数据量较小的时候, 也可以使用 Mysql 来进行存储。
自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。
深知大多数大数据工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!
因此收集整理了一份《2024年大数据全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友。





既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上大数据开发知识点,真正体系化!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新
如果你觉得这些内容对你有帮助,可以添加VX:vip204888 (备注大数据获取)

vip204888 (备注大数据获取)**
[外链图片转存中…(img-25jJpVve-1712851450563)]
更多推荐

所有评论(0)