MapReduce服务 MRS-Flink任务开发建议:中小规模数据量维度表可以采用内存维度表(如Hudi)
时间:2025-02-12 15:03:27
中小规模数据量维度表可以采用内存维度表(如Hudi)
- 内存维度表:将维度数据加载到内存当中,每个TM都会加载全量的数据,在内存内实现数据点查关联。若数据量过大,需要给TM分配大的内存空间,否则容易导致作业异常。
- 外置维度表:将维度数据存在高速的K-V数据库中,通过远程的K-V查询实现点查关联,常用的开源K-V库有HBase。
- 状态维度表:将维度表数据当做流表,实时读入到流式作业当中,通过数据的回撤流能力实现维度更新和数据不对齐场景下的数据一致性保证。维度表保存时间比较长,当前Flink on Hudi能力可以针对Hudi作为维度表单独设置TTL时长。
维度 |
内存维度表(hive/hudi表) |
外置维度表(HBase) |
状态维度表 |
---|---|---|---|
性能 |
非常高(毫秒内) |
中(毫秒级) |
高(毫秒内~毫秒级) |
数据量 |
小,建议单个TM保持1GB以内 |
大,TB级 |
中,GB级 |
存储资源 |
内存消耗大,单个TM全量存储 |
外置存储,无存储资源消耗 |
各TM分散存储,内存+磁盘存储 |
时效性 |
周期性数据加载,时效低 |
相对高 |
高 |
关联数据结果 |
低 |
中 |
- |
support.huaweicloud.com/devg-rule-mrs/mrs_07_450167.html
看了此文的人还看了
CDN加速
GaussDB
文字转换成语音
免费的服务器
如何创建网站
域名网站购买
私有云桌面
云主机哪个好
域名怎么备案
手机云电脑
SSL证书申请
云点播服务器
免费OCR是什么
电脑云桌面
域名备案怎么弄
语音转文字
文字图片识别
云桌面是什么
网址安全检测
网站建设搭建
国外CDN加速
SSL免费证书申请
短信批量发送
图片OCR识别
云数据库MySQL
个人域名购买
录音转文字
扫描图片识别文字
OCR图片识别
行驶证识别
虚拟电话号码
电话呼叫中心软件
怎么制作一个网站
Email注册网站
华为VNC
图像文字识别
企业网站制作
个人网站搭建
华为云计算
免费租用云托管
云桌面云服务器
ocr文字识别免费版
HTTPS证书申请
图片文字识别转换
国外域名注册商
使用免费虚拟主机
云电脑主机多少钱
鲲鹏云手机
短信验证码平台
OCR图片文字识别
SSL证书是什么
申请企业邮箱步骤
免费的企业用邮箱
云免流搭建教程
域名价格
推荐文章
- MapReduce服务_什么是HetuEngine_如何使用HetuEngine
- MapReduce工作原理_MapReduce是什么意思_MapReduce流程_MRS_华为云
- MapReduce服务_什么是存算分离_如何配置MRS集群存算分离
- Hudi服务_什么是Hudi_如何使用Hudi
- 什么是Spark_如何使用Spark_Spark的功能是什么
- 大数据分析是什么_使用MapReduce_创建MRS服务
- MRS优势_什么是MRS_MRS功能
- MapReduce服务_什么是Yarn_如何使用Yarn
- 大数据可视化平台是什么_大数据可视化平台有什么优势
- MapReduce服务_如何使用MapReduce服务_MRS集群客户端安装与使用
ServerLess102