搜索_华为云

支持的大数据平台简介 - 对象存储服务 OBS

支持的大数据平台简介华为云大数据存算分离方案中，OBS支持与多种大数据平台对接，包括华为云MapReduce服务（MRS）、Cloudera CDH和Hortonworks HDP，满足用户业务的灵活诉求。华为云MapReduce服务（MRS）华为云MapReduce服务（

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据平台
对接大数据平台 - 对象存储服务 OBS

对接大数据平台支持的大数据平台简介华为云MRS对接OBS Cloudera CDH对接OBS Hortonworks HDP对接OBS 父主题：大数据场景下使用OBS实现存算分离

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离
支持的大数据组件简介 - 对象存储服务 OBS

支持的大数据组件简介在华为云大数据存算分离方案中，OBS除了可以与大数据平台对接外，还可以直接与开源的大数据组件对接。当前支持的大数据组件如下： Hadoop Hive Spark Flume DataX Druid Flink logstash 父主题：对接大数据组件

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
华为云MRS对接OBS - 对象存储服务 OBS

配置存算分离集群。详细操作，请参见使用委托方式配置存算分离集群。使用存算分离集群。详细操作，请参见使用存算分离集群。父主题：对接大数据平台

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据平台
Spark对接OBS - 对象存储服务 OBS
Spark对接OBS - 对象存储服务 OBS

apache.spark.examples.JavaWordCount obs://obs-bucket/input/test.txt 父主题：对接大数据组件

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Hadoop对接OBS - 对象存储服务 OBS

用于大规模数据处理和分析。OBS服务实现了Hadoop的HDFS协议，在大数据场景中可以替代Hadoop系统中的HDFS服务，实现Spark、MapReduce、Hive等大数据生态与OBS服务的对接，为大数据计算提供“数据湖”存储。 HDFS协议：Hadoop中定义了HDFS协

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
对接大数据组件 - 对象存储服务 OBS

对接大数据组件支持的大数据组件简介 Hadoop对接OBS Hive对接OBS Spark对接OBS Presto对接OBS Flume对接OBS DataX对接OBS Druid对接OBS Flink对接OBS Logstash对接OBS 父主题：大数据场景下使用OBS实现存算分离

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离
大数据场景下使用OBS实现存算分离方案概述 - 对象存储服务 OBS

大数据场景下使用OBS实现存算分离方案概述应用场景随着大数据技术的飞速发展，对数据价值的认识逐渐加深，大数据已经融入到了各行各业。根据相关调查报告数据显示，超过39.6%的企业正在应用大数据并从中获益；超过89.6%的企业已经成立或计划成立相关的大数据分析部门；超过六成的企业

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离
Hortonworks HDP对接OBS - 对象存储服务 OBS

1.1-hw-53.8.jar /usr/hdp/3.0.1.0-187/hive/auxlib 重启Hive集群。父主题：对接大数据平台

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据平台
DataX对接OBS - 对象存储服务 OBS
DataX对接OBS - 对象存储服务 OBS

Server、Oracle、PostgreSQL、HDFS、Hive、HBase、OTS、ODPS等各种异构数据源之间高效的数据同步功能。OBS在大数据场景中可以替代Hadoop系统中的HDFS服务，本文介绍DataX如何对接OBS。对接步骤下载datax源码，以发布版本datax_v202308为例：下载地址。

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Hive对接OBS - 对象存储服务 OBS
Hive对接OBS - 对象存储服务 OBS

Hive对接OBS 概述 Hive是一个数据仓库工具，可以对存储在分布式存储中的大规模数据进行数据提取、转化和加载，它提供了丰富的SQL查询方式来进行数据分析。前提条件已安装Hadoop，具体请参见Hadoop对接OBS。对接步骤以Hive 2.3.3为例。下载apache-hive-2

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Presto对接OBS - 对象存储服务 OBS

dinator（接受client的查询和管理查询执行）。 node-scheduler.include-coordinator:coordinator是否也作为work。对于大型集群来说，在coordinator里做worker的工作会影响查询性能。 http-server.http

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
迁移HDFS数据至OBS - 对象存储服务 OBS

迁移HDFS数据至OBS 操作场景在华为云大数据存算分离方案中，对象存储服务OBS作为统一数据湖存储数据。如果用户数据仍存储在本地HDFS中，则需要先将HDFS的数据迁移至OBS。用户可以使用以下迁移方案中的任意一种完成数据迁移，包括：Distcp方式迁移、CDM方式迁移和OMS方式迁移。

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离
Druid对接OBS - 对象存储服务 OBS
Druid对接OBS - 对象存储服务 OBS

Druid对接OBS 概述 Druid专为需要快速数据查询与摄入的工作流程而设计，在即时数据可见性、即席查询、运营分析以及高并发等方面表现非常出色。通过HDFS接口对接OBS，使用OBS提供的OBSA-HDFS工具，无需重新编译druid，将OBS配置为deep storage。

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
大数据场景下使用OBS实现存算分离 - 对象存储服务 OBS

大数据场景下使用OBS实现存算分离大数据场景下使用OBS实现存算分离方案概述操作流程对接大数据平台对接大数据组件迁移HDFS数据至OBS

帮助中心 > 对象存储服务 OBS > 最佳实践
Logstash对接OBS - 对象存储服务 OBS

开头）。执行以下命令，运行logstash。 bin/logstash -f ../conf/file2obs.conf 父主题：对接大数据组件

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Flink对接OBS - 对象存储服务 OBS
Flink对接OBS - 对象存储服务 OBS

withRollingPolicy(rollingPolicy) .withBucketCheckInterval(1000L) .build(); 父主题：对接大数据组件

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Flume对接OBS - 对象存储服务 OBS
Flume对接OBS - 对象存储服务 OBS

Flume对接OBS 概述 Flume是一个分布式的、可靠的和高可用的服务，用于收集、聚合以及移动大量日志数据，具体请参见Apache Flume。OBS在大数据场景中可以替代Hadoop系统中的HDFS服务。注意事项多sink写同一文件 OBS和HDFS在一致性保证上是有差别的：HDFS租约

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据组件
Cloudera CDH对接OBS - 对象存储服务 OBS

nt、impl等。 core-site.xml配置完成后“重启”Hive集群，再重启Hive集群的“部署客户端配置”。父主题：对接大数据平台

 帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离 > 对接大数据平台
操作流程 - 对象存储服务 OBS
操作流程 - 对象存储服务 OBS

操作流程大数据场景下使用OBS实现存算分离的操作流程如图1所示。图1 操作流程配置的核心是完成大数据平台与OBS对接，实现OBS作为大数据的统一数据湖存储。本文档提供三种主流大数据平台的对接指导，详情请参见支持的大数据平台简介。（可选）OBS除了可以与主流大数据平台对接外，

帮助中心 > 对象存储服务 OBS > 最佳实践 > 大数据场景下使用OBS实现存算分离

总条数： 651

上一页
1
2
3
4
5
...
33
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

支持的大数据平台简介 - 对象存储服务 OBS

对接大数据平台 - 对象存储服务 OBS

支持的大数据组件简介 - 对象存储服务 OBS

华为云MRS对接OBS - 对象存储服务 OBS

Spark对接OBS - 对象存储服务 OBS

Hadoop对接OBS - 对象存储服务 OBS

对接大数据组件 - 对象存储服务 OBS

大数据场景下使用OBS实现存算分离方案概述 - 对象存储服务 OBS

Hortonworks HDP对接OBS - 对象存储服务 OBS

DataX对接OBS - 对象存储服务 OBS

Hive对接OBS - 对象存储服务 OBS

Presto对接OBS - 对象存储服务 OBS

迁移HDFS数据至OBS - 对象存储服务 OBS

Druid对接OBS - 对象存储服务 OBS

大数据场景下使用OBS实现存算分离 - 对象存储服务 OBS

Logstash对接OBS - 对象存储服务 OBS

Flink对接OBS - 对象存储服务 OBS

Flume对接OBS - 对象存储服务 OBS

Cloudera CDH对接OBS - 对象存储服务 OBS

操作流程 - 对象存储服务 OBS

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线