MAPREDUCE服务 MRS-Spark Streaming对接Kafka0-10样例程序开发思路:数据规划
数据规划
- 确保集群安装完成,包括HDFS、Yarn、Spark和Kafka。
- 本地新建文件“input_data1.txt”,将“log1.txt”的内容复制保存到“input_data1.txt”。
在客户端安装节点下创建文件目录:“/home/data”。将上述文件上传到此“/home/data”目录下。
- 将Kafka的Broker配置参数“allow.everyone.if.no.acl.found”的值修改为“true”。
- 创建Topic。
{zkQuorum}表示ZooKeeper集群信息,格式为IP:port。
$KAFKA_HOME/bin/kafka-topics.sh --create --zookeeper {zkQuorum}/kafka --replication-factor 1 --partitions 3 --topic {Topic}
- 启动Kafka的Producer,向Kafka发送数据。
java -cp {ClassPath} com.huawei.bigdata.spark.examples.StreamingExampleProducer {BrokerList} {Topic}
其中,ClassPath除样例jar包路径外,还应包含Spark客户端Kafka jar包的绝对路径,例如:/opt/client/Spark2x/spark/jars/*:/opt/client/Spark2x/spark/jars/streamingClient010/*:{ClassPath}
- 小程序免费开发_免费小程序开发平台_免费开发小程序_免费的小程序平台
- 什么是Spark_如何使用Spark_Spark的功能是什么
- 免费店铺小程序_免费制作小程序_小程序免费开发平台_免费的小程序
- 免费小程序_免费下载小程序_小程序免费开发_零售管理_教育
- GaussDB开发_GaussDB数据库开发_高斯数据库开发_华为云
- 数据治理中心_数据开发_数据开发示例_使用教程-华为云
- 数据备份归档在哪里_数据分析存储系统_大数据存储管理
- MapReduce服务_什么是存算分离_如何配置MRS集群存算分离
- 函数工作流FunctionGraph支持毫秒级响应文件处理_函数工作流_华为云FunctionGraph-华为云
- GaussDB怎么样_华为云数据库_高斯数据库怎么样-华为云