2023年国赛-大数据应用开发(师生同赛)_赛项规程样题解析-任务B：离线数据处理

抱歉，只有登录会员才可浏览！<a href='/member/login'>会员登录</a>

2023年国赛_赛项规程样题解析-离线数据处理_子任务三：指标计算

任务描述

使用Scala编写spark工程代码，并计算相关指标。

启动Hive Metastore服务

如果想要Spark能读写Hive中的数据表，需要访问Metastore服务。在终端中执行如下命令：

$ hive --service metastore

这将保持Hive Metastore服务一直运行，请勿关闭终端。如果要将其作为后台服务启动，则可以使用下面的命令：

$ nohup hive --service metastore &

这个命令将启动Hive Metastore服务，并在后台持续运行。

子任务1

子任务1描述

1. 本任务基于以下2、3、4小题完成，使用Azkaban完成第2、3、4题任务代码的调度。工作流要求，使用shell输出“开始”作为工作流的第一个job（job1），2、3、4题任务为并行任务且它们依赖job1的完成（命名为job2、job3、job4），job2、job3、job4完成之后使用shell输出“结束”作为工作流的最后一个job（endjob），endjob依赖job2、job3、job4，并将最终任务调度完成后的工作流截图，将截图粘贴至客户端桌面【Release\任务B提交结果.docx】中对应的任务序号下；

子任务1分析

本 ......

......

抱歉，只有登录会员才可浏览！会员登录

小白学苑PBCP

PBCP, 让大数据竞赛更简单!

2023年国赛_赛项规程样题解析-离线数据处理_子任务三：指标计算

任务描述

启动Hive Metastore服务

子任务1