问问题描述
答精选答案

大数据作业异常的排查,往往是个比较棘手的问题。
这一方便是因为分布式作业的执行往往需要跨多个网络节点进行通信比较复杂,另一方面也是因为涉及底层框架多(spark, hive, flink, hdfs, hbase, kafka, yarn,zookeeper 等等),排查人员对这些组件各自的运行机制以及组件之间如何交互配合完成最终作业的机制不甚明了,再加上整个作业的执行涉及到各种日志且这些日志散落于集群多个节点多个目录,如何根据时间线跟踪排查各处日志,还原作业执行发生异常时底层究竟发生了什么原因是什么,相比传统的作业异常的排查确实更加困难些。 但正所谓会者不难难者不会,只要大家日积月累勤修内功掌握各个组件的底层原理和运行机制,再加上勤学苦练多多实操查看异常时的各处日志并定期归纳整理,相信大家排查相关问题会越来越得心顺手,成为一名合格的“排坑”专家!在此分享一次真实项目中hive sql作业的异常排查经验,供大家学习参考。
答其他回答(3条)
-
只需要打开微信,搜索:松果查。点击查询,输入信息即可查询到自己的百行征信数据,该数据源自全国2000多家网贷平台和银联中心,用户可以查询到自身的大数据与信用情况,可以获取各类指标,查询到自己的个人信用情况,网黑指数分,黑名单情况,网贷申请记录,申请平台类型,是否逾期,逾期金额,信用卡与网贷授信预估额度等重要数据信息等。
-
1、打开微信,关注“蘑菇信用”,点击左下角“报告查询”,在“报告查询”里面有“报告查询”和“新版报告”,无论哪个都可以查询。
2、查询大数据的时候,会分为简版和详版两种。就和人行的征信报告一样。去查的时候应记住,一定要查详版的,不要查简版的,因为简版的作用并不是很大,所以一定要查详版的。
-
大数据排查是针对各个不同业务系统的数据做查询。比如对接行程大数据,可以查询某一时间段内到某一个地方的人。
本文来自作者[公务员面试小组]投稿,不代表公众科技网立场,如若转载,请注明出处:https://www.cpst.net.cn/know/1408988.html

评论列表(4条)
我是公众科技网的签约作者“公务员面试小组”!
希望本篇文章《大数据排查是怎么查的》能对你有所帮助!
本站[公众科技网]内容主要涵盖:教育咨询,知识百科
本文概览:大数据作业异常的排查,往往是个比较棘手的问题。这一方便是因为分布式作业的执行往往需要跨多个网络节点进行通信比较复杂,另一方面也是因为涉及底层框架多(spark, hive, flink, hdfs, hbase, kafka, yarn,zookeeper 等等),排查人员对这些组件各自的运行机制以及组件之间如何交互配合完成最终作业的机制不甚明了,再加上整个作业的执行涉及到各种日志且这些日志散落于集群多个节点多个目录,如何根据时间线跟踪排查各处日志,还原作业执行发生异常时底层究竟发生了什么原因是什么,相比