数据质量框架QUalitis浅尝使用

数据质量管理平台(微众银行)Qualitis+Linkis

(一)Qualitis是一个数据质量管理系统,用于监控数据质量。

其功能包括:

  • 数据质量模型定义
  • 数据质量结果可视化
  • 可监控

数据质量管理服务提供一整套统一的流程来定义和检测数据集的质量并及时报告问题

image

(二)Linkis属于上层应用程序和底层引擎之间构建了一层计算中间件。

其功能包括:

  • 丰富的底层计算存储引擎支持:Spark、Hive、Python、Shell、Flink、JDBC、Pipeline、Sqoop、OpenLooKeng、Presto、ElasticSearch、Trino、SeaTunnel 等;
  • 丰富的语言支持:SparkSQL、HiveSQL、Python、Shell、Pyspark、Scala、JSON 和 Java 等可监控
  • 全栈计算存储引擎架构支持: 能够接收、执行和管理针对各种计算存储引擎的任务和请求,包括离线批量任务、交互式查询任务、实时流式任务和数据湖任务;

数据质量管理服务提供一整套统一的流程来定义和检测数据集的质量并及时报告问题

没有使用Linkis中间件之前的上传应用和大数据底层引擎的关系

没有Linkis 之前

使用Linkis中间件之前的上传应用和大数据底层引擎的关系

有了Linkis 之后

基于Qualitis做大数据Hive数据质量分析

(一)配置规则计算Linkis系统

image

(二)校验Linkis系统正常接入

image

(三)配置数据质量检测项目

image

(四)配置项目的检测规则

image

image

image

image

(五)执行检测项目的规则任务

image

(六)查看项目规则任务状态

image

(七)数据质量分析

(路径是Linkis所在服务器的HDFS里的路径{由当前用户托管的路径})

image

(八)查看数据质量分析结果

hdfs dfs -get /tmp/linkis/hadoop/hadoop_ClusterName1.3_default_ef04cef1-073a-454a-9506-ba0d5e555ae4.xlsx

image

(九)查看数据质量规则

image

(十)增加任务规则模板

image

(十一)配置质量管理

image

(十二)指标关联检测规则

image

(十三)首页查看质量任务统计

image

posted on   白嫖老郭  阅读(1666)  评论(0编辑  收藏  举报

相关博文:
阅读排行:
· 阿里最新开源QwQ-32B,效果媲美deepseek-r1满血版,部署成本又又又降低了!
· SQL Server 2025 AI相关能力初探
· AI编程工具终极对决:字节Trae VS Cursor,谁才是开发者新宠?
· 开源Multi-agent AI智能体框架aevatar.ai,欢迎大家贡献代码
· Manus重磅发布:全球首款通用AI代理技术深度解析与实战指南

导航

< 2025年3月 >
23 24 25 26 27 28 1
2 3 4 5 6 7 8
9 10 11 12 13 14 15
16 17 18 19 20 21 22
23 24 25 26 27 28 29
30 31 1 2 3 4 5
点击右上角即可分享
微信分享提示