数据中台-知识图谱平台

【数据分析小兵】专注数据中台产品领域,覆盖开发套件,包含数据集成、数据建模、数据开发、数据服务、数据可视化、数据治理相关产品以及相关行业的技术方案的分享。对数据中台产品想要体验、做二次开发、关注方案资料、做技术交流的朋友们,可以关注我。

1. 

  随着科技的不断发展,信息化从IT时代迈入DT时代,不管是数据的增量还是增速上都进入了一个全新的阶段,大部分规模企业和政府部门已经在构建发展大数据平台。如何高效利用数据,快速挖掘数据价值,将数据快速转变为业务知识,让数据赋能业务应用是各行业面临的难题。

  知识图谱系统,可以通过智能化分析、数据建模等方式,将海量碎片化的异构数据进行组织、连接,形成“关系网”,“关系网”中的数据与现实世界中的人、事、物、时间、空间等一一对应,并且以可视化的方式展现对象之间复杂交错的关系,实现将数据投影成为影像,让用户可以更加直观的捕捉到数据中隐藏的关联信息,从而精确研判出关键性情报。

  知识图谱是大数据平台的核心组成部分,它的主要作用是打破数据的孤岛化,融合原本独立存储的数据并打通数据间的逻辑关系,再将数据关系以用户希望的、更贴近真实世界的方式进行展示。他本质上是一种基于图逻辑思维的数据结构,通俗地讲,知识图谱就是把所有不同种类的信息连接在一起而得到的一个关系网络,知识图谱提供了从“关系”的角度去分析问题的能力,是关系表示最有效的方式之一。

  通过知识图谱,可以帮助用户打破大数据分析的重重阻碍,从海量异构数据中挖掘数据价值,可以广泛应用于公共安全、数字经济、金融科技、科学研究、制造业转型、公共健康、人文发展、政府管理等领域。

2. 系统框架

图片

  数据源层:知识图谱分析的数据来源,包括内部数据、外部数据、委办局数据等。

  存储层:

    ²Mysql业务库,存储关系图谱配置信息、基础数据结构等业务数据。

    ²Hive基础库,存储全量基础数据。

    ²Hbase主题构建库,用于存储主题数据和图数据。

    ²ES全文检索库,存储主题表索引、档案表索引、图数据索引等三类索引数据。

  数据服务层:

    ²主题数据抽取服务,根据业务库主题配置信息,从基础表抽取数据到hbase主题表。

    ²索引创建服务,抽取主题表及档案表数据到ES全文检索库。

    ²关系分析服务,进行关系分析,推送kafka消息到图数据适配服务。

    ²图数据适配服务,用于对图数据进行更新。

接口层:对外提供接口,采用spring cloud进行接口注册管理。

WEB应用层,包括主题档案、关系图谱、监控中心等业务模块。

3. 产品亮点

²提供丰富的可视化展示界面,对数据的展示更贴近于现实世界,便于用户理解,可以快速转化成业务知识。

²可以与数据建模系统配合,实现目标复杂关系网络的智能化分析及特征匹配。

²通过混合存储方式及强大的索引功能,实现了查询、分析等操作的秒级响应。

²知识库功能支持将各行业通用的主题、模型、图数据、数据可视化等知识以模版的形式存储起来,实现知识复用。

²一键生成快照,随时进行快照的查看、修改和分享。

²自助式的可视化报表设计,通过简单的组件拖拽和数据源选取,就能生成酷炫的可视化界面。

²数据实时接入基础库后,知识图谱能够对针对相关业务关系等进行主题、档案、关联关系分析。

4. 产品核心功能

4.1. 多数据源融合,强大的数据关系挖掘

  在大数据时代,各行业都存在着海量的多源异构数据,这些数据独立存在,无法产生真正的价值。知识图谱能够高效地对数据间的关系进行挖掘,不仅能够形成各类主题及其关联的档案数据,还能够对数据进行全种类关系、多维度的分析和挖掘。只有产生了关联的数据才是有意义的,才能够真实地反映现实对象之间的关联关系,从而使数据产生价值。

4.2. 直观的关系展示,重现真实场景

  我们为不同行业的用户分别建立了符合行业业务需求的各类实体库和主题库,将现实世界中的人、车、手机、银行账户等对象抽象成一个个实体,用不同类型的线对实体对象进行连接,来表示实体之间的关系,这样的展现方式能够更直观地展示实体对象在现实中的真实联系。我们还提供了灵活的工具对实体对象和关联关系(图表和连线)进行分类筛选、隐藏/显示、增加/删除等操作,帮助用户去除干扰信息,找到隐藏在数据背后的逻辑关系,还原现实世界的真实场景。

4.3. 知识库,行业经验的沉淀和分享

  知识图谱提供知识库功能,支持将各行业通用的主题、模型、图数据、数据可视化等知识以模版的形式存储起来,同行业的其他用户只需要满足相应的数据需求,就可以直接通过知识库中的共享的模版直接生成需要的结果。知识库鼓励行业内用户通过知识分享的方式进行行业经验的沉淀和积累,这样的沉淀和积累一旦达到一定的规模,就可以通过知识复用快速地帮助其他用户形成大数据关系挖掘的实战战力。

4.4. 一键生成快照,内部成果共享

  在进行数据关系挖掘的过程中,知识图谱支持在任意时间将分析的过程和结果一键生成快照,快照并不是静态的截图,而是将关系分析的每一个步骤以图逻辑思维进行数据存储,用户可以方便地对其进行查看或修改。快照功能还支持内部共享功能,用户可以将自己生成的快照,分享给权限内的其他用户或部门,实现分析成果的复用。

4.5. 追求极致的易用,可视化报表设计

  知识图谱系统提供直观易用的自助式报表设计功能,用户可以将关系分析快照、模型数据等按照业务需求,通过简单的组件拖拽和数据源选择等操作设计成效果酷炫的可视化报表。灵活的面板组合和页面布局设计,让数据真正地以用户需要的方式进行呈现。

5. 技术优势

5.1. 先进的微服务框架

  微服务是一种架构风格,一个大型复杂软件应用由一个或多个微服务组成。系统中的各个微服务可被独立部署,各个微服务之间是松耦合的。每个微服务仅关注于完成一件任务并很好地完成该任务。相比于传统的开发模式,微服务有如下优势:

²将应用进行分解,每一个微服务专注于单一功能,并通过定义良好的接口清晰表述服务边界,降低了应用的复杂度。

²每个微服务可以独立部署,使发布更加高效,同时降低对生产环境造成的风险。

²微服务架构下,可以根据自身服务的需求,自由选择最适合的技术栈。

²在微服务架构下,故障会被隔离在单个服务中,增加了应用层面的容错。

²当应用的不同组件在扩展需求上存在差异时,每个服务可以根据实际需求独立进行扩展。

5.2. 高性能图数据存储

  用传统数据库去存储社会关系数据,会产生较大的数据量(一个关系就需要一条记录),查询关系时需要大量连接,导致查询效率极低。为解决上述问题,知识图谱采用了janusgraph高性能图数据存储技术,其优点包括:

²图数据库能够更快地查询和遍历关系数据。

²数据库操作的速度并不会随着数据库的增大有明显地降低。

²更灵活,不管有什么新的数据需要存储,都是统一的节点和边,只需要考虑节点属性和边属性。

²模式匹配查询,支持更多的关系发现。

5.3. 高性能混合存储

  知识图谱采用关系型数据库与NOSQL数据库相结合的存储架构来存储公安的全量数据,极大地提升了数据查询、关系分析、模型匹配等操作的速度,实现真正的秒级响应。

5.4. 分布式任务调度框架

      XXL-JOB是一个轻量级分布式任务调度平台,其核心设计目标是开发迅速、学习简单、轻量级、易扩展。现已开放源代码并接入多家公司线上产品线,开箱即用。包括如下优点:

²简单:通过Web页面操作简单易用。

²任务实时监控,可查看任务执行日志。

²动态:可以动态修改任务状态,暂停或恢复任务,也可以终止进行中的任务。

²邮件报警:任务失败时支持邮件报警,可配置多邮件地址群发报警。

²运行报表:实时查看任务数量、调度次数、执行器数量。

5.5. 灵活的数据可视化工具

  数据的可视化表示是传递复杂信息的最有效手段之一,知识图谱使用D3.js作为数据可视化工具,D3.js提供了创建这些数据可视化的强大工具和灵活性。和其他可视化工具相比有如下优点:

²兼容性强:D3严格遵循WEB标准,所以它对于目前主流的框架都可以很好地兼容。

²灵活度高:与E-charts等可视化工具相比,D3的自由度非常高,支持多种图形的自定义。

²效果酷炫:用D3可以设计出非常漂亮的数据展示效果,给用户带来极致的视觉享受。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/web/26699.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

ResNet——Deep Residual Learning for Image Recognition(论文阅读)

1.什么是ResNet ResNet是一种残差网络,咱们可以把它理解为一个子网络,这个子网络经过堆叠可以构成一个很深的网络。下面是ResNet的结构。 2.为什么要引入ResNet 理论上来说,堆叠神经网络的层数应该可以提升模型的精度。但是现实中真的是这…

智慧守护 畅游无忧——北斗应急呼叫柱,为景区安全加码

在大自然的怀抱中,中型及大型公园、景区以其壮丽风光吸引着成千上万的游客前来探索,成为了人们休闲娱乐的好去处。然而,广袤的区域、复杂的地形和分散的人流也给安全保障带来了前所未有的挑战。传统的巡逻方式难以覆盖每一个角落,…

【第六篇】SpringSecurity的权限管理

一、权限管理的实现 服务端的各种资源要被SpringSecurity的权限管理控制可以通过注解和标签两种方式来处理。 放开了相关的注解后在Controller中就可以使用相关的注解来控制了 JSR250注解 /*** JSR250*/ @Controller @RequestMapping("/user") public class UserC…

物理隔离后数据怎么导入和导出?安全U盘一键解决

政府单位、军工和科研所、航空航天企业、金融机构、医疗单位、电力企业、生物制药实验室等企业及单位,因研发和生产过程、或日常经营中涉及大量敏感信息和技术,需要通过物理隔离来确保网络的安全性。因此,多采用物理隔离的方式进行网络建设。…

前端 CSS 经典:在 Vue3 中使用渐进式图片

1. 什么是渐进式图片 当我们网站会加载很多图片的时候,有些图片尺寸很大,加载就会很慢,会导致页面长时间陷入白屏状态,用户体验很不好。所以可以使用渐进式图片,先给用户展示模糊图,这些图尺寸小&#xff…

django学习入门系列之第二点《浏览器能识别的标签3》

文章目录 列表表格往期回顾 列表 无序列表 <!-- <ul </ul> 无序列表 --> <ul><li> 内容1 </li><li> 内容2 </li><li> 内容3 </li><li> 内容4 </li> </ul>有序列表 <!-- <ol> &…

WordPress、Typecho 站点如何让 CloudFlare 缓存加速

众所周知 WordPress、Typecho 都是著名动态博客站点(一个最简单的判断依据就是都要依赖结合数据库),这类站点在 CDN 缓存上都有一个致命的缓存弊端就是动静态请求的区分,理论上要让 CDN 绕过所有的动态请求,缓存所有的静态请求,否则就会造成前端登录和非登录状态的混乱,…

小程序制作成本是多少?揭秘隐藏费用!

在日常生活中&#xff0c;有很多小程序&#xff0c;其中我们最熟悉的是微信小程序&#xff0c;所以小程序对我们每个人来说并不陌生。那么&#xff0c;你知道制作一个小程序要花多少钱吗&#xff1f;制作小程序的成本是多少&#xff1f;今天&#xff0c;本文将带领您揭示小程序…

禁渔期水域监管:EasyCVR视频智能监控方案

一、背景与需求分析 根据农业部印发的《中国渔政亮剑2024系列专项执法行动方案》&#xff0c;我国将持续推进长江十年禁渔、海洋伏季休渔、黄河等内陆重点水域禁渔等专项行动。根据四川省相关规定&#xff0c;每年3月1日至6月30日为禁渔期&#xff0c;在此期间&#xff0c;四川…

颠覆与创新:探寻Facebook未来的发展路径

Facebook&#xff0c;这个曾经引领社交网络革命的巨头&#xff0c;在如今竞争激烈的科技市场中&#xff0c;正面临着前所未有的挑战和机遇。如何在不断变化的数字世界中保持竞争力&#xff0c;成为业界领先者&#xff0c;这是摆在Facebook面前的重要课题。本文将探寻Facebook未…

单位经常要你加班却不发加班费,你想到这一招没有?

单位经常要你加班却不发加班费&#xff0c;你想到这一招没有&#xff1f; 你也许经常在忙碌的工作和繁重的加班中度过&#xff0c;然而&#xff0c;却从未得到过应有的加班费。但你又不想离开这个单位&#xff0c;或许单位的工作环境人性化&#xff0c;同事之间的关系融洽&…

【新手必看】修复Windows11蓝牙连接问题的7个方法!

在Windows11电脑操作中&#xff0c;用户经常会到蓝牙功能&#xff0c;如果蓝牙连接出现问题了&#xff0c;就会导致用户无法成功使用蓝牙。但是&#xff0c;许多新手用户不清楚要怎么操作才能解决蓝牙连接问题&#xff1f;会有不同的因素导致蓝牙连接出现问题&#xff0c;接下来…

3d交互式场景在线编辑平台的好处

在数字化教学的新时代&#xff0c;我们为您带来了革命性的产品——VR全景展示搭建编辑器。它将传统的教学方式升级为三维模式&#xff0c;让课程训练更加真实生动&#xff0c;为您带来前所未有的学习体验。 VR全景展示搭建编辑器不仅支持视频录播、PDF、图文等多种内容承载方式…

20240613每日前端-------vue3实现聊天室(二)

看效果图&#xff1a; 今天具体讲下&#xff0c;聊天消息框的布局&#xff1a; 消息框大致分为两块&#xff1a; 别人发来的消息自己发出的消息 元素如下&#xff1a; 头像消息发送人发送时间 html代码设计如下&#xff1a; 整体先用一个div作为外边框&#xff0c;观察上面…

大模型:分本分割模型

目录 一、文本分割 二、BERT文本分割模型 三、部署模型 3.1 下载模型 3.2 安装依赖 3.3 部署模型 3.4 运行服务 四、测试模型 一、文本分割 文本分割是自然语言处理中的一项基础任务&#xff0c;目标是将连续的文本切分成有意义的片段&#xff0c;这些片段可以是句子、…

关于dwarf 中 DW_AT_data_member_location 的理解

1、用python elftool解析结构体的成员计算偏移的时候&#xff0c;会用到如下结构体&#xff1b; 2、data member location 是可变长的&#xff08;uleb128编码&#xff09;&#xff1b;DW_OP_plus_uconst是操作码&#xff1b; uleb128编码&#xff0c;正如其名&#xff0c;是小…

160. 相交链表 (Swift版本)

题目描述 最简单直接的解法 遍历 headA 的所有节点, 看 headB 中是否有相交的节点 /*** Definition for singly-linked list.* public class ListNode {* public var val: Int* public var next: ListNode?* public init(_ val: Int) {* self.val val*…

《C++程序设计》银行管理系统

莫思身外无穷事 且尽生前有限杯 我们先来看一下项目需求&#xff1a; 【场景】 在日常生活中&#xff0c;我们普遍接触到窗口服务系统&#xff0c;如到银行柜台办理业务、景区现场购买门票等。当需要办理业务的顾客数超过窗口数量时&#xff0c;我们需遵循排队等待原则。 【需…

同三维T80005EH4 H.265 4路高清HDMI编码器

同三维T80005EH4 H.265 4路高清HDMI编码器 4路HDMI输入2路3.5音频输入&#xff0c;第1路和第2路HDMI可支持4K30&#xff0c;其它支持高清1080P60 产品简介&#xff1a; 同三维T80005EH4 4路HDMI高清H.265编码器采用最新高效H.265高清数字视频压缩技术&#xff0c;具备稳定…

使用uniapp设置tabbar的角标和移除tabbar的角标

使用场景描述 在一进入到小程序的时候就要将用户在购物车中添加的商品总数&#xff0c;要以角标的形式显示在tababr中。 代码实现 //index.vue<script setup> import { onLoad } from dcloudio/uni-apponLoad(()>{uni.setTabBarBadge({index: 1,text: 5 //为了实现…