结构化、半结构化、非结构化的理解
结构化数据就是我们关系数据库里的表,剩下的都是半结构化和非结构化数据,好比XML文档就是半结构化数据,WORD文档就是非结构化数据。
1.结构化数据
定义:业界指关系模型数据,即以关系数据库表形式管理的数据
简析:虽然专业角度上看,结构化就是关系模型的说法并不准确,但针对目前业内现状,还是定义为关系模型最为妥善,因为它准确的代表了我们传统上最熟悉的企业业务数据。
2.半结构化数据
定义:非关系模型的、有基本固定结构模式的数据,例如日志文件、XML文档、JSON文档、Email等。
3.非结构化数据
定义:没有固定模式的数据,如WORD、PDF、PPT、EXL,各种格式的图片、视频等。
简析:区分半结构化与非结构化的意义在于,对两者的处理方法是不同的,非结构化数据大多采用内容管理方法,而半结构化数据基本没有有效的管理方法。
总结
(1)结构化、半结构化、非结构化其实是按照数据格式分类。
(2)严格讲,结构化与半结构化数据都是有基本固定结构模式的数据
(3)半结构与非结构化数据与目前流行的大数据之间只是有领域重叠的关系,本质讲两者并无必然联系。
(4)业界有将大数据认同为半结构/非结构化数据,是因为大数据技术最初是在半结构化数据领域发挥作用,其本质是将数据处理技术与数据格式混淆,是不正确的。
原文:https://blog.csdn.net/qq_25353433/article/details/81451310
结构化、半结构化、非结构化的理解相关推荐
- 结构化数据(structured),半结构化数据(semi-structured),非结构化数据(unstructured)
研究一下分布式架构的实现方式 结构化数据(structured),半结构化数据(semi-structured),非结构化数据(unstructured) 概念 结构化数据:即行数据,存储在数据库里, ...
- 非结构化文件转移服务器,非结构化数据存储管理方法,服务器和系统 Unstructured data storage management method, and a system server...
摘要: 本文提供一种非结构化数据存储管理方法,服务器和系统,解决现有技术中非结构化存储管理系统无法支撑大量的小文件及其元数据的存储和快速访问的问题. This article provides a m ...
- neo4j图数据库:结构化数据流水线、非结构化数据流水线
日萌社 人工智能AI:Keras PyTorch MXNet TensorFlow PaddlePaddle 深度学习实战(不定时更新) 智能对话系统:Unit对话API 在线聊天的总体架构与工具介绍 ...
- 结构体内容引用自非结构体数组对象axes(handles.axes1)
Matlab结构体内容引用自非结构体数组对象 matlab的gui报错axes(handles.axes1) 如何解决 起因 代码 matlab的gui报错axes(handles.axes1) 废话 ...
- 结构化数据(structured),半结构化数据(semi-structured),非结构化数据(unstructured)的定义和区别
相对于结构化数据(即行数据,存储在数据库里,可以用二维表结构来逻辑表达实现的数据)而言,不方便用数据库二维逻辑表来表现的数据即称为非结构化数据,包括所有格式的办公文档.文本.图片.XML.HTML.各 ...
- 结构化数据(structured),半结构化数据(semi-structured),非结构化数据(unstructured)...
概念 结构化数据:即行数据,存储在数据库里,可以用二维表结构来逻辑表达实现的数据. 半结构化数据:介于完全结构化数据(如关系型数据库.面向对象数据库中的数据)和完全无结构的数据(如声音.图像文件等)之 ...
- matlab 非结构网格,基于MATLAB的非结构网格生成器和浅水问题的数值模拟
文章编号:1000-4874(2009)-04-0398-08 基于 MATLAB 的非结构网格生成器 和浅水问题的数值模拟* 蒋艳群,段雅丽, 刘儒勋,张韵华 (中国科学技术大学数学系,安徽合肥,2 ...
- 结构体内容引用自非结构体数组对象_类和对象
类和对象知识点思维导图 面向对象编程的概念 在java中,万物皆对象. 面向对象是指以属性和行为的观点去分析现实生活中的事物. 面向对象编程是指先以面向对象的思想进行分析,然后使用面向对象的编程语言进 ...
- matlab 结构体内容引用自非结构体数组对象
load henzuobiao.matfor i =1:139HZB{i} = henzuobiao.VarName2(i); end 我用的笨办法,把需要的横坐标复制到以前的一个可以运行的文件hen ...
- 福利 |《非结构化数据分析》书评:探索非结构化数据的魅力
文末有数据派独家福利哦 在过去的几年里,围绕大数据.物联网和人工智能等信息的宣传铺天盖地.这些新闻源源不断地向我们展示了技术和分析工作如何改变我们的生活和商业模式.将大数据和物联网转化为有实际价值的信 ...
最新文章
- AT网络抽象层的实现
- SQLSERVER单表CRUD通用方法
- COGS-257-动态排名系统-树状数组+主席树
- VTK:PolyData之SmoothPolyDataFilter
- zookeeper的设计猜想-集群组成
- iOS 如果刷新TableViewCell上得数据是空的 添加尾部暂无数据提示
- linux脚本写的计算器,一步步打造自己的linux命令行计算器
- ssh-keygen实现免密码登陆
- 平板电脑怎么投屏到电视上_学而思网课怎么投屏到电视上
- listview当选中某一个item时设置背景色其他的不变
- Unity3D(六)光照系统
- QGis(一)加载栅格图层和矢量图层
- phpAdmin导入sql文件太大
- 计算机考研初试350分什么水平,考研分数,考研350分什么水平!
- 百度霸屏什么意思?如何实现百度霸屏!
- C语言大作业,可供学习---打字游戏
- 小程序自制自带滑动条的表格组件
- influx数据同步
- 机器学习-Sklearn-13(回归类大家族-下——非线性问题:多项式回归(多项式变换后形成新特征矩阵))
- Google怎么了?