olapoltp和olap的异同

olap  时间:2021-08-17  阅读:()

什么是olap,简述其作用及过程

数据挖掘DM与联机分析处理DLAP都属于分析型工具,但两者之间有着明显的区别。

DM是一种挖掘型工具,DM它能自动地发现隐藏在数据中的模式( Pattern)。

DM是一种有效地从大量数据中发现潜在数据模式、作出预测性分析的分析工具,它是现有的一些人工智能、统计学等成熟技术在特定的数据库领域中的应用。

DM与其他分析型工具最大的不同在于:它的分析过程是自动的。

一个成熟的DM系统,除了具有良好的核心的技术外,还应该具有开放性的结构,友好的用户接口。

DM的用户不必提出确切的问题,而只需DM去挖掘隐藏的模式并预测未来的趋势,这样更有利于发现未知的事实。

OLAP是一种自上而下、不断深入的分析工具:用户提出问题或假设,OLAP负责从上至下深入地提取出关于该问题的详细信息,并以可视化的方式呈现给用户。

与DM相比,OGAP更多地依靠用户输入问题和假设,但用户先入为主的局限性可能会限制问题和假设的范围,从而影响最终的结论。

因此,作为验证型分析工具,QLAP更需要对用户需求有全面而深入的了解。

显然,从对数据分析的深度的角度来看,SLAP位于较浅的层次,而Dh}所处的位置则较深。

如果按E.F. Codd的数据分析模型来区分这两者,那么应该说OLAP实现了解释模型和思考模型,而DNd则实现了更深的第四层—公式模型。

所处分析模型层次的不同决定了这两者的分析能力和所能回答的问题种类也不相同。

OLAP具有哪些功能?

联机分析(OLAP)是由关系数据库之父E.F.Codd于1993年提出的一种数据动态分析模型,它允许以一种称为多维数据集的多维结构访问来自商业数据源的经过聚合和组织整理的数据。

以此为标准,OLAP作为单独的一类产品同联机事务处理(OLTP)得以明显区分。

  有点深奥是不是?其实并不复杂,OLAP最基本的概念其实只有三个:多维观察、数据钻取、CUBE运算。

  从动态的多维角度分析数据   我们在平时工作中,会遇到各种问题,在分析问题的时候,同样的现象,我们会从多个角度去分析考虑,并且有时候我们还会从几个角度综合起来进行分析。

这就是OLAP分析最基本的概念:从多个观察角度的灵活组合来观察数据,从而发现数据内在规律。

  OLAP将数据分为两种特征,一种为表现特征,比如一个销售分析模型中的销售额、毛利等;还有一种为角度特征,比如销售分析中的时间周期、产品类型、销售模式、销售区域等。

前者是被观察的对象,OLAP术语称之为“度量数据”,后者为观察视角,OLAP术语称之为“维数据”。

  如果建立这样一个模型,我们就可以根据业务需求,从产品类型角度去观察各个销售地区的销售额数据(以产品类型和销售地区为维、以销售额为度量);或者我们还可以从销售模式的角度去观察各个销售地区的销售额数据(以销售模式和销售地区为维、以销售额为度量)。

  在Max@X Analyser的OLAP模型中,每个模型最多可以设定255个维、1024个度量,也就是说,我们可以从255个角度或者角度组合,去同时观察1024个数据对象的变化。

  对数据进行钻取,以获得更为精确的信息   在分析过程中,我们可能需要在现有数据基础上,将数据进一步细化,以获得更为精确的认识。

这就是OLAP中数据钻取的概念。

  比如,在销售分析中,当我们以产品类型和销售地区为维、以销售额为度量进行分析的时候,可能希望进一步观察某类产品的不同销售模式在各个销售地区的表现,这时我们就可以在产品大类这个数据维下面,再加上一个销售模式维,从而获得相应的信息。

  创建数据CUBE   那么,要满足上述运算,需要什么样的前提呢?   我们可以想像,和报表不同,OLAP分析所需的原始数据量是非常庞大的。

一个分析模型,往往会涉及数百万条、数千万条、甚至更多;而分析模型中包含多个维数据,这些维又可以由浏览者作任意的提取组合。

这样的结果就是大量的实时运算导致的时间延滞。

我们可以设想,一个对于1000万条记录的分析模型,如果一次提取4个维度进行组合分析,那么实际的运算次数将达到4的1000次方的数量:这样的运算量将导致数十分钟乃至更长的等待时间。

如果用户对维组合次序进行调整,或者增加减少某些维度的话,又将是一个重新的计算过程。

  从上面分析,我们可以得出结论,如果不能解决OLAP运算效率问题的话,OLAP将是一个毫无实用价值的概念。

那么,作为一个成熟产品是如何解决这个问题的呢?这就是OLAP中一个非常重要的技术:数据CUBE预运算。

  一个OLAP模型中,度量数据和维数据我们应该实现确定,一旦两者确定下来,那么我们可以对数据进行预先的处理,在正式发布之前,将数据根据维进行最大限度的聚类运算,运算中会考虑到各种维组合情况,运算结果将生成一个数据CUBE,并保存在服务器上。

这样,当最终用户在调阅这个分析模型的时候,就可以直接使用这个CUBE,在此基础上根据用户的维选择和维组合进行复运算,从而达到实时响应的这么一个效果。

  作为一个成熟的产品,Max@X Analyser无论是在CUBE创建还是后续的浏览操作,效率都是非常高的。

测试结果表明:原始数据行数在3200万条记录的时候,包含10个维数据组合、2个度量数据的CUBE,创建周期为132分钟,装载效率是12.5秒。

这样的成绩对比世界上任何一个高端OLAP同类产品,都不逊色。

(需要更为详细的测试报告,可以与炎鼎软件联系)。

  补充说明   上面所说的,是OLAP最基本的概念,除此以外,OLAP通常包括的功能包括数据旋转(变换观察维组合顺序)、数据切片(过滤无关数据,对指定数据进行重点观察),以及对数据进行跨行列运算(如Max@X Analyser中的增加行列差额、等比环比等扩展运算)。

  如果您希望了解更多关于OLAP的信息,请与炎鼎软件技术支持联系。

oltp和olap的异同

检举|2007-09-19 16:30OLTP即联机事务处理,就是我们经常说的关系数据库,意即记录即时的增、删、改、查,就是我们经常应用的东西,这是数据库的基础; OLAP即联机分析处理,是数据仓库的核心部心,所谓数据仓库是对于大量已经由OLTP形成的数据的一种分析型的数据库,用于处理商业智能、决策支持等重要的决策信息;数据仓库是在数据库应用到一定程序之后而对历史数据的加工与分析;是处理两种不同用途的工具而已。

HostKvm新上联通CUVIP线路VPS,八折优惠后1G内存套餐$5.2/月起

最近上洛杉矶机房联通CUVIP线路主机的商家越来越多了,HostKvm也发来了新节点上线的邮件,适用全场8折优惠码,基于KVM架构,优惠后最低月付5.2美元起。HostKvm是一家成立于2013年的国人主机商,提供基于KVM架构的VPS主机,可选数据中心包括日本、新加坡、韩国、美国、中国香港等多个地区机房,君选择国内直连或优化线路,延迟较低,适合建站或者远程办公等。以洛杉矶CUVIP线路主机为例,...

欧路云(22元) 新增美国Cera线路VPS主机且可全场8折

欧路云(oulucloud) 商家在前面的文章中也有陆续介绍过几次,这不今天有看到商家新增加美国Cera线路的VPS主机,而且有提供全场八折优惠。按照最低套餐最低配置的折扣,月付VPS主机低至22元,还是比较便宜的。不过我们需要注意的是,欧路云是一家2021年新成立的国人主机商,据说是由深圳和香港的几名大佬创建。如果我们有介意新商家的话,选择的时候谨慎且月付即可,注意数据备份。商家目前主营高防VP...

A400:36元/季,16.8/月kvm架构,线路优质,延迟低

A400互联是一家成立于2020年的商家,主要推行洛杉矶服务器采用kvm架构,线路优质,延迟低,稳定性高!全场产品对标腾讯云轻量,服务器线路有有美国洛杉矶cn2_gia、香港cn2+cmi,目前推行的vps服务器均为精心挑选的优质线路机房,A400互联推出了夏季优惠洛杉矶5折、香港7折促销活动,质量可靠,价格实惠!二:优惠码洛杉矶五折优惠码:20210620香港cn2七折优惠码:0710三、优惠方...

olap为你推荐
oracle11g下载怎么下载oracle11g的联机文档?微信红包图片怎么发微信要红包图片中国银行卡号我中国银行卡号前五位数是多少apple以旧换新苹果手机以旧换新划算吗?安卓模拟器哪个好用手机模拟器哪个好用?求推荐。横幅广告通栏广告 横幅广告是什么意思html源代码求html代码实数的定义数学中的“实数”是什么?实数的定义实数的定义torrent文件怎么打开BT下载后的文件怎么打开
网站服务器租用 济南域名注册 域名主机基地 申请免费域名 enom linode日本 t楼 arvixe cve-2014-6271 css样式大全 私有云存储 网站被封 免费smtp服务器 福建天翼加速 圣诞促销 165邮箱 hkg shopex主机 lamp的音标 美国迈阿密 更多