ITPUB??ì3
新一届的微软MVP评选已经开始,欢迎各位推荐!
ITPUB论坛 » 数据仓库与数据挖掘 » 数据仓库技术和数据库技术什么区别

标题: 数据仓库技术和数据库技术什么区别
离线 appeal
初级会员



精华贴数 0
个人空间 0
技术积分 22 (49599)
社区积分 1 (34114)
注册日期 2003-4-22
论坛徽章:1
参与2007年甲骨文全球大会(中国上海)纪念     
      

发表于 2008-4-17 21:40 
数据仓库技术和数据库技术什么区别

谁能说说?谢谢

看到一个技术爱好者聚会交流的帖子,怎么找不到了。


只看该作者    顶部
离线 www_bihuman_com



精华贴数 0
个人空间 0
技术积分 84 (19037)
社区积分 23 (7185)
注册日期 2008-4-17
论坛徽章:0
      
      

发表于 2008-4-18 08:42 
数据仓库 大的概念上 包括数据库
数据仓库 小的概念上 属于数据库

区别,你这一问,我都晕了

技术聚会,去我的名字这个网址把。邀请函 让这里人封了 。欢迎爱好者有空去看看


__________________
商业智能和数据仓库爱好者俱乐部
商业智能和数据仓库爱好者网www.bihuma n.com
只看该作者    顶部
离线 randoming
阳光少年


来自 在那桃花盛开的地方...
精华贴数 0
个人空间 390
技术积分 3357 (439)
社区积分 32064 (28)
注册日期 2007-8-7
论坛徽章:37
2008北京奥运纪念徽章:皮划艇激流回旋2008北京奥运纪念徽章:射箭2008北京奥运纪念徽章:皮划艇激流回旋   
      

发表于 2008-4-18 08:57 
简而言之,数据库是面向事务的设计,数据仓库是面向主题设计的。数据库一般存储在线交易数据,数据仓库存储的一般是历史数据。

数据库设计是尽量避免冗余,一般采用符合范式的规则来设计,数据仓库在设计是有意引入冗余,采用反范式的方式来设计。

数据库是为捕获数据而设计,数据仓库是为分析数据而设计,它的两个基本的元素是维表和事实表。维是看问题的角度,比如时间,部门,维表放的就是这些东西的定义,事实表里放着要查询的数据,同时有维的ID。


单从概念上讲,有些晦涩。任何技术都是为应用服务的,结合应用可以很容易地理解。以银行业务为例。数据库是事务系统的数据平台,客户在银行做的每笔交易都会写入数据库,被记录下来,这里,可以简单地理解为用数据库记帐。数据仓库是分析系统的数据平台,它从事务系统获取数据,并做汇总、加工,为决策者提供决策的依据。比如,某银行某分行一个月发生多少交易,该分行当前存款余额是多少。如果存款又多,消费交易又多,那么该地区就有必要设立ATM了。


显然,银行的交易量是巨大的,通常以百万甚至千万次来计算。事务系统是实时的,这就要求时效性,客户存一笔钱需要几十秒是无法忍受的,这就要求数据库只能存储很短一段时间的数据。而分析系统是事后的,它要提供关注时间段内所有的有效数据。这些数据是海量的,汇总计算起来也要慢一些,但是,只要能够提供有效的分析数据就达到目的了。


数据仓库,是在数据库已经大量存在的情况下,为了进一步挖掘数据资源、为了决策需要而产生的,它决不是所谓的“大型数据库”。那么,数据仓库与传统数据库比较,有哪些不同呢?让我们先看看W.H.Inmon关于数据仓库的定义:面向主题的、集成的、与时间相关且不可修改的数据集合。


“面向主题的”:传统数据库主要是为应用程序进行数据处理,未必按照同一主题存储数据;数据仓库侧重于数据分析工作,是按照主题存储的。这一点,类似于传统农贸市场与超市的区别—市场里面,白菜、萝卜、香菜会在一个摊位上,如果它们是一个小贩卖的;而超市里,白菜、萝卜、香菜则各自一块。也就是说,市场里的菜(数据)是按照小贩(应用程序)归堆(存储)的,超市里面则是按照菜的类型(同主题)归堆的。


“与时间相关”:数据库保存信息的时候,并不强调一定有时间信息。数据仓库则不同,出于决策的需要,数据仓库中的数据都要标明时间属性。决策中,时间属性很重要。同样都是累计购买过九车产品的顾客,一位是最近三个月购买九车,一位是最近一年从未买过,这对于决策者意义是不同的。


“不可修改”:数据仓库中的数据并不是最新的,而是来源于其它数据源。数据仓库反映的是历史信息,并不是很多数据库处理的那种日常事务数据(有的数据库例如电信计费数据库甚至处理实时信息)。因此,数据仓库中的数据是极少或根本不修改的;当然,向数据仓库添加数据是允许的。


数据仓库的出现,并不是要取代数据库。目前,大部分数据仓库还是用关系数据库管理系统来管理的。可以说,数据库、数据仓库相辅相成、各有千秋。


补充一下,数据仓库的方案建设的目的,是为前端查询和分析作为基础,由于有较大的冗余,所以需要的存储也较大。为了更好地为前端应用服务,数据仓库必须有如下几点优点,否则是失败的数据仓库方案。


1.效率足够高。客户要求的分析数据一般分为日、周、月、季、年等,可以看出,日为周期的数据要求的效率最高,要求24小时甚至12小时内,客户能看到昨天的数据分析。由于有的企业每日的数据量很大,设计不好的数据仓库经常会出问题,延迟1-3日才能给出数据,显然不行的。


2.数据质量。客户要看各种信息,肯定要准确的数据,但由于数据仓库流程至少分为3步,2次ETL,复杂的架构会更多层次,那么由于数据源有脏数据或者代码不严谨,都可以导致数据失真,客户看到错误的信息就可能导致分析出错误的决策,造成损失,而不是效益。


3.扩展性。之所以有的大型数据仓库系统架构设计复杂,是因为考虑到了未来3-5年的扩展性,这样的话,客户不用太快花钱去重建数据仓库系统,就能很稳定运行。主要体现在数据建模的合理性,数据仓库方案中多出一些中间层,使海量数据流有足够的缓冲,不至于数据量大很多,就运行不起来了


__________________
Randoming
MSN:
Randoming@live.cn
----------------------------
拥抱阳光...我想...我拼搏
想成为项目经理吗?
先看看大家有没有站在一个项目经理的角度来思考问题...

祈祷...让世界找不到黑暗 幸福像花开放......

Randoming的个人空间
只看该作者    顶部
离线 randoming
阳光少年


来自 在那桃花盛开的地方...
精华贴数 0
个人空间 390
技术积分 3357 (439)
社区积分 32064 (28)
注册日期 2007-8-7
论坛徽章:37
2008北京奥运纪念徽章:皮划艇激流回旋2008北京奥运纪念徽章:射箭2008北京奥运纪念徽章:皮划艇激流回旋   
      

发表于 2008-4-18 08:57 
第一句就解释的很明白了
仓库的意义....


__________________
Randoming
MSN:
Randoming@live.cn
----------------------------
拥抱阳光...我想...我拼搏
想成为项目经理吗?
先看看大家有没有站在一个项目经理的角度来思考问题...

祈祷...让世界找不到黑暗 幸福像花开放......

Randoming的个人空间
只看该作者    顶部
离线 randoming
阳光少年


来自 在那桃花盛开的地方...
精华贴数 0
个人空间 390
技术积分 3357 (439)
社区积分 32064 (28)
注册日期 2007-8-7
论坛徽章:37
2008北京奥运纪念徽章:皮划艇激流回旋2008北京奥运纪念徽章:射箭2008北京奥运纪念徽章:皮划艇激流回旋   
      

发表于 2008-4-18 15:51 
这里也很冷清啊


__________________
Randoming
MSN:
Randoming@live.cn
----------------------------
拥抱阳光...我想...我拼搏
想成为项目经理吗?
先看看大家有没有站在一个项目经理的角度来思考问题...

祈祷...让世界找不到黑暗 幸福像花开放......

Randoming的个人空间
只看该作者    顶部
离线 mky2659
中级会员



精华贴数 0
个人空间 0
技术积分 605 (3159)
社区积分 5 (16297)
注册日期 2007-7-23
论坛徽章:0
      
      

发表于 2008-4-22 15:35 
说的很好


只看该作者    顶部
离线 hongchaoyang


精华贴数 0
个人空间 0
技术积分 123 (14133)
社区积分 0 (1727323)
注册日期 2008-3-16
论坛徽章:0
      
      

发表于 2008-4-22 22:10 
看明白了~~


只看该作者    顶部
离线 oracleniu
初级会员



精华贴数 0
个人空间 0
技术积分 14 (72411)
社区积分 4 (19053)
注册日期 2007-9-24
论坛徽章:0
      
      

发表于 2008-5-24 16:11 
解释的很清楚啊
总算是有个清晰的认识了


只看该作者    顶部
离线 jellywang
JJ娃 尿娃 水娃


精华贴数 1
个人空间 10
技术积分 3692 (391)
社区积分 6228 (238)
注册日期 2006-12-17
论坛徽章:38
现任管理团队成员奥运纪念徽章授权会员2008北京奥运纪念徽章:皮划艇激流回旋2008北京奥运纪念徽章:乒乓球生肖徽章2007版:猪
ITPUB新首页上线纪念徽章     

发表于 2008-5-24 22:35 
都没仔细考虑过这个问题!!


__________________
钱不是问题,问题是没钱!   

JJ之水天上来,灌到海区不复回!!

曾经有2W借款摆在我面前,我没有珍惜,把它砸向了黄蜂,人生最大的明灯莫过如此,如果还有翻身的机会,我只想对口水娃说四个字——我想还钱,如果要加一个期限的话,那就一万年吧!
只看该作者    顶部
离线 wangfans


精华贴数 3
个人空间 20
技术积分 6434 (206)
社区积分 6456 (232)
注册日期 2006-11-29
论坛徽章:71
现任管理团队成员金牌徽章奥运纪念徽章2008北京奥运纪念徽章:自行车2008北京奥运纪念徽章:帆船2008北京奥运纪念徽章:篮球
2008北京奥运纪念徽章:足球2008北京奥运纪念徽章:棒球每日论坛发贴之星体育版块博采纪念徽章2008年新春纪念徽章ITPUB新首页上线纪念徽章

发表于 2008-5-25 13:26 
看下两个的概念就知道区别了


__________________
-------------------------------------------------
Life is always like this !
-------------------------------------------------
MSN: wangfans@163.com
-------------------------------------------------
只看该作者    顶部
相关内容


CopyRight 1999-2006 itpub.net All Right Reserved.
北京皓辰广域网络信息技术有限公司. 版权所有
E-mail:Webmaster@itpub.net
京ICP证:010037号 联系我们 法律顾问