数据库和数据仓库的区别是什么?
我们现在大部分童鞋说的数据库,一般是指Mysql、SqlServer、Oracle这些数据库软件,它们的作用是存储我们的个人信息和一些交易类数据。比如你在某团或者某宝里面的个人信息,这些你会做修改,一般存放在业务数据库中。
数据仓库呢,一般是指一套管理+组织+分析数据的方法论,承载数据仓库的软件,在互联网行业中一般是Hive为主流。它一般存放的是行为类数据,比如你点击一次网页,这些都会被记录下来存放在数据仓库中,当然个人信息一般也会从业务数据库同步一份到数据仓库中。这些数据主要用来做分析使用。
总结来说:
数据库是面向事务的设计,数据仓库是面向主题设计的。
数据库一般服务于业务系统的,数据仓库一般是服务于分析系统的。
数据库一般存储在线交易数据,数据仓库存储的一般是历史数据。
数据库设计是尽量避免冗余,数据仓库在设计是有意引入冗余。
数据库是为捕获数据而设计,数据仓库是为分析数据而设计。
相关推荐HOT
更多>>
大数据之蛇形矩阵
我们最终要输出的是以蛇形摆放之后的字符串再按行串联在一起之后的结果,也就是说每一个字母摆放的列并不重要,重要的是摆放的行号。我们可以很...详情>>
2022-12-07 20:58:39
大数据之两数相加
大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化,半结构化和...详情>>
2022-12-07 20:56:39
设计一个实时的流式计算Wordcount
使用Kafka对接SparkStreaming计算,那么要保证数据不丢失,和不重复的话,要使用直连方式,并且保证一次性语义,手动管理Offset即可,那么在实...详情>>
2022-12-07 20:54:49
大数据之最长回文串
大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化,半结构化和...详情>>
2022-12-07 20:51:53
两两交换链表中的节点
大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化,半结构化和...详情>>
2022-12-07 20:46:54

京公网安备 11010802030320号