【Hive】——数据仓库

这篇具有很好参考价值的文章主要介绍了【Hive】——数据仓库。希望对大家有所帮助。如果存在错误或未考虑完全的地方,请大家不吝赐教,您也可以点击"举报违法"按钮提交疑问。

1.1 数仓概念

数据仓库(data warehouse):是一个用于存储,分析,报告的数据系统
目的:是构建面向分析的集成化数据环境,分析结果为企业提供决策支持
特点:
数据仓库本身不产生任何数据,其数据来源于不同外部系统
数据仓库也不需要消费任何的书,其结果开放给各个外部应用使用
这也是为什么叫仓库,而不叫工厂的原因
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.2 案例

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.3 数仓特征

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.3.1 面向主题性

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.3.2 集成性

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.3.3 非易性、非异变性

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.3.4 时变性

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.4 OLTP、OLAP

1.4.1 OLTP:联机事务处理

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.4.2 OLAP:联机分析处理

【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.4.3 OLAP对比OLTP

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.5 数据仓库、数据库的区别

【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.6 数据仓库、数据集市的区别

【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.7 数据仓库思想与架构

1.7.1 分层思想和标准

操作型数据层(ODS)
数据仓库层(DW)
数据应用层(DA)
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.7.2 ODS层(Operation Data Store)

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.7.2 DW层(Data Warehouse)

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.7.3 DA层(或ADS层)

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.8 分层作用

【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.9 ETL、ELT

ETL:抽取Extra、转化Transfer、装载Load
具体顺序基于业务实际灵活选择

1.9.1 ETL

【Hive】——数据仓库,hive,数据仓库,hive,hadoop
【Hive】——数据仓库,hive,数据仓库,hive,hadoop

1.9.2 ELT

【Hive】——数据仓库,hive,数据仓库,hive,hadoop

【Hive】——数据仓库,hive,数据仓库,hive,hadoop文章来源地址https://www.toymoban.com/news/detail-756631.html

到了这里,关于【Hive】——数据仓库的文章就介绍完了。如果您还想了解更多内容,请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章,希望大家以后多多支持TOY模板网!

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处: 如若内容造成侵权/违法违规/事实不符,请点击违法举报进行投诉反馈,一经查实,立即删除!

领支付宝红包 赞助服务器费用

相关文章

  • Hive数据仓库

    数据仓库(英语:Data Warehouse,简称数仓、DW),是一个用于存储、分析、报告的数据系统。 数据仓库的目的是构建面相分析的集成化数据环境,分析结果为企业提供决策支持(Decision Support)。 数据仓库本身并不“产生”任何数据,其数据来源不同外部系统; 同时数据仓库

    2024年02月15日
    浏览(39)
  • Hive数据仓库简介

    Hive起源于Facebook,Facebook公司有着大量的日志数据,而Hadoop是实现了MapReduce模式开源的分布式并行计算的框架,可轻松处理大规模数据。然而MapReduce程序对熟悉Java语言的工程师来说容易开发,但对于其他语言使用者则难度较大。因此Facebook开发团队想设计一种使用SQL语言对日

    2024年02月15日
    浏览(55)
  • hive数据仓库课后答案

    一、 填空题 1.数据仓库的目的是构建面向     分析         的集成化数据环境。 2.Hive是基于     Hadoop         的一个数据仓库工具。 3.数据仓库分为3层,即      源数据层        、     数据应用层        和数据仓库层。 4.数据仓库层可以细分为      明细层

    2023年04月08日
    浏览(46)
  • 【Hive】——数据仓库

    数据仓库(data warehouse):是一个用于存储,分析,报告的数据系统 目的:是构建面向分析的集成化数据环境,分析结果为企业提供决策支持 特点: 数据仓库本身不产生任何数据,其数据来源于不同外部系统 数据仓库也不需要消费任何的书,其结果开放给各个外部应用使用

    2024年02月04日
    浏览(39)
  • Hive 数据仓库介绍

    目录 ​编辑 一、Hive 概述 1.1 Hive产生的原因 1.2 Hive是什么? 1.3 Hive 特点 1.4 Hive生态链关系 二、Hive架构 2.1 架构图 2.2 架构组件说明 2.2.1 Interface 2.2.1.1 CLI 2.2.1.2 JDBC/ODBC 2.2.1.3 WebUI 2.2.2 MetaData 2.2.3 MetaStore 2.2.4 Hiveserver2 2.2.5 Driver 2.2.5.1 解释器 2.2.5.2 编译器 2.2.5.3 优化器 2.2.5.4 执行

    2024年02月07日
    浏览(40)
  • 安装hive数据仓库

    需要安装部署完成的Hadoop的环境如果不会搭建的可以参考: 卸载Centos7自带的mariadb mariadb-libs-5.5.64-1.el7.x86_64是使用 rpm -qa|grep mariadb 查询出来的名称 安装mysql 安装mysql时可能会出现的问题 1、依赖检测失败 问题很明显了就是依赖的问题,下载他说的依赖就好了 安装hive 上传并且

    2024年02月14日
    浏览(50)
  • Hive数据仓库行转列

    查了很多资料发现网上很多文章都是转发和抄袭,有些问题。这里分享一个自己项目中使用的行转列例子,供大家参考。代码如下: 如果是在SparkSQL或Presto平台,或者阿里云的MaxCompute平台,还可使用如下方式:

    2024年02月21日
    浏览(55)
  • 数据仓库hive的安装说明

    1.按照下面语句顺序依次输入,安装mysql         $sudo apt-get install mysql-server         $sudo apt-get install mysql-client         $sudo apt-get install libmysqlclient-dev 2.连接MySQL数据库 (1)进入mysql         $sudo mysql -u root –p (2)使用mysql         use mysql; (3)修改mysql用户密

    2024年03月10日
    浏览(43)
  • 【数据仓库】Apache Hive初体验

    为什么使用Hive? 使用Hadoop MapReduce直接处理数据所面临的问题: 人员学习成本太高需要掌握ava语言MapReduce实现,复杂查询逻辑开发难度太大! 1,使用Hive处理数据的好处操作接口采用类SQL语法,提供快速开发的能力(简单、容易上手)避免直接写MapReduce,减少开发人员的学习成

    2024年02月14日
    浏览(50)
  • 数据仓库Hive(林子雨课程慕课)

    9.数据仓库Hive 9.1 数据仓库的概念 数据仓库的概念 数据仓库是一个面向主题的、集成的、相对稳定的、反映历史变化的数据集合,用户支持管理决策 根本目的:基于数据仓库的分析结果-以支持企业内部的商业分析和决策-作出相关的经营决策 数据仓库的体系结构: 数据仓库

    2024年02月07日
    浏览(40)

觉得文章有用就打赏一下文章作者

支付宝扫一扫打赏

博客赞助

微信扫一扫打赏

请作者喝杯咖啡吧~博客赞助

支付宝扫一扫领取红包,优惠每天领

二维码1

领取红包

二维码2

领红包