作 者:王雪迎 著 定 价:89 出 版 社:清华大学出版社 出版日期:2017年07月01日 页 数:434 装 帧:平装 ISBN:9787302469803 ●第1章 数据仓库简介
●1.1 什么是数据仓库 1
●1.1.1 数据仓库的定义 1
●1.1.2 建立数据仓库的原因 3
●1.2 操作型系统与分析型系统 5
●1.2.1 操作型系统 5
●1.2.2 分析型系统 8
●1.2.3 操作型系统和分析型系统对比 9
●1.3 数据仓库架构 10
●1.3.1 基本架构 10
●1.3.2 主要数据仓库架构 12
●1.3.3 操作数据存储 16
●1.4 抽取-转换-装载 17
●1.4.1 数据抽取 17
●1.4.2 数据转换 19
●1.4.3 数据装载 20
●1.4.4 开发ETL系统的方法 21
●1.4.5 常见ETL工具 21
●1.5 数据仓库需求 22
●1.5.1 基本需求 22
●部分目录
内容简介
本书讲述在流行的大数据分布式存储和计算平台Hadoop上设计实现数据仓库,将传统数据仓库建模与SQL开发的简单性与大数据技术相结合,快速、高效地建立可扩展的数据仓库及其应用系统。
本书内容包括数据仓库、Hadoop及其生态圈的相关概念,使用Sqoop从关系数据库全量或增量抽取数据,使用HIVE进行数据转换和装载处理,使用Oozie调度作业周期性执行,使用Impala进行快速联机数据分析,使用Hue将数据可视化,以及数据仓库中的渐变维(SCD)、代理键、角色扮演维度、层次维度、退化维度、无事实的事实表、迟到的事实、累积的度量等常见问题在Hadoop上的处理等。
本书适合数据库管理员、大数据技术人员、Hadoop技术人员、数据仓库技术人员,也适合高等院校和培训机构相关专业的师生教学参考。 王雪迎 著 王雪迎,毕业于中国地质大学计算机专业,不错工程师,拥有20年数据库、数据仓库相关技术经验。曾先后供职于北京现代商业信息技术有限公司、北京在线九州信息技术服务有限公司、华北计算技术研究所、北京优贝在线网络科技有限公司,担任DBA、数据架构师等职位。
Hadoop构建数据仓库实践 电子书 下载 mobi epub pdf txt