zoukankan      html  css  js  c++  java
  • ETL简介

    1、ETL的定义

    ETL分别是Extract”、“ Transform” 、Load”三个单词的首字母缩写也就是“抽取”、“转换”、“装载”,但我们日常往往简称其为数据抽取。

    ETL是BI/DW(商务智能/数据仓库)的核心和灵魂,按照统一的规则集成并提高数据的价值,是负责完成数据从数据源向目标数据仓库转化的过程,是实施数据仓库的重要步骤。

    ETL包含了三方面:

    抽取”:将数据从各种原始的业务系统中读取出来,这是所有工作的前提。

    转换”:按照预先设计好的规则将抽取得数据进行转换,使本来异构的数据格式能统一起来。

    装载”:将转换完的数据按计划增量或全部导入到数据仓库中。

    2、为什么需要ETL?

    因为目前运行的应用系统是用户花费了很大精力和财力构建的、不可替代的系统,尤其系统中的数据是非常之宝贵。但由于不同原始数据库中的数据的来源、格式不一样,导致了系统实施、数据整合出现问题。ETL就是用来解决这一问题的。

    本记录摘自 快乐绿茶 的博客:【原文地址

  • 相关阅读:
    HDU 2089 不要62
    NOIP 2012 疫情控制
    提高工作效率的shell工具
    log loss与ctr预估
    推荐系统
    浮点数的间隙
    graphviz初学入门指南
    sparse_hash_map、dense_hash_map和sparsetable的实现细节
    每天离不开的工具vim
    安利开发利器 -- tmux
  • 原文地址:https://www.cnblogs.com/langtianya/p/5458313.html
Copyright © 2011-2022 走看看