<?xml version="1.0" encoding="utf-8" ?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
<channel>
<title>データウェアハウス自由帳</title>
<link>https://ameblo.jp/dhwnote/</link>
<atom:link href="https://rssblog.ameba.jp/dhwnote/rss20.xml" rel="self" type="application/rss+xml" />
<atom:link rel="hub" href="http://pubsubhubbub.appspot.com" />
<description>初心者用データウェアハウス講座です。</description>
<language>ja</language>
<item>
<title>ETLとは</title>
<description>
<![CDATA[ ETLはExtract Transform Loadの略で、データウェアハウス構築の基礎となる部分です。<br>一言で言うと、ソースのデータを抽出してデータウェアハウス内のターゲットとなるテーブルにデータを加工し移行させるプロセスです。<br><br>具体的には<br><br><b>データを抽出する（EXTRACT）</b><br>・ソースモデルを理解する<br>・ソースデータにアクセスするスケジュールの設定<br>・データの変化を把握する<br>・ステージングエリアにデータを移す<br><br><b>データを掃除する（CLEAN）</b><br>・カラム・データタイプ分析<br>・ビジネスルールを分析・作成<br>・データのクオリティを定義<br>・データのクレンジングを行いステージングに移す。<br><br><b>データを統合する（CONFORM）</b><br>・ビジネスラベリング<br>・ビジネスマトリックスとパフォーマンスインディケータの作成<br>・メンテナンス<br>・ローカライゼーション<br>・統合したデータをステージングに移す。<br><br><b>データを移行させる（DELIVER）</b><br>・各ディメンションへのロード<br>・時間ディメンションテーブル作成・ロード<br>・TYPE１・２・３（Slowly changing dimensions）へのロード<br>・各FACTへのロード<br>・アグリゲーションの更新<br>など<br>のプロセスにわかれます。<br><br><br>ETL運用のステップは、だいたいこんな感じです。<br>１．スケジュール<br>２．ジョブの実行<br>３．例外のハンドリング<br>４．リカバリと再起動<br>５．クオリティのチェック<br>６．リリース<br>７．サポート
]]>
</description>
<link>https://ameblo.jp/dhwnote/entry-11389804710.html</link>
<pubDate>Sat, 27 Oct 2012 11:32:00 +0900</pubDate>
</item>
</channel>
</rss>
