Home » » INTRODUCTION OF DATA WAREHOUSE

INTRODUCTION OF DATA WAREHOUSE


Data, Informasi dan Database
¨  Menurut Steven Alter, data merupakan fakta,gambar atau suara yang mungkin atau tidak berhubungan atau berguna bagi tugas tertentu.
¨  Menurut McLeod, data terdiri dari fakta-fakta dan angka yang secara relatif tidak berarti bagi pemakai.
¨  Sedangkan informasi adalah data yang sudah diproses atau data yang memiliki arti
¨  Menurut James A. O’Brien Database adalah suatu koleksi terintegrasi dimana secara logika berhubungan dengan record dari file.
¨  Menurut Fatansyah, Database adalah kumpulan data yang saling berhubungan yang disimpan secara bersama sedemikian rupa dan tanpa pengulangan(redudansi) yang tidak perlu, untuk memenuhi berbagai kebutuhan.
¨  Jadi Database adalah tempat penyimpanan data yang saling berhubungan secara logika, sehingga bisa digunakan untuk mendapatkan suatu informasi yang diperlukan oleh suatu organisasi atau perusahaan.

Database
¨  Data yang diperoleh suatu organisasi atau perusahaan umumnya didapat dari kegiatan operasional sehari-hari atau hasil dari transaksi.

Definisi Data Warehouse
¨  W.H. Inmon dan Richard D.H.: Data warehouse adalah koleksi data yang mempunyai sifat berorientasi subjek,terintegrasi,time-variant, dan bersifat tetap dari koleksi data dalam mendukung proses pengambilan keputusan management
¨  Vidette Poe: data warehouse merupakan database yang bersifat analisis dan read only yang digunakan sebagai fondasi dari sistem penunjang keputusan.
¨  Sebuah sistem yang terdiri dari beberapa proses dan database yang digunakan untuk menyediakan “infrastruktur data” bagi EIS dan DSS

Why Data warehouse
¨  “We have mountains of data in this company, but we can’t access it.”
¨   “We need to slice and dice the data every which way.”
¨   “You’ve got to make it easy for business people to get at the data directly.”
¨   “Just show me what is important.”
¨   “It drives me crazy to have two people present the same business metrics at a meeting, but with different numbers.”
¨   “We want people to use information to support more fact-based decision making.



DW Requirements
¨  The data warehouse must make an organization’s information easily accessible.
¨  The data warehouse must present the organization’s information consistently
¨  The data warehouse must be adaptive and resilient to change
¨  The data warehouse must be a secure bastion that protects our information assets.
¨  The data warehouse must serve as the foundation for improved decision making.
¨  The business community must accept the data warehouse if it is to be successful



Istilah-istilah yang berhubungan dengan data warehouse
¨  Data Mart
Adalah suatu bagian pada data warehouse yang mendukung pembuatan laporan dan analisa data pada suatu unit, bagian atau operasi pada suatu perusahaan.
¨  On-Line Analytical Processing(OLAP)
Merupakan suatu pemrosesan database yang menggunakan tabel fakta dan dimensi untuk dapat menampilkan berbagai macam bentuk laporan, analisis, query dari data yang berukuran besar.
¨  On-Line Transaction Processing(OLTP)
Merupakan suatu pemrosesan yang menyimpan data mengenai kegiatan operasional transaksi sehari-hari.
¨  Dimension Table
Tabel yang berisikan kategori dengan ringkasan data detail yang dapat dilaporkan. Seperti laporan laba pada tabel fakta  dapat dilaporkan sebagai dimensi waktu(yang berupa perbulan, perkwartal dan pertahun).

Karakteristik Data Warehouse
1. Subject Oriented (Berorientasi subject)
¨  Data warehouse berorientasi subject artinya data warehouse didesain untuk menganalisa data berdasarkan subject-subject tertentu dalam organisasi, bukan pada proses atau fungsi aplikasi tertentu.
¨  Data warehouse diorganisasikan disekitar subjek-subjek utama dari perusahaan(customers, products dan sales) dan tidak  diorganisasikan pada area-area aplikasi utama (customer invoicing, stock control dan product sales).
¨  Hal ini dikarenakan kebutuhan dari data warehouse untuk menyimpan data-data yang bersifat sebagai penunjang suatu keputusan, dari pada aplikasi yang berorientasi terhadap data.
¨  Jadi dengan kata lain, data yang disimpan adalah berorientasi kepada subjek bukan terhadap proses. Secara garis besar perbedaan antara data operasional dan data warehouse yaitu :
¨  Secara garis besar perbedaan antara data operasional dan data warehouse yaitu :
Data Operasional
Data Warehouse
Dirancang berorientasi hanya pada aplikasi dan fungsi tertentu
Dirancang berdasar pada subjek-subjek tertentu(utama)
Focusnya pada desain database dan proses
Focusnya pada pemodelan data dan desain data
Berisi rincian atau detail data
Berisi data-data history yang akan dipakai dalam proses analisis
Relasi antar table berdasar aturan terkini (selalu mengikuti rule/aturan terbaru)
Banyak aturan bisnis dapat tersaji antara tabel-tabel

2. Integrated (Terintegrasi)
¨  Data Warehouse dapat menyimpan data-data yang berasal dari sumber-sumber yang terpisah kedalam suatu format yang konsisten dan saling terintegrasi satu dengan lainnya.
¨  Dengan demikian data tidak bisa dipecah-pecah karena data yang ada merupakan suatu kesatuan yang menunjang keseluruhan konsep data warehouse itu sendiri.
¨  Syarat integrasi sumber data dapat dipenuhi dengan berbagai cara sepeti konsisten dalam penamaan variable, konsisten dalam ukuran variable, konsisten dalam struktur pengkodean dan konsisten dalam atribut fisik dari data.

3. Time-variant (Rentang Waktu)
¨  Seluruh data pada data warehouse dapat dikatakan akurat atau valid pada rentang waktu tertentu. Untuk melihat interval waktu yang digunakan dalam mengukur keakuratan suatu data warehouse, kita dapat menggunakan cara antara lain :
¤  Cara yang paling sederhana adalah menyajikan data warehouse pada rentang waktu tertentu, misalnya antara 5 sampai 10 tahun ke depan.
¤  Cara yang kedua, dengan menggunakan variasi/perbedaan waktu yang disajikan dalam data warehouse baik implicit maupun explicit secara explicit dengan unsur waktu dalam hari, minggu, bulan dsb. Secara implicit misalnya pada saat data tersebut diduplikasi pada setiap akhir bulan, atau per tiga bulan.
¤  Cara yang ketiga,variasi waktu yang disajikan data warehouse melalui serangkaian snapshot yang panjang. Snapshot merupakan tampilan dari sebagian data tertentu sesuai keinginan pemakai dari keseluruhan data yang ada bersifat read-only.

4. Non-Volatile
¨  maksudnya data pada data warehouse tidak di-update secara real time tetapi di refresh dari sistem operasional secara reguler.
¨  Data yang baru selalu  ditambahkan sebagai suplemen bagi database itu sendiri dari pada sebagai sebuah perubahan.
¨  Database tersebut secara kontinyu menyerap data baru ini, kemudian secara incremental disatukan dengan data sebelumnya.
¨  Berbeda dengan database operasional yang dapat melakukan update, insert dan delete terhadap data yang mengubah isi dari database.
¨  pada data warehouse hanya ada dua kegiatan memanipulasi data yaitu loading data (mengambil data) dan akses data (mengakses data warehouse seperti melakukan query atau menampilan laporan yang dibutuhkan, tidak ada kegiatan updating data).





Elemen Dasar Data Warehouse

¨  These are the operational systems of record that capture the transactions of the business.
¨  The data staging area is everything between the operational source systems and the data presentation area. It is somewhat analogous to the kitchen of a restaurant, where raw food products are transformed into a fine meal. In the data warehouse, raw operational data is transformed into a warehouse deliverable fit for user query and consumption. Similar to the restaurant’s kitchen, the backroom data staging area is accessible only to skilled professionals.
¨  The data presentation area is where data is organized, stored, and made available for direct querying by users, report writers, and other analytical applications.
¨  A data access tool can be as simple as an ad hoc query tool or as complex as a sophisticated data mining or modeling application. all data access tools query the data in the data warehouse’s presentation area

OLTP versus OLAP/DW
¨  On-Line Transaction Processing System
¨  Transaksi proses (= kegiatan bisnis – penjualan, pemesanan, pembayaran dll)
¨  Umumnya digunakan di ‘bagian depan’ bisnis oleh orang-orang yang berinteraksi langsung dengan para pelanggan, supplier, pegawai dll
¨  Dikarakterisasikan dengan data entry, update dan deletion
¨  Biasanya terfokus pada satu area bisnis (seperti POS – point-of-sales, inventory, purchasing, human resources)
¨  On-Line Analytical Processing
¨  Umumnya digunakan oleh pembuat kebijakan seperti analis dan manajer
¨  Data yang ada di dalam sebuah data warehouse umumnya berasal dari bermacam-macam OLTP systems
¨  Dikarakterisasikan oleh data reading (pelaporan, queries) bukan data entry
Arsitektur Data Warehouse Umum

Sebuah Data Warehouse


Motivasi Sebuah Data Warehouse
¨  Tekanan terhadap database OLTP untuk proses query terlalu besar
¨  Data warehousing didisain untuk proses pengambilan yang efesien
¨  Data pada sistem yang berbeda-beda umumnya tidak konsisten, kualitasnya buruk dan disimpan di dalam format yang berbeda
¨  Mengurangi biaya dalam menyediakan data untuk keperluan pengambilan keputusan
¨  Mendukung untuk memfokuskan diri pada proses bisnis lengkap
¨  Mendukung inisiatif baru
¨  Sumber-sumber industri menyebutkan bahwa ROI berjumlah rata-rata 401% dalam tiga tahun
¨  Tetap kompetitif
Goals Dari Data Warehouse
¨  Menyediakan akses pada data perusahaan atau organisasi
¨  Data di dalam sebuah warehouse bersifat konsisten
¨  Satu versi dari kebenaran
¨  Data warehouse adalah tempat dimana data yang telah digunakan dipublikasikan
¨  Kualitas data di dalam data warehouse adalah kritikal
¨   “Kualitas – ketepatan untuk suatu tujuan”
Kualitas Data: Atribut
¨  Kelengkapan
¨  Tidak Mendua
¨  Berarti
¨  Tepat
¨  Akurat
¨  Berkelanjutan
Data Warehousing Sebagai Suatu Proses
¨  Dinamika fundamental di pusat data warehousing
¨  Proses pembelajaran
  1. Data dalam data warehouse akan mengubah pengertian pengguna akhir terhadap pekerjaan mereka
  2. Dengan mengertinya mereka terhadap perubahan pekerjaan mereka, keperluan mereka terhadap informasi akan berubah
  3. Dengan berubahnya informasi yang diperlukan maka data warehouse juga akan berubah
  4. Kembali ke nomor 1.
Penggunaan Data Warehouse di Indonesia
¨  Statistic Indonesia
¨  Bank Rakyat Indonesia
¨  PT Asuransi Allianz Utama Indonesia
¨  Contoh lain...

Jika Anda menyukai Artikel di blog ini, Silahkan klik disini untuk berlangganan gratis via email, dengan begitu Anda akan mendapat kiriman artikel setiap ada artikel yang terbit di Creating Website

0 komentar:

Poskan Komentar

 
Supported : Ende Batak | Sihotang Blog
Copyright © 2011. Blog Bang Bolon - All Rights Reserved
Template Modify by Bataknesia
Proudly powered by Blogger