Sunday, April 29, 2012

WEB CLUSTER



     Setelah sebelunya saya membahas tentang Web crawler, sekarang akan saya lanjutkan dengan membahas Web Cluster. Seperti biasa sebelum masuk ke pembahasan kita harus mengerti terlebih dahulu apa yang di maksut dengan web cluster. Web Cluster adalah sekumpulan komputer (umumnya server jaringan) independen yang beroperasi serta bekerja secara berkerterkaitan sehingga terlihat oleh klien jaringan seolah-olah komputer-komputer tersebut adalah satu buah unit komputer. Proses menghubungkan beberapa komputer agar dapat bekerja seperti itu dinamakan dengan CLUSTERING.


Komponen cluster biasanya saling terhubung dengan cepat melalui sebuah interkoneksi yang sangat cepat, atau bisa juga melalui jaringan lokal (LAN). Karena menggunakan lebih dari sebuah server, maka managemen dan perawatan sebuah cluster jauh lebih rumit dibandingkan dengan manajemen server mainframe yang memiliki skalabilitas tinggi.








Clustering bisa diumpamakan dengan tangan manusia, apabila serverI terjadi gangguan maka serverII akan mengambil ahli semua tugas serverI tanpa mengganggu oprasi jaringan. Dalam keadaan normal kedua server saling membeckup secara aktif.

terdapat tiga kelebihan antara lain:
  1. Kemampuan Balance, pengaturan distribusi jumlah tu gas server terbagi rata. Tugas terdistribusi terlihat seolah-olah hanya satu sistem. Bila ada tugas sebanyak 100, maka akan dibagi rata menjadi 3 (33-33-33) dan jika salah satu mesin mati maka tugas akan diambil alih oleh mesin lain, sehingga tugas menjadi (50-50) tanpa dirasakan dampaknya oleh pemakai.
  2. Kemampuan Growth System, kemampuan pertumbuhan sistem baru untuk antisipasi pemakai suatu aplikasi.
  3. Very High-end Cluster, memeiliki kemampuan disaster discovery. misalkan: suatu sistem di bangun dengan jarak 40km dalam suatu kelompok cluster. tiba-tiba satu diantarannya hancur atau rusak, maka secara otomatis server lain mengambil ahli tugas, sehingga sistem tidak mati.

Salah satu software yang dapat menerapkan teknik clustring adalah carrot2. kalian bisa mengetahui secara rinci dan mendownload  di website http://project.carrot2.org/. 



     
Carrot mengambil bahan atau materi yang bersumber dari GoogleAPI, Bing API, eTools Meta Search, Lucene, SOLR, dan masih banyak lagi.

SUMBER:

Friday, March 30, 2012

web crawler

       Web Crawler atau yang sering kita kenal dengan sebutan Web Spider atau Web Robot merupakan suatu aplikasi dimana kita dapat membandingkan beberapa web yang terdapat di internet Web Crawler berkerja secara otomatis dengan membandingkan beberapa alamat website yang sering dikunjungi dan akan secara otomatis menyimpan semua bagian file yang terdapat didalamnya dalam folder komputer kita.

        web crawler yang akan saya gunakan adalah http://win-web-crawler.soft32.com/free-download?rel=center. disini setelah kita menginstal akan muncul tampilan awal yang berisi data berupa analisa web yang akan kita kunjungi.

     Proses mengunjungi setiap dokumen pada web clawler disebut dengan web crawling atau spidering. dari penganalisaan data pada web clawler kita bisa memvalidasi kode HTML dan juga mengumpuulkan alamat e-mail website yang kita analisa.

gambar1
      Disini saya akan mengambil salah satu contoh situs website makanan cepat saji kfc. untuk memulai kita dapat memilih command button new yang terdapat di pojok kiri halaman awal web clawler. selanjutnya akan muncul tampilan halaman seperti pada gambar 1. kita pilih website/dirs

lalu masukkan alamat website kfc pada command list



lalu beri ceklis pada cekbox 
 

dan tekan command button ok, maka data akan langsung diproses setelah selesai akan ada menghasilkan tampilan seperti gambar2
gambar2
 maka secara otomatis isi file dari halaman website yang telah diproses akan masuk kedalam sebuah folder didalam tempat penyimpanan data software web crowler. isi dari folder tersebut data mengenai website yang telah dianalisa.
 URL berisi tentang alamat website yang tersedia didalam website kfcindonesia.com



sumber: