Membuat Ringkasan Berita Dari Situs Berita Nasional – Website Crawl

Bagi kebanyakan dari kita membaca berita merupakan aktivitas rutin bahkan mungkin wajib, tetapi sebaliknya banyak yang menganggap membaca berita adalah aktivitas yang istimewa karena mereka susah punya waktu cukup luang untuk membaca berita di koran maupun di situs berita online. Untuk orang yang tidak mempunyai waktu yang cukup, maka membaca ringkasan berita akan sangat membantu. Membuat ringkasan berita merupakan ide yang sudah lama saya pikirkan dan mungkin sudah dilakukan oleh banyak orang. Berbagai macam teknik diperkenalkan yang tujuan akhirnya membuat ringkasan berita pada satu periode tertentu misal berita harian, berita mingguan, berita bulanan dan seterusnya berdasarkan topik topik tertentu.

Salah satu teknik yang paling umum dilakukan adalah melakukan “crawling” situs berita online. Aktivitas “crawling” ini tidak mudah, diperlukan pengetahuan programming dan layout halaman web (HTML, CSS, JS dll). Dengan kebutuhan yang tinggi maka aktivitas ekstraksi situs berita akan menjadi lama dan biaya mahal (biaya programmer, komputer, internet dan lain lain). Representasi bentuk ringkasan berita pun bisa bermacam macam, contohnya bisa saja dilakukan proses kompleks menggunakan text miningnetwork text analysis ataupun yang sederhana seperti word cloud / tag cloud

Untungnya saat ini terdapat cara untuk membuat API online sehingga proses “crawling” ini bisa dilakukan dengan cepat dan mudah. Mahasiswa saya Rio memberitahu saya mengenai aplikasi import.io untuk membuat API crawling website menjadi lebih mudah. Saya mencoba eksperimen dengan situs berita antara , dimana saya ambil berita nasional selama satu bulan terakhir (2 september 2015 – 2 oktober 2015), dan saya peroleh 1495 berita. Atribut informasi yang saya ekstrak adalah judul berita, isi berita, quote berita, waktu berita di post dan identitas wartawan penulis. Kemudian hasilnya saya tampilkan dalam ringkasan sederhana yaitu  word cloud / tag cloud.

Kalo anda ingin membuat ringkasan / ekstraksi informasi dari website, maka bisa melakukannya dengan cara ini, baik website berita, ecommerce, forum online, dan lain lain. Jika ingin bantuan mendetail atau tidak mau repot repot otak atik dan cuma butuh datanya saja bisa kontak Rio.  Cek screenshot dari eksperimen saya dibawah ini. Semoga sharing ini bermanfaat ..

1

 

2

 

proses crawling url website pada situs berita antara

3

 

proses penentuan informasi apa yang akan diambil dari suatu situs, import.io membuatnya sangat mudah

 

4

 

proses konstruksi API import.io

 

5

 

wordcloud dari isi situs berita antara sub berita nasional periode 2 september 2015 – 2 oktober 2015

Advertisements

3 thoughts on “Membuat Ringkasan Berita Dari Situs Berita Nasional – Website Crawl

  1. selamat pagi pak mungkin bapak bisa membantu saya untuk menghubungi sodara rio karena pada saat ini saya sedang mengerjakan skripsi tentang ringkasan berita, disini saya membutuhkan berbagai data berita untuk saya olah nantinya. sekian pak terima kasih.

Leave a Reply

Fill in your details below or click an icon to log in:

WordPress.com Logo

You are commenting using your WordPress.com account. Log Out / Change )

Twitter picture

You are commenting using your Twitter account. Log Out / Change )

Facebook photo

You are commenting using your Facebook account. Log Out / Change )

Google+ photo

You are commenting using your Google+ account. Log Out / Change )

Connecting to %s