Langsung ke konten utama

Perbedaan Supervised dan Unsupervised Learning

Setelah sebelumnya kita belajar tentang apa itu machine learning dan bagaimana sejarahnya dari masa ke masa, saat ini kita akan mengupas lebih dalam tentang algoritma machine learning. Jenis algoritma machine learning secara umum dikategorikan menjadi 3, yaitu Supervised Learning, Unsupervised Learning, dan Reinforecement Learning. Namun sesuai dengan judulnya, kita hanya akan membahas tentang perbedaan Supervised Learning dan Unsupervised Learning, sedangkan untuk Reinforecement learning akan kita pelajari di lain waktu.


1. Supervised Learning

Dalam supervised learning atau disebut juga pembelajaran yang diawasi, kita diberikan satu set data dan sudah tahu seperti apa seharusnya bentuk output kita yang benar. Dengan kata lain, terdapat hubungan antara input dan output.

Algoritma Supervised Learning digunakan untuk menyelesaikan masalah “regresi” dan “klasifikasi”. Dalam masalah regresi, kita mencoba untuk memprediksi hasil dalam output kontinu. Artinya, kita mencoba memetakan variabel input ke beberapa fungsi kontinu. Sedangkan dalam masalah klasifikasi, kita mencoba memprediksi hasil dalam output diskrit. Dengan kata lain, kita mencoba memetakan variabel input ke dalam kategori diskrit. Hmm, bingung ya. Baiklah, perhatikan contoh di bawah ini untuk lebih memahami perbedaan regresi dan klasifikasi.

Contoh 1:
  • Dengan data berupa ukuran rumah yang di jual, cobalah untuk memperkirakan harganya di pasaran. Harga sebagai fungsi ukuran adalah output yang berkelanjutan, sehingga ini adalah masalah regresi.
  •  Contoh di atas juga bisa menjadi masalah klasifikasi dengan membuat output tentang apakah rumah itu “dijual dengan harga lebih atau kurang dari harga yang diminta.” Di sini kita akan mengklasifikasikan rumah berdasarkan harga ke dalam dua kategori terpisah.

Contoh 2:

  • Regresi – Diberikan gambar seseorang, kita harus memprediksi usia mereka berdasarkan gambar yang diberikan.
  • Klasifikasi – Diberikan data pasien yang memiliki tumor, kita harus memprediksi apakah tumor itu ganas atau jinak. 

2. Unsupervised Learning

Unsupervised learning (pembelajaran tanpa pengawasan) memungkinkan kita untuk menyelesaikan masalah yang kita tidak ketahui seperti apa hasil seharusnya. Kita dapat memperoleh struktur dari data di mana kita tidak perlu mengetahui pengaruh variabel.

Kita dapat memperoleh struktur ini dengan mengelompokkan data berdasarkan hubungan antar variabel dalam data. Dengan unsupervised learning tidak ada umpan balik berdasarkan hasil prediksi.

Contoh

  • Clustering : Terdapat koleksi 1.000.000 gen yang berbeda, temukan cara untuk secara otomatis mengelompokkan gen-gen ini ke dalam kelompok yang entah bagaimana serupa atau terkait oleh variabel yang berbeda, seperti umur, lokasi, peran, dan sebagainya.
  • Non-clustering : Sebuah algoritma bernama “Cocktail Party Algorithm”, memungkinkan kita menentukan struktur dalam lingkungan yang kacau. (Yaitu mengidentifikasikan suara dan musik individu dari suara di pesta koktail). Misalnya ada seseorang yang berbicara dengan sebuah microfon dengan latar belakang suara band yang sedang konser, teknik ini digunakan untuk membedakan mana suara band dan mana suara orang tersebut. 

Sekian dulu pembahasan tentang perbedaan supervised learning dan unsupervised learning. Selanjutnya kita akan bahas lebih mendalam tentang algoritma machine learning.

Postingan populer dari blog ini

Data Crawling dan Scraping - Pengertian, Tools, dan Studi Kasus

PENGERTIAN Crawling Web Crawler adalah suatu program atau script otomat yang relatif simple, yang dengan metode tertentu melakukan scan atau “crawl” ke semua halaman-halaman internet untuk membuat index dari data yang dicarinya. Nama lain untuk web crawl adalah web spider, web robot, bot, crawl dan automatic indexer. Proses crawling dalam suatu website dimulai dari mendata seluruh url dari website, menelusurinya satu-persatu, kemudian memasukkannya dalam daftar halaman pada indeks search engine, sehingga setiap kali ada perubahan pada website, akan terupdate secara otomatis. Web crawler dirancang secara algoritmik untuk mencapai kedalaman maksimum halaman dan merayapnya secara iteratif, menggali setiap data yang ada di internet seperti seperti : meta data, keyword, dan lain sebagainya. Kemudian web crawler atau si (spider man) ini akan meng index seluruh data kita ke dalam data base search engine. Sampai pada akhirnya halaman website akan ditampilkan di SERP (search engine rage...

Scraping Data Twitter Menggunakan Tweepy Python

Alat dan Bahan yang dibutuhkan : 1. Api Key Twitter 2. Jupyter notebook 3. Library Tweepy Disini saya menggunakan Anaconda ( https://www.anaconda.com/products/individual ) kalian juga bisa menggunakan teks editor seperti VSCode dengan membuat file berekstensi .ipynb. Untuk cara yang lebih jelas kalian bisa cek dokumentasinya saja. Langkah-Langkah : 1. Buka jupyter notebook 2. Klik New, lalu pilih Python 3 3. Install Library Tweepy jika belum punya, tulis saja pip install tweepy kemudian Run (Ctrl+Enter). Karena saya sudah menginstallnya, maka tampilannya seperti di bawah 4. Import library yang dibutuhkan seperti yang di bawah ini import tweepy from tweepy.streaming import StreamListener from tweepy import OAuthHandler from tweepy import Stream import time import json 5. Buatlah beberapa variabel untuk menyimpan API Token Twitter, kalian bisa copy paste script di bawah dan isikan variabel sesuai dengan API Key milik kalian. access_token = "<your access token...

Berkenalan dengan Bahasa Pemrograman Python

Kali kita akan sedikit berkenalan dengan bahasa pemrograman Python. Python adalah bahasa pemrograman komputer, sama layaknya seperti bahasa pemrograman lain, misalnya C, C++, Pascal, Java, PHP, Perl, dan lain-lain. Sebagai bahasa pemrograman, Python tentu memiliki dialek, kosakata atau kata kunci (keyword), dan aturan tersendiri yang mungkin agak berbeda dengan bahasa pemrograman lainnya. Sejarah Python Baiklah, mari kita mulai berkenalan dengan bahasa python. Bahasa pemrograman Python disusun di akhir tahun 1980-an dan implementasinya baru dimulai pada Desember 1989 oleh Guido Van Rossum di Centrum Wiskunde & Informatika (CWI), sebuah pusat riset di bidang matematika dan sains, Amsterdam-Belanda; sebagai pengganti bahasa sebelumnya. Publikasi pertama bahasa pemrograman Python dilakukan oleh Van Rossum pada tahun 1991 dengan label versi 0.9.0, yang kemudian disusul dengan versi 1.0 pada tahun 1994. Pada bulan April 1995, Guido pindah dari CWI ke Corporation for National Res...