Rumah Keuangan Pribadi Dasar-dasar Data Cluster dalam Analisis Prediktif - dummies

Dasar-dasar Data Cluster dalam Analisis Prediktif - dummies

Video: Cara Mudah Uji Validitas Menggunakan SPSS - Full Tutorial 2025

Video: Cara Mudah Uji Validitas Menggunakan SPSS - Full Tutorial 2025
Anonim

A dataset < (atau pengumpulan data) adalah seperangkat item dalam analisis prediktif. Sebagai contoh, satu set dokumen adalah dataset dimana item data adalah dokumen. Satu set informasi pengguna jaringan sosial (nama, usia, daftar teman, foto, dan sebagainya) adalah kumpulan data dimana data adalah profil pengguna jaringan sosial. Pengelompokkan data

adalah pembagian dataset menjadi himpunan bagian dari item serupa. Item juga dapat disebut sebagai contoh, observasi, entitas atau objek data. Dalam kebanyakan kasus, kumpulan data terwakili dalam format tabel - matriks data . Matriks data adalah tabel angka, dokumen, atau ungkapan, yang ditunjukkan dalam baris dan kolom sebagai berikut:

Setiap baris sesuai dengan item tertentu dalam kumpulan data.
  • Baris terkadang disebut item, objek, contoh, atau observasi

    . Setiap kolom mewakili karakteristik tertentu dari sebuah item.

  • Kolom disebut sebagai fitur atau atribut

    . Menerapkan pengelompokkan data ke kumpulan data menghasilkan kelompok item data serupa. Kelompok ini disebut cluster

- kumpulan item data serupa.

Similar

item memiliki hubungan yang kuat dan terukur di antara mereka - sayuran segar, misalnya, lebih mirip satu sama lain daripada makanan beku - dan teknik pengelompokan menggunakan hubungan tersebut dengan kelompok barang-barang. Kekuatan hubungan antara dua atau lebih item dapat dihitung sebagai ukuran kemiripan

: Fungsi matematika menghitung korelasi antara dua item data. Hasil perhitungan tersebut, yang disebut nilai kesamaan, pada dasarnya membandingkan item data tertentu dengan semua item lainnya dalam kumpulan data. Item lainnya akan lebih mirip atau kurang mirip dibandingkan dengan item tertentu.

Persamaan yang dihitung memainkan peran utama dalam menugaskan item ke grup (

cluster ). Setiap kelompok memiliki item yang paling mewakili; Item ini disebut sebagai perwakilan cluster . Pertimbangkan kumpulan data yang terdiri dari beberapa jenis buah dalam keranjang. Keranjang memiliki buah dari berbagai jenis seperti apel, pisang, lemon, dan pir. Dalam hal ini, buah adalah item data. Proses pengelompokan data mengekstrak kelompok buah serupa dari kumpulan data ini (keranjang buah yang berbeda).

Langkah pertama dalam proses pengelompokkan data adalah menerjemahkan dataset ini ke dalam matriks data: Salah satu cara untuk memodelkan dataset ini adalah dengan memiliki baris yang mewakili item dalam kumpulan data (buah); dan kolom mewakili karakteristik, atau fitur, yang menggambarkan item.

Misalnya, fitur buah bisa berupa buah (seperti pisang atau apel), berat, warna, atau harga. Dalam dataset contoh ini, item memiliki tiga fitur: jenis buah, warna, dan berat.

Dalam kebanyakan kasus, menerapkan teknik pengelompokkan data ke kumpulan buah seperti yang dijelaskan di atas memungkinkan Anda untuk

Ambil kelompok (kelompok) item serupa.

  • Anda dapat mengetahui bahwa buah Anda terdiri dari beberapa kelompok. Setelah itu, jika Anda memilih buah acak, Anda akan dapat membuat pernyataan tentang item itu sebagai bagian dari salah satu grup N. Ambil perwakilan kelompok dari masing-masing kelompok.

  • Dalam contoh ini, perwakilan cluster akan memilih satu jenis buah dari keranjang dan menyingkirkannya. Ciri khas buah ini adalah buah yang paling mewakili gugusnya. Setelah selesai berkerumun, kumpulan data Anda diatur dan dibagi menjadi pengelompokan alami.

Pengelompokan data menunjukkan struktur dalam data dengan mengekstrak pengelompokan alami dari kumpulan data. Oleh karena itu, menemukan kumpulan merupakan langkah penting untuk merumuskan gagasan dan hipotesis tentang struktur data Anda dan mendapatkan wawasan untuk memahaminya dengan lebih baik.

Pengelompokan data juga bisa menjadi cara untuk memodelkan data: Ini mewakili kumpulan data yang lebih besar oleh cluster atau perwakilan cluster.

Selain itu, analisis Anda mungkin berusaha memisahkan data ke dalam kelompok item serupa - seperti ketika

segmentasi pasar memproyeksikan data pasar sasaran ke dalam kelompok seperti Konsumen yang memiliki minat yang sama seperti masakan Mediterania)

  • Konsumen yang memiliki kebutuhan bersama (misalnya, mereka yang alergi makanan tertentu)

  • Mengidentifikasi kelompok pelanggan serupa dapat membantu Anda mengembangkan strategi pemasaran yang memenuhi kebutuhan kelompok tertentu.

Selain itu, pengelompokkan data juga dapat membantu Anda mengidentifikasi, mempelajari, atau memprediksi sifat item data baru - terutama bagaimana data baru dapat dikaitkan dengan pembuatan prediksi. Misalnya, dalam

pengenalan pola , menganalisis pola dalam data (seperti pola beli di wilayah atau kelompok usia tertentu) dapat membantu Anda mengembangkan analisis prediktif - dalam hal ini, memprediksi sifat item data masa depan yang dapat cocok dengan pola yang mapan. Contoh keranjang buah menggunakan pengelompokan data untuk membedakan antara item data yang berbeda. Misalkan bisnis Anda merakit keranjang buah yang spesial, dan buah baru yang tidak dikenal diperkenalkan ke pasar. Anda ingin mempelajari atau memprediksi kumpulan item baru yang akan dimiliki jika Anda menambahkannya ke keranjang buah.

Karena Anda telah menerapkan pengelompokkan data ke kumpulan buah, Anda memiliki empat kelompok - yang membuatnya lebih mudah untuk memprediksi cluster mana (jenis buah tertentu) yang sesuai untuk item baru. Yang harus Anda lakukan adalah membandingkan buah yang tidak diketahui ke empat cluster lainnya dan mengidentifikasi cluster mana yang paling sesuai.

Meskipun proses ini mungkin tampak jelas bagi seseorang yang bekerja dengan kumpulan data kecil, ini tidak begitu jelas dalam skala yang lebih besar - bila Anda harus mengumpulkan jutaan item tanpa memeriksa masing-masing.Kompleksitas menjadi eksponensial saat dataset berukuran besar, beragam, dan relatif tidak koheren - itulah sebabnya algoritma clustering ada: Komputer melakukan jenis pekerjaan terbaik.

Dasar-dasar Data Cluster dalam Analisis Prediktif - dummies

Pilihan Editor

SharePoint 2010 Edit Menu - dummies

SharePoint 2010 Edit Menu - dummies

SharePoint 2010 menyediakan dua metode untuk bekerja dengan dokumen. Setiap dokumen memiliki menu Edit yang dapat Anda gunakan untuk mengambil beberapa tindakan pada dokumen itu, seperti memeriksanya untuk diedit. Ribbon juga menampilkan serangkaian tindakan yang dapat dilakukan pada masing-masing dokumen atau sekelompok dokumen yang dipilih. Mengakses ...

SharePoint 2010 Halaman Master dan Galeri Tata Letak Halaman - dummies

SharePoint 2010 Halaman Master dan Galeri Tata Letak Halaman - dummies

Jika Anda berada di situs kolaborasi SharePoint 2010 koleksi, Anda bisa mencatat galeri Master Page di Galeri, namun tidak ada link untuk menerapkan halaman utama di bagian Look and Feel. Di situs penerbitan, Anda memiliki galeri Halaman Utama dan Galeri Page Layout serta pilihan Master Page di ...

Kerangka situs Business Intelligence Center SharePoint 2010 - dummies

Kerangka situs Business Intelligence Center SharePoint 2010 - dummies

Template situs Business Intelligence Center yang baru di SharePoint 2010 menyatukan semuanya untuk Anda guna memantau, menganalisis, dan mewakili data kinerja dan hasil dalam organisasi Anda. Untuk membuat situs berdasarkan template Business Intelligence Center, Anda harus memiliki fitur PerformancePoint Services Site Collection yang diaktifkan. Jika Anda bukan ...

Pilihan Editor

Manfaat Memotret di Alam pada masa siang hari

Manfaat Memotret di Alam pada masa siang hari

Jika Anda kebetulan melakukan pemotretan di alam tengah hari, maka Anda mungkin memiliki waktu yang lebih sulit menemukan cahaya yang memiliki arah atau kualitas yang Anda inginkan. Matahari bertumpu tinggi di langit untuk sebagian besar hari itu, berseri lurus ke bawah pada subjek Anda ...

Manfaat Kamera Digital Kompak untuk Fotografi HDR

Manfaat Kamera Digital Kompak untuk Fotografi HDR

(Kadang disebut titik digital - dan - kamera shoot) adalah yang termurah masuk ke fotografi dengan rentang dinamis tinggi. Anda bisa membelinya seharga sekitar $ 100 dan memulai karir Anda tanpa harus mendapatkan hipotek kedua di rumah Anda. Berikut adalah beberapa model yang bisa sesuai dengan tagihan. Nikon Coolpix S220 dan Canon PowerShot A480 ...

HDR hitam-putih: Berwarna dengan Elemen Variasi Warna Alat - dummies

HDR hitam-putih: Berwarna dengan Elemen Variasi Warna Alat - dummies

Salah satu pilihan untuk mewarnai gambar kisaran dinamis hitam-putih tinggi (HDR) di Photoshop Elements adalah dengan menggunakan alat Variasi Warna. Beberapa kontrol tersedia di sini dimana Anda dapat menambah atau mengurangi warna pada daerah nada tertentu. Dengan kata lain, jika Anda ingin meningkatkan warna hijau dalam bayang-bayang, Anda bisa. Kelemahannya adalah bahwa ...

Pilihan Editor

Membangun Swift Outlets and Actions with Xcode - dummies

Membangun Swift Outlets and Actions with Xcode - dummies

Xcode memiliki Interface Builder yang terpasang di dalamnya sehingga Anda dapat merancang antarmuka Anda secara grafis Kunci untuk membuat semuanya bekerja adalah menghubungkan elemen grafis dari Interface Builder ke file Swift Anda. Xcode memudahkan - cukup ikuti langkah berikut: Buka Utama. storyboard Papan cerita utama Anda mungkin memiliki nama yang berbeda; ini ...

Memilih Bagaimana Melaksanakan Fungsi di Swift - dummies

Memilih Bagaimana Melaksanakan Fungsi di Swift - dummies

Saat Anda sedang berpikir untuk membuat sebuah aplikasi, bagaimana caranya? Anda memutuskan bagaimana menerapkan fungsinya? Swift, bersama dengan kerangka Cocoa and Cocoa Touch, menyediakan berbagai macam alat untuk membantu Anda. Berikut adalah daftar beberapa pertanyaan untuk diajukan kepada diri sendiri saat menentukan mana yang akan digunakan: Apakah ini sesuatu yang ...

Memoles Alat Pengembangan Anda untuk Pemasar Kakao - dummies

Memoles Alat Pengembangan Anda untuk Pemasar Kakao - dummies

Kakao adalah salah satu jenis program yang dapat Anda lakukan dengan Apple's Alat pengembang. Kakao adalah kumpulan alat dan perpustakaan yang memungkinkan Anda mendapatkan hasil maksimal dari pemrograman Mac OS X. Banyak fitur membuat Cocoa hebat, termasuk yang berikut: Desain berorientasi objek modular Penggunaan kerangka kerja Desain antarmuka visual Mengapa program dengan ...