Lompat ke isi

Penggalian web: Perbedaan antara revisi

Ensiklopedia Pengetahuan Universitas Islam Sultan Agung
Maintenance script (bicara | kontrib)
Impor teks terkontrol dari Wikipedia bahasa Indonesia; revisi 28701396; atribusi sumber disertakan.
 
Maintenance script (bicara | kontrib)
Presentation V4: sitasi, referensi, Math, Wikimedia Commons, dan atribusi
 
Baris 3: Baris 3:
Biasanya teknik ini diterapkan pada sebuah bot agar bisa membuat proses yang harusnya dilakukan secara manual menjadi otomatis. Ketika kita menjumpai sebuah situs yang membatasi kuota (jatah) [[Antarmuka pemrograman aplikasi|API]] (''application programming interface'') atau bahkan tidak menyediakan sama sekali, maka penggalian web akan sangat dibutuhkan sebagai langkah pengambilan data.
Biasanya teknik ini diterapkan pada sebuah bot agar bisa membuat proses yang harusnya dilakukan secara manual menjadi otomatis. Ketika kita menjumpai sebuah situs yang membatasi kuota (jatah) [[Antarmuka pemrograman aplikasi|API]] (''application programming interface'') atau bahkan tidak menyediakan sama sekali, maka penggalian web akan sangat dibutuhkan sebagai langkah pengambilan data.


'''Mengikis halaman web''' melibatkan ekstraksi [[Laman web|halaman web]] dan kemudian mengekstrak data darinya. Retrieval adalah pemuatan halaman (yang dilakukan browser saat pengguna melihat halaman). Dengan demikian, pemindaian web adalah komponen utama dari web scraping untuk mengekstrak halaman untuk diproses lebih lanjut. Setelah ekstraksi, ekstraksi dapat dilakukan. Konten halaman dapat dianalisis, dicari, dan diformat ulang, serta datanya disalin ke dalam spreadsheet atau diunggah ke database. Web scraper biasanya mengekstrak sesuatu dari sebuah halaman untuk digunakan di tempat lain untuk tujuan lain. Contohnya termasuk menemukan dan menyalin nama dan nomor telepon, perusahaan dan URL atau alamat email mereka ke dalam daftar (penggalian kontak) menggunakan pemindaian web, pengenalan pola, mengumpulkan data dari [[media sosial]] dan jaringan profesional, pencarian WHOIS, dan banyak lagi.
'''Mengikis halaman web''' melibatkan ekstraksi [[Laman web|halaman web]] dan kemudian mengekstrak data darinya.<ref>[https://www.fortra.com/resources/guides/what-is-web-scraping What is Web Scraping? A Complete Guide]. ''www.fortra.com''.</ref> Retrieval adalah pemuatan halaman (yang dilakukan browser saat pengguna melihat halaman).<ref>[https://developer.mozilla.org/en-US/docs/Web/Performance/Guides/How_browsers_work Populating the page: how browsers work]. ''developer.mozilla.org''.</ref> Dengan demikian, pemindaian web adalah komponen utama dari web scraping untuk mengekstrak halaman untuk diproses lebih lanjut.<ref>[https://www.zyte.com/learn/difference-between-web-scraping-and-web-crawling/ Web crawling vs web scraping]. ''www.zyte.com''.</ref> Setelah ekstraksi, ekstraksi dapat dilakukan. Konten halaman dapat dianalisis, dicari, dan diformat ulang, serta datanya disalin ke dalam spreadsheet atau diunggah ke database.<ref>[https://www.octoparse.com/blog/scraping-data-from-website-to-excel 3 Easy Ways to Scrape Website to Excel]. ''www.octoparse.com''.</ref> Web scraper biasanya mengekstrak sesuatu dari sebuah halaman untuk digunakan di tempat lain untuk tujuan lain.<ref>[https://r4ds.hadley.nz/webscraping.html 24 Web scraping]. ''r4ds.hadley.nz''.</ref> Contohnya termasuk menemukan dan menyalin nama dan nomor telepon, perusahaan dan URL atau alamat email mereka ke dalam daftar (penggalian kontak) menggunakan pemindaian web, pengenalan pola, mengumpulkan data dari [[media sosial]] dan jaringan profesional, pencarian WHOIS, dan banyak lagi.<ref>[https://mailwarm.io/blog/email-scraping-tools Email Scraping Tools: A Comprehensive Guide]. ''mailwarm.io''.</ref>


Selain mengumpulkan kontak, pengumpulan data web digunakan sebagai komponen aplikasi yang digunakan untuk pengindeksan web, penambangan web  dan penambangan data, pemantauan perubahan harga dan perbandingan harga secara online, mengumpulkan ulasan produk (untuk memantau pesaing), mengumpulkan daftar real estat, memantau data cuaca, mendeteksi perubahan situs web, penelitian, melacak keberadaan dan reputasi web, penggabungan web, dan integrasi data web.
Selain mengumpulkan kontak, pengumpulan data web digunakan sebagai komponen aplikasi yang digunakan untuk pengindeksan web,<ref>[https://www.wix.com/encyclopedia/definition/web-indexing Web Indexing]. ''www.wix.com''.</ref> penambangan web<ref>[https://www.geeksforgeeks.org/web-mining/ Web Mining]. ''www.geeksforgeeks.org''.</ref> dan penambangan data, pemantauan perubahan harga dan perbandingan harga secara online, mengumpulkan ulasan produk (untuk memantau pesaing),<ref>[https://feedcheck.co/blog/how-to-do-a-competitor-product-analysis-by-review-monitoring/ How to do a competitor product analysis by review monitoring]. ''feedcheck.co''.</ref> mengumpulkan daftar real estat, memantau data cuaca, mendeteksi perubahan situs web, penelitian, melacak keberadaan dan reputasi web, penggabungan web, dan integrasi data web.
 
Halaman web dibuat menggunakan bahasa markup berbasis teks (HTML dan XHTML) dan sering kali berisi banyak data yang berguna dalam bentuk teks. Namun, sebagian besar halaman web dirancang untuk pengguna akhir, bukan untuk kemudahan penggunaan otomatis. Sebagai hasilnya, alat dan perangkat lunak khusus telah dikembangkan untuk memfasilitasi penguraian halaman web. Aplikasi penguraian halaman web termasuk [[riset pasar]], perbandingan harga, pemantauan konten, dan banyak lagi. Perusahaan mengandalkan layanan penguraian halaman web untuk mengumpulkan dan memanfaatkan data ini secara efisien.


Halaman web dibuat menggunakan bahasa markup berbasis teks (HTML dan XHTML) dan sering kali berisi banyak data yang berguna dalam bentuk teks.<ref>[https://www.w3schools.com/html/html_xhtml.asp HTML Versus XHTML]. ''www.w3schools.com''.</ref> Namun, sebagian besar halaman web dirancang untuk pengguna akhir, bukan untuk kemudahan penggunaan otomatis. Sebagai hasilnya, alat dan perangkat lunak khusus telah dikembangkan untuk memfasilitasi penguraian halaman web. Aplikasi penguraian halaman web termasuk [[riset pasar]], perbandingan harga, pemantauan konten, dan banyak lagi. Perusahaan mengandalkan layanan penguraian halaman web untuk mengumpulkan dan memanfaatkan data ini secara efisien.


== Referensi ==
== Referensi ==
 
<references />
 


== Sumber dan atribusi ==
== Sumber dan atribusi ==


Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=Penggalian+web&oldid=28701396 Wikipedia bahasa Indonesia], revisi 28701396 (2025-12-15T08:59:16Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.
Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=Penggalian+web&oldid=28701396 Wikipedia bahasa Indonesia], revisi 28701396 (2025-12-15T08:59:16Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.
<!-- WIKI_UNISSULA_PRESENTATION_V4 -->

Revisi terkini sejak 23 Agustus 2026 18.07

Penggalian web adalah suatu kegiatan pengambilan data tertentu secara semi-terstruktur dari sebuah halaman situs web. Halaman tersebut umumnya dibangun menggunakan bahasa markup seperti HTML atau XHTML.

Biasanya teknik ini diterapkan pada sebuah bot agar bisa membuat proses yang harusnya dilakukan secara manual menjadi otomatis. Ketika kita menjumpai sebuah situs yang membatasi kuota (jatah) API (application programming interface) atau bahkan tidak menyediakan sama sekali, maka penggalian web akan sangat dibutuhkan sebagai langkah pengambilan data.

Mengikis halaman web melibatkan ekstraksi halaman web dan kemudian mengekstrak data darinya.[1] Retrieval adalah pemuatan halaman (yang dilakukan browser saat pengguna melihat halaman).[2] Dengan demikian, pemindaian web adalah komponen utama dari web scraping untuk mengekstrak halaman untuk diproses lebih lanjut.[3] Setelah ekstraksi, ekstraksi dapat dilakukan. Konten halaman dapat dianalisis, dicari, dan diformat ulang, serta datanya disalin ke dalam spreadsheet atau diunggah ke database.[4] Web scraper biasanya mengekstrak sesuatu dari sebuah halaman untuk digunakan di tempat lain untuk tujuan lain.[5] Contohnya termasuk menemukan dan menyalin nama dan nomor telepon, perusahaan dan URL atau alamat email mereka ke dalam daftar (penggalian kontak) menggunakan pemindaian web, pengenalan pola, mengumpulkan data dari media sosial dan jaringan profesional, pencarian WHOIS, dan banyak lagi.[6]

Selain mengumpulkan kontak, pengumpulan data web digunakan sebagai komponen aplikasi yang digunakan untuk pengindeksan web,[7] penambangan web[8] dan penambangan data, pemantauan perubahan harga dan perbandingan harga secara online, mengumpulkan ulasan produk (untuk memantau pesaing),[9] mengumpulkan daftar real estat, memantau data cuaca, mendeteksi perubahan situs web, penelitian, melacak keberadaan dan reputasi web, penggabungan web, dan integrasi data web.

Halaman web dibuat menggunakan bahasa markup berbasis teks (HTML dan XHTML) dan sering kali berisi banyak data yang berguna dalam bentuk teks.[10] Namun, sebagian besar halaman web dirancang untuk pengguna akhir, bukan untuk kemudahan penggunaan otomatis. Sebagai hasilnya, alat dan perangkat lunak khusus telah dikembangkan untuk memfasilitasi penguraian halaman web. Aplikasi penguraian halaman web termasuk riset pasar, perbandingan harga, pemantauan konten, dan banyak lagi. Perusahaan mengandalkan layanan penguraian halaman web untuk mengumpulkan dan memanfaatkan data ini secara efisien.

Referensi

Sumber dan atribusi

Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 28701396 (2025-12-15T08:59:16Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.