Perangkak web: Perbedaan antara revisi
Impor teks terkontrol dari Wikipedia bahasa Indonesia; revisi 28713145; atribusi sumber disertakan. |
Presentation V4: sitasi, referensi, Math, Wikimedia Commons, dan atribusi |
||
| Baris 1: | Baris 1: | ||
'''Perangkak web''' (), merupakan mesin/[[perangkat lunak]] yang secara sistematis menjelajahi [[Waring Wera Wanua]] dan biasanya dioperasikan oleh mesin pencari untuk tujuan pengindeksan maupun untuk tujuan pengarsipan. | '''Perangkak web'''<ref>[https://kbbi.kemdikbud.go.id/entri/ Arti kata perangkak web]. ''KBBI Daring''.</ref> (), merupakan mesin/[[perangkat lunak]] yang secara sistematis menjelajahi [[Waring Wera Wanua]] dan biasanya dioperasikan oleh mesin pencari untuk tujuan pengindeksan<ref>Quan Bai. [https://www.sciencedirect.com/science/article/pii/S1877050914005407 Analysis and Detection of Bogus Behavior in Web Crawler Measurement]. ''Procedia Computer Science''. 2014-01-01. Vol. 31. hlm. 1084–1091. doi:10.1016/j.procs.2014.05.363.</ref> maupun untuk tujuan pengarsipan.<ref>Matt Smithers. [https://clockss.org/web-archiving-the-process-of-collecting-and-storing-websites-and-web-pages-for-long-term-access-and-preservation/ Web Archiving: The process of collecting and storing websites and web pages for long-term access and preservation]. ''CLOCKSS''. 2024-09-11.</ref> | ||
Cara kerja perangkak web adalah dengan cara mengunjungi [[Lokator Sumber Seragam|URL]] web tujuan, dan berkomunikasi dengan peladen web yang merespons URL tersebut, perangkak web mengidentifikasi semua [[pranala]] di halaman web yang diambil dan menambahkannya ke daftar URL yang akan dikunjungi, atau yang dikenal dengan istilah ''crawl frontier''. Pada saat perangkak web melakukan pengarsipan, perangkap akan menyalin dan menyimpan informasi yang ada pada web tersebut, kemudian arsip web akan disimpan, sehingga dapat dilihat, dibaca, dan dinavigasi seolah-olah berada di web asli langsung. | Cara kerja perangkak web adalah dengan cara mengunjungi [[Lokator Sumber Seragam|URL]] web tujuan, dan berkomunikasi dengan peladen web yang merespons URL tersebut, perangkak web mengidentifikasi semua [[pranala]] di halaman web yang diambil dan menambahkannya ke daftar URL yang akan dikunjungi, atau yang dikenal dengan istilah ''crawl frontier''. Pada saat perangkak web melakukan pengarsipan, perangkap akan menyalin dan menyimpan informasi yang ada pada web tersebut, kemudian arsip web akan disimpan, sehingga dapat dilihat, dibaca, dan dinavigasi seolah-olah berada di web asli langsung.<ref>[https://www.worldcat.org/oclc/262691786 Web archiving]. Springer. 2006. ISBN 978-3-540-46332-0.</ref> | ||
== Daftar perangkak web == | == Daftar perangkak web == | ||
| Baris 32: | Baris 32: | ||
== Referensi == | == Referensi == | ||
<references /> | |||
== Sumber dan atribusi == | == Sumber dan atribusi == | ||
Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=Perangkak+web&oldid=28713145 Wikipedia bahasa Indonesia], revisi 28713145 (2025-12-18T04:16:01Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku. | Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=Perangkak+web&oldid=28713145 Wikipedia bahasa Indonesia], revisi 28713145 (2025-12-18T04:16:01Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku. | ||
<!-- WIKI_UNISSULA_PRESENTATION_V4 --> | |||
Revisi terkini sejak 25 Agustus 2026 09.10
Perangkak web[1] (), merupakan mesin/perangkat lunak yang secara sistematis menjelajahi Waring Wera Wanua dan biasanya dioperasikan oleh mesin pencari untuk tujuan pengindeksan[2] maupun untuk tujuan pengarsipan.[3]
Cara kerja perangkak web adalah dengan cara mengunjungi URL web tujuan, dan berkomunikasi dengan peladen web yang merespons URL tersebut, perangkak web mengidentifikasi semua pranala di halaman web yang diambil dan menambahkannya ke daftar URL yang akan dikunjungi, atau yang dikenal dengan istilah crawl frontier. Pada saat perangkak web melakukan pengarsipan, perangkap akan menyalin dan menyimpan informasi yang ada pada web tersebut, kemudian arsip web akan disimpan, sehingga dapat dilihat, dibaca, dan dinavigasi seolah-olah berada di web asli langsung.[4]
Daftar perangkak web
Beberapa perangkak web adalah sebagai berikut:
Perangkak web dengan sumber terbuka
Beberapa perangkak web sumber terbuka:
- GNU Wget
- GRUB
- Heritrix
- ht://Dig
- HTTrack
- mnoGoSearch
- Apache Nutch
- Open Search Server
- Scrapy
- Seeks
- StormCrawler
- tkWWW Robot
- Xapian
- YaCy
Perangkap web komersial
Beberapa perangkap web berbayar:
Referensi
- ↑ Arti kata perangkak web. KBBI Daring.
- ↑ Quan Bai. Analysis and Detection of Bogus Behavior in Web Crawler Measurement. Procedia Computer Science. 2014-01-01. Vol. 31. hlm. 1084–1091. doi:10.1016/j.procs.2014.05.363.
- ↑ Matt Smithers. Web Archiving: The process of collecting and storing websites and web pages for long-term access and preservation. CLOCKSS. 2024-09-11.
- ↑ Web archiving. Springer. 2006. ISBN 978-3-540-46332-0.
Sumber dan atribusi
Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 28713145 (2025-12-18T04:16:01Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.