LeNet: Perbedaan antara revisi
Impor teks terkontrol dari Wikipedia bahasa Indonesia; revisi 29568195; atribusi sumber disertakan. |
Presentation V4: sitasi, referensi, Math, Wikimedia Commons, dan atribusi |
||
| Baris 1: | Baris 1: | ||
'''LeNet''' adalah sebuah struktur [[jaringan saraf konvolusional]] yang diusulkan oleh [[Yann LeCun|LeCun]], dkk. pada tahun 1998. Secara umum, LeNet mengacu pada LeNet-5 dan merupakan [[jaringan saraf konvolusional]] (CNN) sederhana. CNN merupakan bagian dari [[jaringan saraf umpan maju]] yang [[Sel saraf|neuron]]-neuron buatannya dapat merespons sel-sel di sekitarnya dalam rentang cakupan tertentu dan bekerja dengan baik dalam pemrosesan gambar berskala besar. | '''LeNet''' adalah sebuah struktur [[jaringan saraf konvolusional]] yang diusulkan oleh [[Yann LeCun|LeCun]], dkk. pada tahun 1998.<ref>Y. Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf Gradient-based learning applied to document recognition]. ''Proceedings of the IEEE''. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791.</ref> Secara umum, LeNet mengacu pada LeNet-5 dan merupakan [[jaringan saraf konvolusional]] (CNN) sederhana. CNN merupakan bagian dari [[jaringan saraf umpan maju]] yang [[Sel saraf|neuron]]-neuron buatannya dapat merespons sel-sel di sekitarnya dalam rentang cakupan tertentu dan bekerja dengan baik dalam pemrosesan gambar berskala besar. | ||
== Sejarah pengembangan == | == Sejarah pengembangan == | ||
LeNet-5 adalah salah satu [[jaringan saraf konvolusional]] paling awal yang juga berperan dalam mempromosikan pengembangan [[Pemelajaran dalam|pembelajaran mendalam]]. Sejak 1988, setelah penelitian bertahun-tahun dan banyak sekali percobaan, karya rintisan tersebut diberi nama LeNet-5. | LeNet-5 adalah salah satu [[jaringan saraf konvolusional]] paling awal yang juga berperan dalam mempromosikan pengembangan [[Pemelajaran dalam|pembelajaran mendalam]]. Sejak 1988, setelah penelitian bertahun-tahun dan banyak sekali percobaan, karya rintisan tersebut diberi nama LeNet-5. | ||
Pada tahun 1989, untuk pertama kalinya, [[Yann LeCun]], dkk. di [[Bell Labs]] mengimplementasikan [[algoritma perambatan mundur]] untuk aplikasi praktis. Mereka percaya bahwa kemampuan untuk mempelajari generalisasi jaringan dapat ditingkatkan secara signifikan dengan membatasi domain masalah. Ia menggabungkan jaringan saraf konvolusional yang telah dilatih dengan algoritma perambatan mundur untuk membaca angka tulisan tangan dan berhasil mengimplementasikan nomor [[kode pos]] tulisan tangan yang disediakan oleh [[Jawatan Pos Amerika Serikat|Jawatan Pos AS]]. Prototipe inilah yang nantinya menjadi LeNet. Pada tahun yang sama, LeCun menguraikan masalah pengenalan digit tulisan tangan kecil dalam artikel jurnal lain. Ia berhasil menunjukkan bahwa meskipun masalah tersebut dapat dipisahkan secara linear, jaringan lapisan tunggal memiliki kemampuan generalisasi yang buruk. Namun, ketika menggunakan pendeteksi [[Fitur (arkeologi)|fitur]] dengan invarian-geser (''shift-invariant'') pada jaringan multi-lapis berkendala (''multi-layered, constrained network''), model tersebut dapat memiliki performa yang sangat baik. Ia meyakini bahwa hasil ini membuktikan bahwa dengan meminimalkan jumlah parameter bebas dalam jaringan saraf dapat meningkatkan kemampuan generalisasinya. | Pada tahun 1989, untuk pertama kalinya, [[Yann LeCun]], dkk. di [[Bell Labs]] mengimplementasikan [[algoritma perambatan mundur]] untuk aplikasi praktis. Mereka percaya bahwa kemampuan untuk mempelajari generalisasi jaringan dapat ditingkatkan secara signifikan dengan membatasi domain masalah. Ia menggabungkan jaringan saraf konvolusional yang telah dilatih dengan algoritma perambatan mundur untuk membaca angka tulisan tangan dan berhasil mengimplementasikan nomor [[kode pos]] tulisan tangan yang disediakan oleh [[Jawatan Pos Amerika Serikat|Jawatan Pos AS]]. Prototipe inilah yang nantinya menjadi LeNet.<ref>Y. LeCun. [https://archive.org/details/sim_neural-computation_winter-1989_1_4/page/541 Backpropagation Applied to Handwritten Zip Code Recognition]. ''Neural Computation''. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541.</ref> Pada tahun yang sama, LeCun menguraikan masalah pengenalan digit tulisan tangan kecil dalam artikel jurnal lain. Ia berhasil menunjukkan bahwa meskipun masalah tersebut dapat dipisahkan secara linear, jaringan lapisan tunggal memiliki kemampuan generalisasi yang buruk. Namun, ketika menggunakan pendeteksi [[Fitur (arkeologi)|fitur]] dengan invarian-geser (''shift-invariant'') pada jaringan multi-lapis berkendala (''multi-layered, constrained network''), model tersebut dapat memiliki performa yang sangat baik. Ia meyakini bahwa hasil ini membuktikan bahwa dengan meminimalkan jumlah parameter bebas dalam jaringan saraf dapat meningkatkan kemampuan generalisasinya.<ref>Yann Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-89.pdf Generalization and network design strategies]. ''Technical Report CRG-TR-89-4''. Department of Computer Science, University of Toronto. June 1989.</ref> | ||
Pada tahun 1990, mereka kembali memublikasikan makalah ilmiah yang menjelaskan penerapan jaringan perambatan mundur dalam pengenalan digit tulisan tangan. Pada makalah ini, mereka hanya melakukan sedikit pra-pemrosesan pada data dengan model yang dirancang secara cermat dan berkendala besar. Data masukan dalam bentuk citra berjumlah banyak yang masing-masing berisi satu digit angka. Hasil pengujian pada data digital kode pos yang disediakan oleh [[Jawatan Pos Amerika Serikat|Jawatan Pos]] AS menunjukkan bahwa model tersebut memiliki tingkat kesalahan hanya sebesar 1% dan penolakan sekitar 9%. | Pada tahun 1990, mereka kembali memublikasikan makalah ilmiah yang menjelaskan penerapan jaringan perambatan mundur dalam pengenalan digit tulisan tangan. Pada makalah ini, mereka hanya melakukan sedikit pra-pemrosesan pada data dengan model yang dirancang secara cermat dan berkendala besar. Data masukan dalam bentuk citra berjumlah banyak yang masing-masing berisi satu digit angka. Hasil pengujian pada data digital kode pos yang disediakan oleh [[Jawatan Pos Amerika Serikat|Jawatan Pos]] AS menunjukkan bahwa model tersebut memiliki tingkat kesalahan hanya sebesar 1% dan penolakan sekitar 9%.<ref>Y. LeCun. [http://yann.lecun.com/exdb/publis/pdf/lecun-90c.pdf Handwritten digit recognition with a back-propagation network]. ''Advances in Neural Information Processing Systems''. June 1990. Vol. 2. hlm. 396–404.</ref> | ||
Setelah itu, penelitian mereka berlanjut untuk empat tahun berikutnya. Pada tahun 1994, [[MNIST|kumpulan data MNIST]] berhasil dikembangkan. Namun, karena LeNet-1 sebelumnya terlalu kecil, LeNet-4 dikembangkan untuk dilatih pada data baru tersebut. Setahun kemudian, kelompok [[AT&T]] [[Bell Labs]] memperkenalkan LeNet-5. Selain itu, mereka juga membandingkan berbagai metode pengenalan karakter tulisan tangan untuk mengidentifikasi berbagai tugas ''[[Tolok ukur (komputasi)|benchmark]]'' dandidapatkan bahwa jaringan terbaru mengungguli model-model lain. Pada tahun 1998, [[Yann LeCun]], [[Leon Bottou]], [[Yoshua Bengio]], dan Patrick Haffner memperkenalkan contoh [[aplikasi]] praktis jaringan saraf, seperti dua sistem untuk mengenali karakter tulisan tangan secara daring dan model yang dapat membaca jutaan cek per hari. | Setelah itu, penelitian mereka berlanjut untuk empat tahun berikutnya. Pada tahun 1994, [[MNIST|kumpulan data MNIST]] berhasil dikembangkan. Namun, karena LeNet-1 sebelumnya terlalu kecil, LeNet-4 dikembangkan untuk dilatih pada data baru tersebut.<ref>http://yann.lecun.com/exdb/publis/pdf/bottou-94.pdf</ref> Setahun kemudian, kelompok [[AT&T]] [[Bell Labs]] memperkenalkan LeNet-5. Selain itu, mereka juga membandingkan berbagai metode pengenalan karakter tulisan tangan untuk mengidentifikasi berbagai tugas ''[[Tolok ukur (komputasi)|benchmark]]'' dandidapatkan bahwa jaringan terbaru mengungguli model-model lain.<ref>https://www.eecis.udel.edu/~shatkay/Course/papers/NetworksAndCNNClasifiersIntroVapnik95.pdf</ref> Pada tahun 1998, [[Yann LeCun]], [[Leon Bottou]], [[Yoshua Bengio]], dan Patrick Haffner memperkenalkan contoh [[aplikasi]] praktis jaringan saraf, seperti dua sistem untuk mengenali karakter tulisan tangan secara daring dan model yang dapat membaca jutaan cek per hari.<ref>Y. Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf Gradient-based learning applied to document recognition]. ''Proceedings of the IEEE''. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791. Lecun, Y.; Bottou, L.; Bengio, Y.; Haffner, P. (1998). [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf "Gradient-based learning applied to document recognition"] (PDF) . ''Proceedings of the IEEE''. '''86''' (11): 2278–2324. doi:10.1109/5.726791. S2CID [https://api.semanticscholar.org/CorpusID:14542261 14542261].</ref> | ||
Penelitian ini mencapai kesuksesan besar dan membangkitkan minat para akademisi dalam studi jaringan saraf. Meskipun arsitektur jaringan saraf terbaik saat ini tidak sama dengan LeNet, LeNet merupakan titik awal untuk sejumlah besar arsitektur jaringan saraf, dan juga menginspirasi penelitian di bidang tersebut. | Penelitian ini mencapai kesuksesan besar dan membangkitkan minat para akademisi dalam studi jaringan saraf. Meskipun arsitektur jaringan saraf terbaik saat ini tidak sama dengan LeNet, LeNet merupakan titik awal untuk sejumlah besar arsitektur jaringan saraf, dan juga menginspirasi penelitian di bidang tersebut. | ||
{| class="wikitable" | |||
|+Garis Waktu | |||
| tahun 1989 | |||
| Yann LeCun dkk. mengusulkan bentuk asli LeNet | |||
| LeCun Y., Boser B., Denker JS, Henderson D., Howard RE, Hubbard W. dan Jackel LD (1989). Backpropagation diterapkan pada pengenalan kode pos tulisan tangan. Komputasi Neural, 1(4):541-551. <ref>Y. LeCun. [https://archive.org/details/sim_neural-computation_winter-1989_1_4/page/541 Backpropagation Applied to Handwritten Zip Code Recognition]. ''Neural Computation''. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". ''Neural Computation''. '''1''' (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID [https://api.semanticscholar.org/CorpusID:41312633 41312633].</ref> | |||
|- | |||
| tahun 1989 | |||
| Yann LeCun membuktikan bahwa meminimalkan jumlah parameter bebas dalam jaringan saraf dapat meningkatkan kemampuan generalisasi jaringan saraf. | |||
| LeCun, Y. (1989). Strategi generalisasi dan desain jaringan. Laporan Teknis CRG-TR-89-4, Departemen Ilmu Komputer, Universitas Toronto. <ref>Yann Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-89.pdf Generalization and network design strategies]. ''Technical Report CRG-TR-89-4''. Department of Computer Science, University of Toronto. June 1989. Lecun, Yann (June 1989). [http://yann.lecun.com/exdb/publis/pdf/lecun-89.pdf "Generalization and network design strategies"] (PDF) . ''Technical Report CRG-TR-89-4''. Department of Computer Science, University of Toronto.</ref> | |||
|- | |||
| tahun 1990 | |||
| Makalah mereka menjelaskan penerapan jaringan backpropagation dalam pengenalan digit tulisan tangan sekali lagi | |||
| LeCun Y., Boser B., Denker JS, Henderson D., Howard RE, Hubbard W. dan Jackel LD (1990). Pengenalan digit tulisan tangan dengan jaringan propagasi balik. Kemajuan dalam Sistem Pemrosesan Informasi Neural 2 (NIPS*89). <ref>Y. LeCun. [http://yann.lecun.com/exdb/publis/pdf/lecun-90c.pdf Handwritten digit recognition with a back-propagation network]. ''Advances in Neural Information Processing Systems''. June 1990. Vol. 2. hlm. 396–404. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jacker, L. D. (June 1990). [http://yann.lecun.com/exdb/publis/pdf/lecun-90c.pdf "Handwritten digit recognition with a back-propagation network"] (PDF) . ''Advances in Neural Information Processing Systems''. '''2''': 396–404.</ref> | |||
|- | |||
| tahun 1994 | |||
| Database MNIST dan LeNet-4 dikembangkan | |||
| | |||
|- | |||
| tahun 1995 | |||
| LeNet-5 dikembangkan, berbagai metode yang diterapkan pada pengenalan karakter tulisan tangan ditinjau dan dibandingkan dengan tolok ukur pengenalan digit tulisan tangan standar. Hasilnya menunjukkan bahwa [[jaringan saraf konvolusional]] mengungguli semua model lainnya. | |||
| | |||
|- | |||
| tahun 1998 | |||
| Aplikasi praktis | |||
| LeCun, Y.; Bottou, L.; Bengio, Y. dan Haffner, P. (1998). Pembelajaran berbasis gradien diterapkan pada pengenalan dokumen. Prosiding IEEE. 86(11): 2278 - 2324. <ref>Y. Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf Gradient-based learning applied to document recognition]. ''Proceedings of the IEEE''. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791. Lecun, Y.; Bottou, L.; Bengio, Y.; Haffner, P. (1998). [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf "Gradient-based learning applied to document recognition"] (PDF) . ''Proceedings of the IEEE''. '''86''' (11): 2278–2324. doi:10.1109/5.726791. S2CID [https://api.semanticscholar.org/CorpusID:14542261 14542261].</ref> | |||
|} | |||
== Struktur == | == Struktur == | ||
Sebagai perwakilan jaringan saraf konvolusional awal, LeNet memiliki unit-unit dasar jaringan saraf konvolusional, seperti lapisan konvolusional (''convolutional layer''), lapisan penggabungan (''pooling layer''), dan lapisan terhubung sepenuhnya (''fully-connected layer'') yang merupakan dasar bagi pengembangan jaringan saraf konvolusional di masa mendatang. LeNet-5 terdiri dari tujuh lapisan dengan citra masukan berukuran 32*32 piksel. Selain lapisan masukan, setiap lapisan lainnya dapat [[Parameter kereta api|melatih parameter]] (seperti pada gambar). Cx merupakan representasi dari lapisan konvolusi, Sx merupakan representasi dari lapisan sub-sampling, Fx merupakan representasi dari lapisan koneksi lengkap, dan x merupakan representasi dari indeks lapisan.<ref>Y. LeCun. [https://archive.org/details/sim_neural-computation_winter-1989_1_4/page/541 Backpropagation Applied to Handwritten Zip Code Recognition]. ''Neural Computation''. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". ''Neural Computation''. '''1''' (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID [https://api.semanticscholar.org/CorpusID:41312633 41312633].</ref><ref>[https://www.cnblogs.com/wangguchangqing/p/10329402.html 卷积神经网络之LeNet - Brook_icv - 博客园]. ''www.cnblogs.com''.</ref><ref>[https://blog.csdn.net/happyorg/article/details/78274066 深度学习 CNN 卷积神经网络 LeNet-5 详解]. ''blog.csdn.net''.</ref> | |||
Sebagai perwakilan jaringan saraf konvolusional awal, LeNet memiliki unit-unit dasar jaringan saraf konvolusional, seperti lapisan konvolusional (''convolutional layer''), lapisan penggabungan (''pooling layer''), dan lapisan terhubung sepenuhnya (''fully-connected layer'') yang merupakan dasar bagi pengembangan jaringan saraf konvolusional di masa mendatang. LeNet-5 terdiri dari tujuh lapisan dengan citra masukan berukuran 32*32 piksel. Selain lapisan masukan, setiap lapisan lainnya dapat [[Parameter kereta api|melatih parameter]] (seperti pada gambar). Cx merupakan representasi dari lapisan konvolusi, Sx merupakan representasi dari lapisan sub-sampling, Fx merupakan representasi dari lapisan koneksi lengkap, dan x merupakan representasi dari indeks lapisan. | |||
Lapisan C1 adalah [[Lilitan|lapisan konvolusi]] dengan enam kernel konvolusi berukuran 5x5, sementara peta fiturnya berukuran 28x28 yang dapat mencegah informasi citra masukan keluar dari batas kernel konvolusi. | Lapisan C1 adalah [[Lilitan|lapisan konvolusi]] dengan enam kernel konvolusi berukuran 5x5, sementara peta fiturnya berukuran 28x28 yang dapat mencegah informasi citra masukan keluar dari batas kernel konvolusi. | ||
| Baris 30: | Baris 54: | ||
== Fitur == | == Fitur == | ||
* Setiap [[Jaringan saraf konvolusional|lapisan konvolusional]] mencakup tiga bagian: konvolusi, ''pooling'', dan [[fungsi aktivasi]] nonlinier | * Setiap [[Jaringan saraf konvolusional|lapisan konvolusional]] mencakup tiga bagian: konvolusi, ''pooling'', dan [[fungsi aktivasi]] nonlinier | ||
* Menggunakan konvolusi untuk mengekstraksi fitur spasial (Konvolusi awalnya disebut sebagai bidang reseptif) | * Menggunakan konvolusi untuk mengekstraksi fitur spasial (Konvolusi awalnya disebut sebagai bidang reseptif) | ||
| Baris 41: | Baris 64: | ||
Aplikasi LeNet yang paling klasik adalah untuk mengenali citra digit sederhana karena ia diciptakan karena itu. | Aplikasi LeNet yang paling klasik adalah untuk mengenali citra digit sederhana karena ia diciptakan karena itu. | ||
[[Yann LeCun]] dkk. membuat bentuk awal LeNet pada tahun 1989. Makalah ilmiah berjudul ''Backpropagation Applied to Handwrittern Zip code Recognition'' | [[Yann LeCun]] dkk. membuat bentuk awal LeNet pada tahun 1989. Makalah ilmiah berjudul ''Backpropagation Applied to Handwrittern Zip code Recognition'' <ref>Y. LeCun. [https://archive.org/details/sim_neural-computation_winter-1989_1_4/page/541 Backpropagation Applied to Handwritten Zip Code Recognition]. ''Neural Computation''. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". ''Neural Computation''. '''1''' (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID [https://api.semanticscholar.org/CorpusID:41312633 41312633].</ref> menunjukkan bagaimana kendala tersebut dapat diintegrasikan ke dalam jaringan [[Algoritma perambatan mundur|perambatan mundur]] melalui arsitektur jaringan yang berhasil diterapkan pada pengenalan angka kode pos tulisan tangan yang disediakan oleh Jawatan Pos Amerika.<ref>Y. LeCun. [https://archive.org/details/sim_neural-computation_winter-1989_1_4/page/541 Backpropagation Applied to Handwritten Zip Code Recognition]. ''Neural Computation''. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541.</ref> | ||
== Analisis pengembangan == | == Analisis pengembangan == | ||
LeNet-5 menunjukkan kebangkitan [[Jaringan saraf konvolusional|CNN]] dan mendefinisikan komponen dasar [[Jaringan saraf konvolusional|CNN]]. Namun, saat itu belum populer karena keterbatasan perangkat keras, terutama [[Unit pemroses grafis|GPU]] dan algoritma lain, seperti [[Mesin vektor pendukung|SVM]] yang dapat mencapai efek serupa atau bahkan melampaui LeNet. | LeNet-5 menunjukkan kebangkitan [[Jaringan saraf konvolusional|CNN]] dan mendefinisikan komponen dasar [[Jaringan saraf konvolusional|CNN]].<ref>Y. Lecun. [http://yann.lecun.com/exdb/publis/pdf/lecun-01a.pdf Gradient-based learning applied to document recognition]. ''Proceedings of the IEEE''. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791.</ref> Namun, saat itu belum populer karena keterbatasan perangkat keras, terutama [[Unit pemroses grafis|GPU]] dan algoritma lain, seperti [[Mesin vektor pendukung|SVM]] yang dapat mencapai efek serupa atau bahkan melampaui LeNet. | ||
Sejak keberhasilan AlexNet pada tahun 2012, [[Jaringan saraf konvolusional|CNN]] telah menjadi pilihan terbaik untuk aplikasi [[visi komputer]] dan berbagai jenis [[Jaringan saraf konvolusional|CNN]] telah dibuat, seperti seri R-[[Jaringan saraf konvolusional|CNN]]. Saat ini, model [[Jaringan saraf konvolusional|CNN]] sangat berbeda dari LeNet, tetapi semuanya dikembangkan berdasarkan LeNet. | Sejak keberhasilan AlexNet pada tahun 2012, [[Jaringan saraf konvolusional|CNN]] telah menjadi pilihan terbaik untuk aplikasi [[visi komputer]] dan berbagai jenis [[Jaringan saraf konvolusional|CNN]] telah dibuat, seperti seri R-[[Jaringan saraf konvolusional|CNN]]. Saat ini, model [[Jaringan saraf konvolusional|CNN]] sangat berbeda dari LeNet, tetapi semuanya dikembangkan berdasarkan LeNet. | ||
Arsitektur pohon berlapis tiga yang meniru LeNet-5 dan hanya terdiri dari satu lapisan konvolusional, telah mencapai tingkat keberhasilan yang sama pada dataset CIFAR-10. | Arsitektur pohon berlapis tiga yang meniru LeNet-5 dan hanya terdiri dari satu lapisan konvolusional, telah mencapai tingkat keberhasilan yang sama pada dataset CIFAR-10.<ref>Yuval Meir. ''Learning on tree architectures outperforms a convolutional feedforward network''. ''Scientific Reports''. 2023-01-30. Vol. 13 (1). hlm. 962. doi:10.1038/s41598-023-27986-6.</ref> | ||
Peningkatan jumlah filter untuk arsitektur LeNet menghasilkan peluruhan hukum daya pada tingkat kesalahan. Hasil ini menunjukkan bahwa jaringan dangkal dapat mencapai kinerja yang sama dengan arsitektur pemelajaran mendalam. | Peningkatan jumlah filter untuk arsitektur LeNet menghasilkan peluruhan hukum daya pada tingkat kesalahan. Hasil ini menunjukkan bahwa jaringan dangkal dapat mencapai kinerja yang sama dengan arsitektur pemelajaran mendalam.<ref>Yuval Meir. ''Efficient shallow learning as an alternative to deep learning''. ''Scientific Reports''. 2023-04-20. Vol. 13 (1). hlm. 5423. doi:10.1038/s41598-023-32559-8.</ref> | ||
== Referensi == | == Referensi == | ||
<references /> | |||
== Sumber dan atribusi == | == Sumber dan atribusi == | ||
Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=LeNet&oldid=29568195 Wikipedia bahasa Indonesia], revisi 29568195 (2026-08-12T22:06:42Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku. | Konten artikel ini diadaptasi dari [https://id.wikipedia.org/w/index.php?title=LeNet&oldid=29568195 Wikipedia bahasa Indonesia], revisi 29568195 (2026-08-12T22:06:42Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku. | ||
<!-- WIKI_UNISSULA_PRESENTATION_V4 --> | |||
Revisi terkini sejak 23 Agustus 2026 13.56
LeNet adalah sebuah struktur jaringan saraf konvolusional yang diusulkan oleh LeCun, dkk. pada tahun 1998.[1] Secara umum, LeNet mengacu pada LeNet-5 dan merupakan jaringan saraf konvolusional (CNN) sederhana. CNN merupakan bagian dari jaringan saraf umpan maju yang neuron-neuron buatannya dapat merespons sel-sel di sekitarnya dalam rentang cakupan tertentu dan bekerja dengan baik dalam pemrosesan gambar berskala besar.
Sejarah pengembangan
LeNet-5 adalah salah satu jaringan saraf konvolusional paling awal yang juga berperan dalam mempromosikan pengembangan pembelajaran mendalam. Sejak 1988, setelah penelitian bertahun-tahun dan banyak sekali percobaan, karya rintisan tersebut diberi nama LeNet-5.
Pada tahun 1989, untuk pertama kalinya, Yann LeCun, dkk. di Bell Labs mengimplementasikan algoritma perambatan mundur untuk aplikasi praktis. Mereka percaya bahwa kemampuan untuk mempelajari generalisasi jaringan dapat ditingkatkan secara signifikan dengan membatasi domain masalah. Ia menggabungkan jaringan saraf konvolusional yang telah dilatih dengan algoritma perambatan mundur untuk membaca angka tulisan tangan dan berhasil mengimplementasikan nomor kode pos tulisan tangan yang disediakan oleh Jawatan Pos AS. Prototipe inilah yang nantinya menjadi LeNet.[2] Pada tahun yang sama, LeCun menguraikan masalah pengenalan digit tulisan tangan kecil dalam artikel jurnal lain. Ia berhasil menunjukkan bahwa meskipun masalah tersebut dapat dipisahkan secara linear, jaringan lapisan tunggal memiliki kemampuan generalisasi yang buruk. Namun, ketika menggunakan pendeteksi fitur dengan invarian-geser (shift-invariant) pada jaringan multi-lapis berkendala (multi-layered, constrained network), model tersebut dapat memiliki performa yang sangat baik. Ia meyakini bahwa hasil ini membuktikan bahwa dengan meminimalkan jumlah parameter bebas dalam jaringan saraf dapat meningkatkan kemampuan generalisasinya.[3]
Pada tahun 1990, mereka kembali memublikasikan makalah ilmiah yang menjelaskan penerapan jaringan perambatan mundur dalam pengenalan digit tulisan tangan. Pada makalah ini, mereka hanya melakukan sedikit pra-pemrosesan pada data dengan model yang dirancang secara cermat dan berkendala besar. Data masukan dalam bentuk citra berjumlah banyak yang masing-masing berisi satu digit angka. Hasil pengujian pada data digital kode pos yang disediakan oleh Jawatan Pos AS menunjukkan bahwa model tersebut memiliki tingkat kesalahan hanya sebesar 1% dan penolakan sekitar 9%.[4]
Setelah itu, penelitian mereka berlanjut untuk empat tahun berikutnya. Pada tahun 1994, kumpulan data MNIST berhasil dikembangkan. Namun, karena LeNet-1 sebelumnya terlalu kecil, LeNet-4 dikembangkan untuk dilatih pada data baru tersebut.[5] Setahun kemudian, kelompok AT&T Bell Labs memperkenalkan LeNet-5. Selain itu, mereka juga membandingkan berbagai metode pengenalan karakter tulisan tangan untuk mengidentifikasi berbagai tugas benchmark dandidapatkan bahwa jaringan terbaru mengungguli model-model lain.[6] Pada tahun 1998, Yann LeCun, Leon Bottou, Yoshua Bengio, dan Patrick Haffner memperkenalkan contoh aplikasi praktis jaringan saraf, seperti dua sistem untuk mengenali karakter tulisan tangan secara daring dan model yang dapat membaca jutaan cek per hari.[7]
Penelitian ini mencapai kesuksesan besar dan membangkitkan minat para akademisi dalam studi jaringan saraf. Meskipun arsitektur jaringan saraf terbaik saat ini tidak sama dengan LeNet, LeNet merupakan titik awal untuk sejumlah besar arsitektur jaringan saraf, dan juga menginspirasi penelitian di bidang tersebut.
| tahun 1989 | Yann LeCun dkk. mengusulkan bentuk asli LeNet | LeCun Y., Boser B., Denker JS, Henderson D., Howard RE, Hubbard W. dan Jackel LD (1989). Backpropagation diterapkan pada pengenalan kode pos tulisan tangan. Komputasi Neural, 1(4):541-551. [8] |
| tahun 1989 | Yann LeCun membuktikan bahwa meminimalkan jumlah parameter bebas dalam jaringan saraf dapat meningkatkan kemampuan generalisasi jaringan saraf. | LeCun, Y. (1989). Strategi generalisasi dan desain jaringan. Laporan Teknis CRG-TR-89-4, Departemen Ilmu Komputer, Universitas Toronto. [9] |
| tahun 1990 | Makalah mereka menjelaskan penerapan jaringan backpropagation dalam pengenalan digit tulisan tangan sekali lagi | LeCun Y., Boser B., Denker JS, Henderson D., Howard RE, Hubbard W. dan Jackel LD (1990). Pengenalan digit tulisan tangan dengan jaringan propagasi balik. Kemajuan dalam Sistem Pemrosesan Informasi Neural 2 (NIPS*89). [10] |
| tahun 1994 | Database MNIST dan LeNet-4 dikembangkan | |
| tahun 1995 | LeNet-5 dikembangkan, berbagai metode yang diterapkan pada pengenalan karakter tulisan tangan ditinjau dan dibandingkan dengan tolok ukur pengenalan digit tulisan tangan standar. Hasilnya menunjukkan bahwa jaringan saraf konvolusional mengungguli semua model lainnya. | |
| tahun 1998 | Aplikasi praktis | LeCun, Y.; Bottou, L.; Bengio, Y. dan Haffner, P. (1998). Pembelajaran berbasis gradien diterapkan pada pengenalan dokumen. Prosiding IEEE. 86(11): 2278 - 2324. [11] |
Struktur
Sebagai perwakilan jaringan saraf konvolusional awal, LeNet memiliki unit-unit dasar jaringan saraf konvolusional, seperti lapisan konvolusional (convolutional layer), lapisan penggabungan (pooling layer), dan lapisan terhubung sepenuhnya (fully-connected layer) yang merupakan dasar bagi pengembangan jaringan saraf konvolusional di masa mendatang. LeNet-5 terdiri dari tujuh lapisan dengan citra masukan berukuran 32*32 piksel. Selain lapisan masukan, setiap lapisan lainnya dapat melatih parameter (seperti pada gambar). Cx merupakan representasi dari lapisan konvolusi, Sx merupakan representasi dari lapisan sub-sampling, Fx merupakan representasi dari lapisan koneksi lengkap, dan x merupakan representasi dari indeks lapisan.[12][13][14]
Lapisan C1 adalah lapisan konvolusi dengan enam kernel konvolusi berukuran 5x5, sementara peta fiturnya berukuran 28x28 yang dapat mencegah informasi citra masukan keluar dari batas kernel konvolusi.
Lapisan S2 adalah lapisan subsampling/pooling yang menghasilkan 6 grafik fitur berukuran 14x14. Setiap sel di setiap peta fitur terhubung ke ketetanggaan berukuran 2x2 di peta fitur yang sesuai di C1.
Lapisan C3 adalah lapisan konvolusi dengan 16 5-5 kernel konvolusi. Masukan dari enam peta fitur C3 pertama merupakan setiap subset berkesinambungan dari tiga peta fitur di S2, masukan dari enam peta fitur berikutnya berasal dari masukan dari empat subset berkesinambungan, dan masukan dari tiga peta fitur berikutnya berasal dari empat subset tidak berkesinambungan. Terakhir, masukan untuk grafik fitur terakhir berasal dari semua grafik fitur S2.
Lapisan S4 mirip dengan S2, dengan ukuran 2x2 dan keluaran 16 5x5 grafik fitur.
Lapisan C5 adalah lapisan konvolusi dengan 120 kernel konvolusi berukuran 5x5. Setiap sel terhubung ke lingkungan 5*5 pada semua 16 grafik fitur S4. Di sini, karena ukuran grafik fitur S4 juga 5x5, ukuran keluaran C5 adalah 1*1. Jadi S4 dan C5 terhubung sepenuhnya. C5 diberi label sebagai lapisan konvolusional dan bukan lapisan terhubung penuh, karena jika masukan LeNet-5 menjadi lebih besar dan strukturnya tetap tidak berubah, ukuran keluarannya akan lebih besar dari 1x1, yaitu bukan lapisan terhubung penuh.
Lapisan F6 adalah lapisan yang sepenuhnya terhubung ke C5 dan 84 adalah grafik fitur yang dikeluarkan.
Fitur
- Setiap lapisan konvolusional mencakup tiga bagian: konvolusi, pooling, dan fungsi aktivasi nonlinier
- Menggunakan konvolusi untuk mengekstraksi fitur spasial (Konvolusi awalnya disebut sebagai bidang reseptif)
- Lapisan pengumpulan menggunakan rata-rata subsampling (average pooling layer)
- fungsi aktivasi tanh
- Menggunakan MLP sebagai pengklasifikasi terakhir
- Koneksi jarang (sparse connection) antar lapisan untuk mengurangi kompleksitas komputasi
Aplikasi
Aplikasi LeNet yang paling klasik adalah untuk mengenali citra digit sederhana karena ia diciptakan karena itu.
Yann LeCun dkk. membuat bentuk awal LeNet pada tahun 1989. Makalah ilmiah berjudul Backpropagation Applied to Handwrittern Zip code Recognition [15] menunjukkan bagaimana kendala tersebut dapat diintegrasikan ke dalam jaringan perambatan mundur melalui arsitektur jaringan yang berhasil diterapkan pada pengenalan angka kode pos tulisan tangan yang disediakan oleh Jawatan Pos Amerika.[16]
Analisis pengembangan
LeNet-5 menunjukkan kebangkitan CNN dan mendefinisikan komponen dasar CNN.[17] Namun, saat itu belum populer karena keterbatasan perangkat keras, terutama GPU dan algoritma lain, seperti SVM yang dapat mencapai efek serupa atau bahkan melampaui LeNet.
Sejak keberhasilan AlexNet pada tahun 2012, CNN telah menjadi pilihan terbaik untuk aplikasi visi komputer dan berbagai jenis CNN telah dibuat, seperti seri R-CNN. Saat ini, model CNN sangat berbeda dari LeNet, tetapi semuanya dikembangkan berdasarkan LeNet.
Arsitektur pohon berlapis tiga yang meniru LeNet-5 dan hanya terdiri dari satu lapisan konvolusional, telah mencapai tingkat keberhasilan yang sama pada dataset CIFAR-10.[18]
Peningkatan jumlah filter untuk arsitektur LeNet menghasilkan peluruhan hukum daya pada tingkat kesalahan. Hasil ini menunjukkan bahwa jaringan dangkal dapat mencapai kinerja yang sama dengan arsitektur pemelajaran mendalam.[19]
Referensi
- ↑ Y. Lecun. Gradient-based learning applied to document recognition. Proceedings of the IEEE. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791.
- ↑ Y. LeCun. Backpropagation Applied to Handwritten Zip Code Recognition. Neural Computation. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541.
- ↑ Yann Lecun. Generalization and network design strategies. Technical Report CRG-TR-89-4. Department of Computer Science, University of Toronto. June 1989.
- ↑ Y. LeCun. Handwritten digit recognition with a back-propagation network. Advances in Neural Information Processing Systems. June 1990. Vol. 2. hlm. 396–404.
- ↑ http://yann.lecun.com/exdb/publis/pdf/bottou-94.pdf
- ↑ https://www.eecis.udel.edu/~shatkay/Course/papers/NetworksAndCNNClasifiersIntroVapnik95.pdf
- ↑ Y. Lecun. Gradient-based learning applied to document recognition. Proceedings of the IEEE. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791. Lecun, Y.; Bottou, L.; Bengio, Y.; Haffner, P. (1998). "Gradient-based learning applied to document recognition" (PDF) . Proceedings of the IEEE. 86 (11): 2278–2324. doi:10.1109/5.726791. S2CID 14542261.
- ↑ Y. LeCun. Backpropagation Applied to Handwritten Zip Code Recognition. Neural Computation. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". Neural Computation. 1 (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID 41312633.
- ↑ Yann Lecun. Generalization and network design strategies. Technical Report CRG-TR-89-4. Department of Computer Science, University of Toronto. June 1989. Lecun, Yann (June 1989). "Generalization and network design strategies" (PDF) . Technical Report CRG-TR-89-4. Department of Computer Science, University of Toronto.
- ↑ Y. LeCun. Handwritten digit recognition with a back-propagation network. Advances in Neural Information Processing Systems. June 1990. Vol. 2. hlm. 396–404. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jacker, L. D. (June 1990). "Handwritten digit recognition with a back-propagation network" (PDF) . Advances in Neural Information Processing Systems. 2: 396–404.
- ↑ Y. Lecun. Gradient-based learning applied to document recognition. Proceedings of the IEEE. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791. Lecun, Y.; Bottou, L.; Bengio, Y.; Haffner, P. (1998). "Gradient-based learning applied to document recognition" (PDF) . Proceedings of the IEEE. 86 (11): 2278–2324. doi:10.1109/5.726791. S2CID 14542261.
- ↑ Y. LeCun. Backpropagation Applied to Handwritten Zip Code Recognition. Neural Computation. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". Neural Computation. 1 (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID 41312633.
- ↑ 卷积神经网络之LeNet - Brook_icv - 博客园. www.cnblogs.com.
- ↑ 深度学习 CNN 卷积神经网络 LeNet-5 详解. blog.csdn.net.
- ↑ Y. LeCun. Backpropagation Applied to Handwritten Zip Code Recognition. Neural Computation. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541. LeCun, Y.; Boser, B.; Denker, J. S.; Henderson, D.; Howard, R. E.; Hubbard, W.; Jackel, L. D. (December 1989). "Backpropagation Applied to Handwritten Zip Code Recognition". Neural Computation. 1 (4): 541–551. doi:10.1162/neco.1989.1.4.541. ISSN 0899-7667. S2CID 41312633.
- ↑ Y. LeCun. Backpropagation Applied to Handwritten Zip Code Recognition. Neural Computation. December 1989. Vol. 1 (4). hlm. 541–551. doi:10.1162/neco.1989.1.4.541.
- ↑ Y. Lecun. Gradient-based learning applied to document recognition. Proceedings of the IEEE. 1998. Vol. 86 (11). hlm. 2278–2324. doi:10.1109/5.726791.
- ↑ Yuval Meir. Learning on tree architectures outperforms a convolutional feedforward network. Scientific Reports. 2023-01-30. Vol. 13 (1). hlm. 962. doi:10.1038/s41598-023-27986-6.
- ↑ Yuval Meir. Efficient shallow learning as an alternative to deep learning. Scientific Reports. 2023-04-20. Vol. 13 (1). hlm. 5423. doi:10.1038/s41598-023-32559-8.
Sumber dan atribusi
Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 29568195 (2026-08-12T22:06:42Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.