Riffusiion

Riffusion adalah jaringan saraf yang dirancang oleh Seth Forsgren dan Hayk Martiros untuk menghasilkan musik menggunakan gambar suara, bukan audio langsung[1] Musik yang dihasilkan digambarkan sebagai “de otro mundo” (dari dunia lain),[2] meskipun dinilai kecil kemungkinannya untuk menggantikan musik buatan manusia.[3] Model ini dirilis pada 15 Desember 2022, dan kode sumbernya tersedia secara bebas di GitHub.[4]
Versi pertama Riffusion merupakan hasil fine-tuning dari Stable Diffusion—model open-source yang digunakan untuk menghasilkan gambar dari prompt teks—pada spectrogram.[5] Proses ini menghasilkan model yang menggunakan prompt teks untuk mengubahnya menjadi berkas gambar, kemudian diproses melalui transformasi-balik-Fourier dan dikonversi menjadi berkas audio.[6] Berkas audio yang dihasilkan hanya berdurasi beberapa detik, tetapi model ini dapat memanfaatkan ruang laten di antara keluaran suara untuk menginterpolasi beberapa berkas secara berkelanjutan[7] (melalui kemampuan img2img pada Stable Diffusion).[8] Riffusion menjadi salah satu dari banyak model turunan Stable Diffusion.[9]
Pada Desember 2022, Mubert[10] juga memanfaatkan Stable Diffusion untuk mengubah deskripsi teks menjadi loop musik. Pada Januari 2023, Google mempublikasikan makalah tentang generator musik dari teks bernama MusicLM.[11][12]
Forsgren dan Martiros kemudian membentuk perusahaan rintisan dengan nama Riffusion, dan memperoleh pendanaan modal ventura sebesar 4 juta dolar pada Oktober 2023.[13][14]
Referensi
- ↑ Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
- ↑ Sofía Calahorra. ¿Comemos con los ojos? Ver fotografías de alimentos también puede producir saciedad. doi.org. 2023-09-04.
- ↑ Sofía Calahorra. ¿Comemos con los ojos? Ver fotografías de alimentos también puede producir saciedad. doi.org. 2023-09-04.
- ↑ Michele Nasi. Riffusion: creare tracce audio con l'intelligenza artificiale. IlSoftware.it. 2022-12-15.
- ↑ Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
- ↑ Michele Nasi. Riffusion: creare tracce audio con l'intelligenza artificiale. IlSoftware.it. 2022-12-15.
- ↑ Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
- ↑ 文章に沿った楽曲を自動生成してくれるAI「Riffusion」登場、画像生成AI「Stable Diffusion」ベースで誰でも自由に利用可能 - GIGAZINE. gigazine.net. 2022-12-16.
- ↑ 文章に沿った楽曲を自動生成してくれるAI「Riffusion」登場、画像生成AI「Stable Diffusion」ベースで誰でも自由に利用可能 - GIGAZINE. gigazine.net. 2022-12-16.
- ↑ Mubert Team. Mubert launches Text-to-Music interface – a completely new way to generate music from a single text prompt. MUBERT Blog – Royalty-free AI Music for Content Creators. 2022-12-21.
- ↑ MusicLM. google-research.github.io.
- ↑ Ezra Sandzer-Bell. Google Lyria 2: The New AI Music Generator from Deepmind. AudioCipher. 2025-04-25.
- ↑ Free A.I. music creation platform launches, competing with Suno The Jerusalem Post. The Jerusalem Post JPost.com. 2025-02-10.
- ↑ John Hawkins. Spotify continues to change music. What’s next – will AI musicians replace music made by humans?. doi.org. 2025-05-20.
Sumber dan atribusi
Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 29619596 (2026-08-23T06:47:46Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Gambar pada artikel ini bersumber dari Wikimedia Commons dan mengikuti ketentuan lisensi masing-masing berkas. Mohon gunakan konten dan media secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.