Lompat ke isi

Riffusiion

Ensiklopedia Pengetahuan Universitas Islam Sultan Agung
Revisi sejak 23 Agustus 2026 10.28 oleh Maintenance script (bicara | kontrib) (Presentation V4: sitasi, referensi, Math, Wikimedia Commons, dan atribusi)
(beda) ← Revisi sebelumnya | Revisi terkini (beda) | Revisi selanjutnya → (beda)
AI-generated audio featuring bossa nova music with electric guitar

Riffusion adalah jaringan saraf yang dirancang oleh Seth Forsgren dan Hayk Martiros untuk menghasilkan musik menggunakan gambar suara, bukan audio langsung[1] Musik yang dihasilkan digambarkan sebagai “de otro mundo” (dari dunia lain),[2] meskipun dinilai kecil kemungkinannya untuk menggantikan musik buatan manusia.[3] Model ini dirilis pada 15 Desember 2022, dan kode sumbernya tersedia secara bebas di GitHub.[4]

Versi pertama Riffusion merupakan hasil fine-tuning dari Stable Diffusion—model open-source yang digunakan untuk menghasilkan gambar dari prompt teks—pada spectrogram.[5] Proses ini menghasilkan model yang menggunakan prompt teks untuk mengubahnya menjadi berkas gambar, kemudian diproses melalui transformasi-balik-Fourier dan dikonversi menjadi berkas audio.[6] Berkas audio yang dihasilkan hanya berdurasi beberapa detik, tetapi model ini dapat memanfaatkan ruang laten di antara keluaran suara untuk menginterpolasi beberapa berkas secara berkelanjutan[7] (melalui kemampuan img2img pada Stable Diffusion).[8] Riffusion menjadi salah satu dari banyak model turunan Stable Diffusion.[9]

Pada Desember 2022, Mubert[10] juga memanfaatkan Stable Diffusion untuk mengubah deskripsi teks menjadi loop musik. Pada Januari 2023, Google mempublikasikan makalah tentang generator musik dari teks bernama MusicLM.[11][12]

Forsgren dan Martiros kemudian membentuk perusahaan rintisan dengan nama Riffusion, dan memperoleh pendanaan modal ventura sebesar 4 juta dolar pada Oktober 2023.[13][14]

Referensi

  1. Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
  2. Sofía Calahorra. ¿Comemos con los ojos? Ver fotografías de alimentos también puede producir saciedad. doi.org. 2023-09-04.
  3. Sofía Calahorra. ¿Comemos con los ojos? Ver fotografías de alimentos también puede producir saciedad. doi.org. 2023-09-04.
  4. Michele Nasi. Riffusion: creare tracce audio con l'intelligenza artificiale. IlSoftware.it. 2022-12-15.
  5. Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
  6. Michele Nasi. Riffusion: creare tracce audio con l'intelligenza artificiale. IlSoftware.it. 2022-12-15.
  7. Devin Coldewey. Try 'Riffusion,' an AI model that composes music by visualizing it. TechCrunch. 2022-12-15.
  8. 文章に沿った楽曲を自動生成してくれるAI「Riffusion」登場、画像生成AI「Stable Diffusion」ベースで誰でも自由に利用可能 - GIGAZINE. gigazine.net. 2022-12-16.
  9. 文章に沿った楽曲を自動生成してくれるAI「Riffusion」登場、画像生成AI「Stable Diffusion」ベースで誰でも自由に利用可能 - GIGAZINE. gigazine.net. 2022-12-16.
  10. Mubert Team. Mubert launches Text-to-Music interface – a completely new way to generate music from a single text prompt. MUBERT Blog – Royalty-free AI Music for Content Creators. 2022-12-21.
  11. MusicLM. google-research.github.io.
  12. Ezra Sandzer-Bell. Google Lyria 2: The New AI Music Generator from Deepmind. AudioCipher. 2025-04-25.
  13. Free A.I. music creation platform launches, competing with Suno The Jerusalem Post. The Jerusalem Post JPost.com. 2025-02-10.
  14. John Hawkins. Spotify continues to change music. What’s next – will AI musicians replace music made by humans?. doi.org. 2025-05-20.

Sumber dan atribusi

Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 29619596 (2026-08-23T06:47:46Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Gambar pada artikel ini bersumber dari Wikimedia Commons dan mengikuti ketentuan lisensi masing-masing berkas. Mohon gunakan konten dan media secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.