Stable Audio 3.0: AI Pembuat Musik yang Kini Bisa Menghasilkan Lagu Lebih dari 6 Menit
Stable Audio 3.0 adalah keluarga model generatif audio dari Stability AI dengan empat model berukuran 459 juta hingga 2,7 miliar parameter. Model Small SFX dan Small fokus pada penggunaan ringan dan audio pendek, sementara Medium dan Large mampu membuat komposisi musik hingga sekitar 6 menit 20 detik.
Diterbitkan olehDiedit dengan GPT-5.5Gambar dibuat dengan GPT Image 2
Stable Audio 3.0 adalah keluarga model generatif audio dari Stability AI dengan empat model berukuran 459 juta hingga 2,7 miliar parameter.
Model Small SFX dan Small fokus pada penggunaan ringan dan audio pendek, sementara Medium dan Large mampu membuat komposisi musik hingga sekitar 6 menit 20 detik.
Tiga model dirilis sebagai open‑weight, sementara model terbesar tersedia lewat API; Stability AI juga menekankan pelatihan dengan data berlisensi dan kerja sama dengan label besar.
How does Stability AI’s new Stable Audio 3.0 family work, what models does it include (small SFX, small, medium, and large with 459M–2.7B paStable Audio 3.0 expands AI music generation with multiple model sizes and longer compositions.
AI Perintah
Create a landscape editorial hero image for this Studio Global article: How does Stability AI’s new Stable Audio 3.0 family work, what models does it include (small SFX, small, medium, and large with 459M–2.7B pa. Article summary: Stable Audio 3.0 is Stability AI’s new text-to-audio/music generation family, positioned as a more open and licensing-safe alternative in AI music. It includes four models from 459M to 2.7B parameters, with three open-we. Topic tags: general, general web, news. Reference image context from search candidates: Reference image 1: visual subject "Title: Stability AI debuts Stable Audio bringing text to audio generation to the masses | VentureBeat # Stability AI debuts Stable Audio bringing text to audio generation to the ma" source context "Stability AI debuts Stable Audio bringing text to audio generation to the masses | VentureBeat" Reference image 2: visual subj
openai.com
Generasi musik oleh AI berkembang sangat cepat. Setelah sukses dengan model gambar Stable Diffusion, Stability AI kini memperkenalkan Stable Audio 3.0, keluarga model AI yang mampu membuat musik atau efek suara langsung dari deskripsi teks.
Dengan pendekatan baru yang mencakup komposisi lebih panjang, beberapa ukuran model untuk kebutuhan berbeda, dan strategi open‑weight sebagian, Stable Audio 3.0 menjadi salah satu pemain baru yang serius di ekosistem AI musik yang semakin kompetitif.
Apa Itu Stable Audio 3.0
Stable Audio 3.0 adalah keluarga model generatif teks‑ke‑audio. Pengguna cukup menuliskan deskripsi—misalnya gaya musik, suasana, instrumen, atau situasi—dan model akan menghasilkan trek audio yang sesuai.
Studio Global AI
Lanjutkan penelitian Anda
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Apa jawaban singkat untuk "Stable Audio 3.0: AI Pembuat Musik yang Kini Bisa Menghasilkan Lagu Lebih dari 6 Menit"?
Stable Audio 3.0 adalah keluarga model generatif audio dari Stability AI dengan empat model berukuran 459 juta hingga 2,7 miliar parameter.
Apa poin penting yang harus divalidasi terlebih dahulu?
Stable Audio 3.0 adalah keluarga model generatif audio dari Stability AI dengan empat model berukuran 459 juta hingga 2,7 miliar parameter. Model Small SFX dan Small fokus pada penggunaan ringan dan audio pendek, sementara Medium dan Large mampu membuat komposisi musik hingga sekitar 6 menit 20 detik.
Apa yang harus saya lakukan selanjutnya dalam latihan?
Tiga model dirilis sebagai open‑weight, sementara model terbesar tersedia lewat API; Stability AI juga menekankan pelatihan dengan data berlisensi dan kerja sama dengan label besar.
Stability AI menggambarkannya sebagai platform untuk "generative audio" dan eksperimen kreatif. Salah satu poin pentingnya adalah klaim bahwa model dilatih menggunakan dataset yang sepenuhnya berlisensi, sebuah upaya untuk mengurangi risiko pelanggaran hak cipta yang sering menjadi kontroversi dalam AI musik.
Alih‑alih satu model tunggal, sistem ini terdiri dari beberapa model dengan ukuran dan kemampuan berbeda sehingga pengembang dapat memilih sesuai kebutuhan perangkat dan kualitas hasil yang diinginkan.
Empat Model dalam Keluarga Stable Audio 3.0
Stability AI merilis empat model utama dengan skala parameter dari ratusan juta hingga miliaran.
Stable Audio 3.0 Small SFX
Sekitar 459 juta parameter
Difokuskan pada pembuatan efek suara singkat
Dioptimalkan untuk penggunaan ringan atau langsung di perangkat
Stable Audio 3.0 Small
Sekitar 459 juta parameter
Untuk pembuatan musik atau audio sederhana
Cocok untuk proyek kecil atau penggunaan lokal
Stable Audio 3.0 Medium
Sekitar 1,4 miliar parameter
Dirancang untuk komposisi musik yang lebih ekspresif dan kompleks
Stable Audio 3.0 Large
Sekitar 2,7 miliar parameter
Model paling kuat dalam seri ini
Ditujukan untuk produksi musik berkualitas profesional
Pendekatan bertingkat ini memungkinkan kreator memilih model berdasarkan keterbatasan hardware, kebutuhan kualitas audio, dan panjang komposisi yang diinginkan.
Durasi Musik yang Bisa Dihasilkan
Salah satu peningkatan paling menonjol dari Stable Audio 3.0 adalah durasi audio yang jauh lebih panjang.
Model Small SFX dan Small dapat menghasilkan audio hingga sekitar 2 menit, dan cocok untuk penggunaan langsung di perangkat.
Model Medium dan Large dapat membuat komposisi musik lengkap hingga sekitar 6 menit 20 detik.
Durasi ini lebih dari dua kali lipat dibandingkan kemampuan versi sebelumnya, sehingga AI tidak hanya membuat klip pendek atau loop, tetapi lagu penuh dengan struktur musik yang lebih utuh.
Model Mana yang Open‑Weight?
Stability AI menggunakan strategi distribusi campuran.
Model open‑weight:
Stable Audio 3.0 Small SFX
Stable Audio 3.0 Small
Stable Audio 3.0 Medium
Model‑model ini dapat diunduh dan dijalankan secara lokal oleh pengembang atau peneliti.
Model yang hanya tersedia melalui API:
Stable Audio 3.0 Large
Model terbesar tidak dirilis bobotnya secara publik dan hanya tersedia melalui layanan terkelola atau akses enterprise.
Strategi ini mirip dengan pendekatan Stability AI pada produk lain: membuka sebagian model untuk komunitas, tetapi mempertahankan model paling kuat sebagai layanan berbayar.
Lisensi Data dan Pendekatan Hak Cipta
Perdebatan tentang hak cipta adalah isu besar dalam AI musik. Stability AI menegaskan bahwa Stable Audio 3.0 dilatih menggunakan dataset yang sepenuhnya berlisensi.
Pengguna pada umumnya memiliki hasil audio yang mereka buat dan dapat mendistribusikannya secara komersial di bawah Stability AI Community License. Namun organisasi dengan pendapatan tahunan di atas sekitar US$1 juta perlu menggunakan lisensi enterprise.
Meski demikian, detail lengkap mengenai komposisi dataset tidak sepenuhnya dipublikasikan, sehingga verifikasi independen terhadap klaim tersebut masih terbatas.
Kerja Sama dengan Label Musik Besar
Untuk memperkuat pendekatan berbasis lisensi, Stability AI juga menjalin kerja sama dengan perusahaan musik besar.
Universal Music Group (UMG) bekerja sama dengan Stability AI untuk mengembangkan alat pembuatan musik berbasis AI yang menggunakan data berlisensi dan melibatkan artis dalam proses pengembangan.
Warner Music Group (WMG) juga berkolaborasi dengan perusahaan tersebut untuk membangun alat AI yang mendukung penulis lagu, produser, dan artis dengan pendekatan AI yang bertanggung jawab.
Kemitraan ini bertujuan menjawab kritik utama terhadap AI musik: penggunaan materi berhak cipta tanpa izin dalam proses pelatihan model.
Posisi Stable Audio 3.0 di Persaingan AI Musik
Peluncuran ini terjadi saat persaingan di bidang generative audio semakin intens. Perusahaan seperti Google, Suno, Udio, dan ElevenLabs juga mengembangkan teknologi yang mampu menghasilkan musik dan vokal AI dengan kualitas semakin realistis.
Stable Audio 3.0 mencoba membedakan dirinya lewat dua pendekatan utama:
Model open‑weight yang dapat digunakan dan dimodifikasi oleh pengembang.
Fokus pada data berlisensi, diperkuat oleh kerja sama dengan label musik besar untuk mengurangi risiko hukum.
Dengan kemampuan menghasilkan lagu lebih dari enam menit, Stable Audio 3.0 membawa AI musik selangkah lebih dekat ke produksi lagu lengkap yang terstruktur, bukan sekadar demo pendek.
Gambaran Besarnya
Stable Audio 3.0 menunjukkan tren baru dalam AI generatif: bukan lagi satu model besar untuk semua hal, tetapi keluarga model dengan berbagai ukuran dan fungsi.
Pendekatan ini memungkinkan teknologi digunakan oleh berbagai kelompok—mulai dari hobiis yang menjalankan model kecil secara lokal hingga produser musik profesional yang membutuhkan kualitas produksi lebih tinggi. Seiring peningkatan kualitas, durasi, dan kejelasan lisensi data, sistem seperti Stable Audio 3.0 berpotensi menjadi fondasi bagi generasi berikutnya dari perangkat kreatif berbasis AI.