Telset.id – Suno resmi meluncurkan fitur Speech yang mampu menghasilkan suara spoken berdasarkan skrip atau deskripsi yang diminta, sekaligus menggabungkannya dengan musik latar dalam satu trek utuh. Fitur ini kini tersedia dalam versi public beta di platform web dan mobile Suno. Langkah ini menandai ekspansi Suno dari dunia AI music ke ranah AI-generated speech, meski teknologi serupa sudah lebih dulu dikembangkan sejumlah pemain lain.
Dalam pengumuman resminya, Suno menegaskan bahwa musik akan selalu menjadi inti dari apa yang mereka bangun. Chief Product Officer Suno, Jack Brody, menyatakan bahwa visi perusahaan memang selalu mencakup bentuk ekspresi manusia lain di luar musik. “Today, we’re expanding what’s possible in Suno with Speech: the first audio model that generates voice and music together as one cohesive track,” ujar Brody dalam pengumuman tersebut.
Fitur Speech memungkinkan pengguna menghasilkan voiceover dan musik latar secara bersamaan. AI-generated speech sendiri bukan hal baru. DeepMind telah bereksperimen dengan deep learning speech synthesis selama satu dekade, Adobe memiliki text-to-speech tool, dan ElevenLabs menjadi salah satu platform paling dikenal untuk teknologi ini sejak diluncurkan pada 2023. Suno kini ikut masuk ke pasar tersebut, yang diduga sebagai upaya diversifikasi platform di tengah banyaknya gugatan hukum yang menghadang music generator mereka.
Yang membedakan fitur Speech dari text-to-speech tool lain adalah kemampuannya menggabungkan AI music dengan suara yang dihasilkan. Sifatnya opsional, sehingga pengguna bisa menonaktifkan musik latar dengan toggle jika hanya menginginkan suara bersih. Konsep ini dirancang untuk melengkapi sejumlah penggunaan generative spoken word, misalnya musik latar yang menenangkan untuk puisi, atau trek yang lebih energik untuk voiceover dramatis dan pidato yang membangkitkan semangat.
Cara Menggunakan Fitur Speech di Suno
Untuk menggunakan fitur ini, pengguna perlu memilih tab “Create” lalu menavigasi ke opsi Speech. Terdapat dua mode yang tersedia. Mode Simple memungkinkan pengguna mendeskripsikan apa yang ingin dibuat melalui prompt box yang disediakan, contohnya “a pirate captain rallying his crew”. Sementara mode Advanced memungkinkan pengguna menambahkan skrip kustom jika sudah tahu persis apa yang ingin disampaikan.
Advanced settings juga memberi pengguna kendali untuk menyesuaikan gender suara AI, gaya bicara, serta seberapa besar variasi pada setiap generasi suara. Fitur Speech memiliki durasi maksimum sekitar delapan menit. Batasan ini menjadikannya cocok untuk konten berdurasi pendek hingga menengah, seperti voiceover promosi, narasi puisi, atau pengantar presentasi.
Pendekatan Suno yang menggabungkan voice dan music dalam satu track menjadi pembeda dibanding platform lain yang umumnya memisahkan kedua elemen tersebut. Bagi pengguna yang terbiasa bekerja dengan pemutar musik hi-res sekalipun, konsep satu trek terpadu ini menawarkan alur kerja yang lebih ringkas karena tidak perlu menggabungkan dua sumber audio secara manual.
Keterbatasan yang Diakui Suno
Suno secara terbuka mengakui bahwa fitur ini masih jauh dari sempurna. Perusahaan menyatakan akan terus meningkatkan Speech berdasarkan feedback dari pengguna. Brody menegaskan bahwa status beta memang benar-benar beta. “Occasionally, British accents can wander off to Australia and back. Dramatic pauses may be very dramatic. You will almost certainly discover uses for this that never occurred to us,” kata Brody.
Pernyataan tersebut mengindikasikan bahwa akurasi aksen dan pengaturan jeda dramatis masih menjadi area yang perlu diperbaiki. Meski demikian, Suno tampak membuka ruang bagi pengguna untuk menemukan penggunaan baru yang mungkin belum terpikirkan oleh tim pengembang. Pendekatan ini sejalan dengan strategi platform yang mengandalkan komunitas untuk mengeksplorasi kemampuan model di luar skenario awal.
Peluncuran fitur Speech terjadi di tengah tekanan hukum yang dihadapi Suno. Music generator perusahaan telah menarik banyak gugatan, termasuk langkah hukum dari label besar. Ekspansi ke ranah spoken voice disebut-sebut sebagai upaya mendiversifikasi platform agar tidak sepenuhnya bergantung pada satu lini produk yang sedang menghadapi sengketa. Langkah ini juga memperluas cakupan Suno ke wilayah yang selama ini dikuasai pemain seperti ElevenLabs dan Adobe.
Bagi industri, masuknya Suno ke segmen AI-generated speech menambah persaingan di pasar text-to-speech yang semakin ramai. Pendekatan yang menyatukan voice dan music dalam satu track bisa menjadi nilai jual tersendiri, terutama bagi kreator yang membutuhkan kedua elemen tersebut dalam satu alur kerja. Namun, kualitas output tetap menjadi penentu apakah fitur ini mampu bersaing dengan platform yang lebih dulu matang di bidang speech synthesis.
Fitur Speech kini dapat diakses dalam public beta di web dan mobile Suno. Pengguna yang ingin mencoba dapat langsung membuka tab Create dan memilih opsi Speech, baik melalui mode Simple maupun Advanced. Suno menyatakan akan terus menyempurnakan fitur ini seiring masuknya feedback dari pengguna selama periode beta berlangsung.





Komentar
Belum ada komentar.