Suno, l’AI music maker, ora genera testi parlati: scopri come con questa innovativa funzione!
Pubblicato il da Ignazio Aragona - Tecnologia
Suno sta espandendo il suo universo dalla musica generata da intelligenza artificiale, lanciando una nuova funzionalità che genera voci basate su script o descrizioni fornite. La funzionalità di speech è ora disponibile in versione beta pubblica su tutte le piattaforme web e mobile di Suno, consentendo di generare contemporaneamente voci e musiche di sottofondo per accompagnarle.
La nuova frontiera di Suno: Speech
“La musica rimarrà sempre il cuore di Suno e di ciò che costruiamo. Allo stesso tempo, la nostra visione si è sempre estesa ad altre forme di espressione umana,” ha dichiarato Jack Brody, chief product officer di Suno, nell’annuncio. “Oggi stiamo espandendo ciò che è possibile in Suno con Speech: il primo modello audio che genera voce e musica insieme in un unico brano coeso.”
La generazione di speech tramite intelligenza artificiale non è certo una novità – DeepMind ha sperimentato la sintesi vocale tramite apprendimento profondo per un decennio, Adobe dispone di uno strumento di text-to-speech, e ElevenLabs è diventata una delle piattaforme più riconoscibili per questo dal suo lancio nel 2023. Suno si sta inserendo in questo campo – probabilmente nel tentativo di diversificare la piattaforma, considerando che il suo generatore di musica ha attirato numerose cause legali.
La combinazione innovativa di musica e voci generata da Suno
L’abbinamento tra musica generata da intelligenza artificiale e voci generate costituisce uno dei punti di forza di Suno. Questa funzionalità è facoltativa, il che significa che è possibile disattivare facilmente la musica di sottofondo se si desidera solo ascoltare il discorso pulito, ma l’idea è che esso possa essere utile in determinati contesti per la creazione di discorsi generativi – ad esempio utilizzando una colonna sonora rilassante per poesie, o qualcosa di più energico per doppiaggi drammatici e incoraggianti.
Per utilizzare la funzione, seleziona la scheda “Crea” e scegli l’opzione Speech. Ci sono due modalità: la modalità Semplice, che ti consente di descrivere ciò che desideri creare tramite il prompt fornito (come ad esempio “un capitano pirata che incita il suo equipaggio”), o la modalità Avanzata che ti permette di aggiungere uno script personalizzato se sai esattamente cosa vuoi che la voce dica. Le impostazioni avanzate consentono anche di regolare il genere della voce AI, lo stile di parola e quanto varierà ogni generazione vocale. La durata massima di Speech è di circa otto minuti.
Suno ammette che la funzione è lontana dalla perfezione, ma afferma che continuerà a migliorare Speech in base ai feedback degli utenti. “Beta significa veramente beta,” ha detto Brody. “A volte, gli accenti britannici possono vagare fino in Australia e tornare indietro. Le pause drammatiche potrebbero essere molto drammatiche. Scoprirai quasi certamente utilizzi per questo che non ci sono mai venuti in mente.”
Fonti:
Non perderti tutte le notizie di tecnologia su Blog.it