Amazon sta usando l’intelligenza artificiale per sviluppare nuovi stili di parlato per Alexa, inclusa una voce da giornalista per leggere articoli
Alexa di Amazon continua a imparare nuovi trucchi e la voce parlante in stile giornalista verrà lanciata sui dispositivi abilitati tra poche settimane.
Puoi ascoltare di seguito i campioni dello stile del parlato e i risultati parlano da soli. La voce non può essere confusa con un umano, ma incorpora l’enfasi nelle frasi nello stesso modo che aspetteresti da un giornalista televisivo o radiofonico.
Amazon afferma che il nuovo stile è reso possibile dallo sviluppo della tecnologia “neurale text-to-speech” o NTTS; questa è la prossima generazione di sintesi vocale, che usa il machine learning per generare più velocemente voci espressive. Attualmente, Alexa usa la sintesi vocale concatenativa, un metodo che esiste da decenni: ciò comporta la suddivisione degli esempi di parlato in suoni distinti (noti come fonemi) e quindi la concatenazione per formare nuove parole e frasi.
Stile concatenativo:
NTTS standard
NTTS in stile newscaster
La sintesi vocale concatenativa può produrre risultati sorprendentemente buoni, ma i nuovi metodi con AI superano rapidamente i limiti precedenti. Lo scorso ottobre, Google ha lanciato una nuova forma di sintesi vocale per l’Assistente Google che utilizza tecniche di machine learning sviluppate dal laboratorio di intelligenza artificiale di Londra DeepMind. Amazon ha affermato che Alexa dovrebbe passare alla sintesi neurale vocale (completa con la voce da giornalista) “nelle prossime settimane”. È plausibile che tale implementazione, però, possa comportare un’attesa maggiore per l’Italia.
La voce da giornalista è stata creata registrando clip audio da canali di notizie reali, utilizzando, poi, il maschile learning per individuare gli schemi nel modo in cui i giornalisti leggono il testo. Amazon ha affermato che questo approccio cattura più facilmente i dettagli negli stili di espressione umana.
In particolare, Amazon sostiene che ci sono volute solo poche ore di dati per insegnare ad Alexa la voce da giornalista, suggerendo che un’intera gamma di stili potrebbe essere facilmente incorporata in futuro. Finora, Amazon ha già aggiunto una modalità sussurrata per Alexa, e dopo l’aggiornamento a NTTS nelle prossime settimane potremo probabilmente aspettarci una serie di nuovi voci che andranno, man mano, ad essere implementate nel corso del 2019.
L'ultima tappa del tour TD SYNNEX approda nel simbolo dell'innovazione nazionale
Scopri come Formula, BlueIT e IBM stanno trasformando l’ERP in un sistema intelligente che unisce…
Una panoramica esaustiva dei migliori plug-in ChatGPT, con uso, vantaggi e indicazioni pratiche.
L’ entrata in vigore della legge italiana sull’AI cambia le regole del gioco: ecco cosa…
Con l'evento AI Accelerator BlueIT ha riunito esperti e visionari per riflettere sull’umanesimo dell’intelligenza artificiale:…
Tilly Norwood: dalle micro-espressioni al respiro simulato: come l’attrice creata con l’AI riscrive il futuro…
Via Italia 50, 20900 Monza (MB) - C.F. e Partita IVA: 03339380135
Reg. Trib. Milano n. 409 del 21/7/2011 - ROC n. 21424 del 3/8/2011