Vai al contenuto
Italiano
Contenuto FikirPilot

Ho creato un avatar digitale interattivo di me stessa; potete parlarci

Aggiornato: 03/10/2026 · 4 min di lettura · 657 parole

Pubblicato: · Notizia ricevuta: · Tempo di elaborazione: 101 h 46 min

Ho creato un avatar digitale interattivo di me stessa; potete parlarci
Un avatar digitale sullo schermo di un computer

Il responsabile delle relazioni aziendali di Synthesia, Alexandru Voica, utilizza un avatar interattivo creato con la propria immagine e la propria voce per rispondere alle domande della stampa sull’azienda. L’azienda con sede nel Regno Unito opera nel settore degli avatar digitali insieme a startup come D-ID, HeyGen e Colossyan. È stato riferito che Synthesia ha raggiunto una valutazione di $4 miliardi all’inizio di quest’anno e che lo scorso anno ha dichiarato di aver superato $100 milioni di ARR.

L’azienda consente alle imprese di preparare video di formazione con avatar basati sull’intelligenza artificiale. Con il nuovo prodotto Roleplay Sessions, i dipendenti possono provare scenari come le presentazioni di vendita con avatar interattivi; gli avatar possono valutare e assegnare un punteggio alle risposte.

Dominic-Madori Davis, autrice di TechCrunch, ha creato il proprio avatar digitale nell’ufficio di Synthesia a New York. A questo scopo, le sono state scattate numerose foto ed è stata effettuata una registrazione di due minuti della sua voce. L’azienda ha preparato due avatar personali, uno con gli occhiali e uno senza, e due avatar interattivi. Mentre l’avatar personale legge il testo fornito, quello interattivo può ascoltare e rispondere. L’avatar interattivo di Davis è stato addestrato con il suo articolo sul motivo per cui le startup sostenute da venture capital commettono più frodi rispetto alle altre startup ed è stato progettato per rispondere soltanto alle domande su questo argomento.

Il funzionamento tecnologico dell’avatar si articola in quattro fasi:

  • Il modello voce-testo trasforma in testo ciò che dice l’utente.
  • Il modello linguistico basato su agenti interpreta il testo ed esegue le operazioni di conseguenza.
  • Il modello testo-voce converte la risposta in audio.
  • Il modello video sviluppato da Synthesia anima l’avatar mentre parla.

I prodotti di Synthesia si dividono in tre categorie principali:

  • Una piattaforma per creare e distribuire video in cui l’avatar legge il testo scritto dall’utente.
  • Una piattaforma basata su agenti chiamata Sessions, che offre interazioni come sondaggi e giochi di ruolo.
  • Una piattaforma API che consente di integrare i modelli video e audio dell’azienda con altri servizi.

L’azienda consente di utilizzare, oltre ai propri modelli, anche i modelli di Cartesia, ElevenLabs, Google e OpenAI; le aziende possono ospitare gli avatar sul cloud che preferiscono oppure utilizzare il servizio di hosting di Synthesia.

La preparazione degli avatar ha richiesto alcuni giorni. Davis ha ritenuto molto efficace la voce del proprio avatar personale, mentre i suoi amici hanno trovato l’aspetto e la voce dell’avatar interattivo un po’ inquietanti. L’avatar ha risposto soltanto alle domande relative alla storia sulla frode di una startup per la quale era stato addestrato; inoltre, non ha risposto alle domande personali della famiglia di Davis.

Davis ha dichiarato che questa esperienza ha sollevato la questione se la fiducia nel giornalismo possa essere trasferita all’intelligenza artificiale. Ha osservato che potrebbe essere allettante consentire alle copie digitali di rispondere alle domande degli utenti al posto loro durante le vacanze, ma ha riferito di provare sentimenti complessi nei confronti dei propri avatar.

Perché è importante

Questo sviluppo mostra che le aziende potrebbero utilizzare, nei processi di formazione e di esercitazione, sistemi capaci di interagire con i dipendenti invece di limitarsi a proporre video da guardare. In questo modo, in applicazioni come le presentazioni di vendita, le funzioni di valutazione e assegnazione del punteggio potrebbero ridurre la necessità che il formatore partecipi al processo in ogni fase; tuttavia, il fatto che l’avatar sia in grado di rispondere soltanto nell’ambito di argomenti prestabiliti dimostra che i suoi campi di impiego sono ancora limitati. L’utilizzo della tecnologia nel giornalismo, invece, solleva la questione del ruolo di una copia digitale di una persona nella trasmissione delle informazioni e della misura in cui il pubblico si fiderà di tale copia. La possibilità di ospitare gli avatar personali su diversi cloud e di offrire varie opzioni di modelli crea per le aziende un margine di scelta tecnica, lasciando però aperta la questione di come debbano essere gestiti i dati e l’autorità di rappresentanza.

Fonte: TechCrunch AI