George Rybintsev ha creato ActOnCue per gli attori che registrano provini a casa. L’attore carica un copione, sceglie il personaggio da interpretare e prova con voci IA che leggono le altre parti. Cartesia è il fornitore predefinito di queste voci e Sonic 3 ha convinto ActOnCue a lasciare ElevenLabs.
La sfida: un lavoro da soli che richiede una seconda persona
I self-tape sono nati come soluzione durante la pandemia e sono rimasti. I casting continuano a usarli e gli attori devono quindi produrre autonomamente i propri provini.
Un self-tape è l’unica attività individuale che richiede una troupe. Una persona può gestire la videocamera e leggere la seconda parte, ma questo raddoppia l’impegno, il tempo e il montaggio. Nella pratica, un self-tape significa chiamare il coinquilino alle dieci di sera e chiedergli di interpretare Giulietta.
ActOnCue elimina la necessità di una seconda persona senza restituire il lavoro all’attore. Basta caricare un copione, selezionare il personaggio e iniziare a provare. La piattaforma individua gli altri personaggi e assegna automaticamente le voci, che si possono cambiare dopo il primo tentativo. Un attore non dovrebbe dover configurare un sistema IA prima di un provino.
Vuoi solo passare da A a B molto velocemente e con grande efficienza.
Dal lancio, ActOnCue si è estesa al resto del lavoro dell’attore: memorizzazione delle battute, prove e preparazione per diverse discipline recitative. La voce è diventata la parte più importante dell’esperienza.
Perché ActOnCue ha scelto Cartesia
Chi legge le battute di una scena ha un compito insolito. Deve essere abbastanza presente da suscitare una reazione e abbastanza neutro da passare inosservato. All’attore serve qualcuno con cui recitare, non un’altra interpretazione. Nel momento in cui la voce inizia a fare scelte proprie, l’attore comincia a modellare le battute come risposta a quelle scelte e il self-tape smette di essere suo.
Durante un self-tape non vuoi una lettura troppo drammatica. La vuoi molto costante. Pulita, e devi assicurarti che la voce di chi legge non tolga spazio al self-tape.
ActOnCue ha iniziato con ElevenLabs e ha trovato le voci troppo drammatiche per il compito. Interpretavano le battute e competevano con l’attore invece di sostenerlo. ElevenLabs costava anche di più e la sua roadmap si stava chiaramente spostando verso prodotti per consumatori, anziché verso gli strumenti per sviluppatori di cui ActOnCue aveva bisogno.
Sonic 3 è stato il punto di svolta: una cadenza conversazionale e una resa umana che non sovrastano l’interpretazione. Cartesia ha accolto ActOnCue nel suo programma startup come beneficiaria di un Cartesia Startup Grant, con 12 mesi di accesso gratuito al piano Scale.
La soluzione: la scelta predefinita su una piattaforma con più fornitori
ActOnCue offre ancora diversi fornitori vocali e Cartesia è quello assegnato per impostazione predefinita. La scelta nasce da un’analisi attenta di ciò che serve davvero durante una prova e non è vincolante: gli attori possono cambiare fornitore in qualsiasi momento.
Il risultato più importante per il team è il lavoro che la voce di lettura non richiede più. Una voce che mantiene da sola un registro neutro non ha bisogno di essere gestita, regolata o giustificata. ActOnCue può così concentrarsi sul resto del flusso di lavoro dell’attore, lasciando a quest’ultimo l’unica interpretazione che conta nella stanza.
I risultati: gli attori mantengono la scelta predefinita
- Il 93,3% dell’utilizzo speech-to-speech di ActOnCue si basa su Cartesia, su una piattaforma dove gli attori possono scegliere qualsiasi fornitore
- Il 3,9% degli utenti che iniziano con una voce ElevenLabs passa poi a Cartesia, contro circa il 2% che fa il percorso inverso. È quindi quasi due volte più probabile che un cambio porti verso Cartesia anziché lontano da essa
I prossimi passi
La prossima versione di ActOnCue sarà una revisione completa pensata per offrire agli attori un flusso di lavoro lineare. L’assegnazione automatica delle voci è stata il primo passo. La revisione completa il percorso, togliendo ogni altro meccanismo dal cammino dell’attore e spostandolo dietro al prodotto. Più semplice diventa quel percorso, maggiore è la responsabilità della voce che lo sostiene.