Runway intègre la voix ElevenLabs
IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.
Transcription avec les sources de chaque passage
Léna
Runway a intégré le modèle Eleven v4 d’ElevenLabs à sa plateforme, pour générer des narrations et des dialogues de personnages dans le même workflow que ses outils d’image et de vidéo, selon AlphaSignal. Cette intégration rassemble ainsi, dans l’environnement créatif de Runway, la production visuelle et la création des éléments vocaux destinés aux vidéos. Le modèle Eleven v4 standard est conçu pour produire une parole expressive ; Eleven v4 Turbo vise plutôt les agents vocaux et les usages qui nécessitent une faible latence, sans que l’intégration de cette version Turbo à Runway soit précisée. Le modèle v4 prend aussi en charge des consignes vocales empilées et des dialogues à plusieurs voix qui tiennent compte du contexte de la conversation, pour élaborer des échanges entre personnages en tenant compte de ce qui a déjà été dit. ElevenLabs indique que v4 peut cloner une voix à partir de 10 secondes d’audio et générer jusqu’à 10 000 caractères par requête ; ces chiffres décrivent les capacités annoncées du modèle, sans préciser les conditions d’utilisation du clonage. L’entreprise annonce aussi une prise en charge de 90 langues, contre 70 auparavant, soit 20 langues de plus que la couverture précédente. L’intégration est disponible dans l’application Runway, et Eleven v4 est également accessible via ElevenAPI ; les outils vocaux peuvent donc être utilisés avec ceux d’image et de vidéo dans le workflow de création de Runway.
Une erreur ?
Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.
Signaler une erreurUn mot pour la rédaction ?
Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.