DupDub
DupDub is an all-in-one AI content platform for generating voiceovers, cloning voices, creating talking avatars, translating videos, producing subtitles, and editing multimedia content.
DupDub est une plateforme de création audio et vidéo basée sur navigateur, conçue pour les créateurs de contenu, les spécialistes du marketing, les éducateurs, les podcasteurs, les producteurs de livres audio, les entreprises et les développeurs.
Elle combine la synthèse vocale, le clonage vocal, les avatars parlants, la traduction vidéo, la transcription, la création de sous-titres, l’écriture de scripts, les effets sonores, l’enregistrement et le montage vidéo dans un seul environnement de production.
Son studio de synthèse vocale propose plus de 700 voix IA dans plus de 90 langues et accents, avec plus de 1 000 styles de voix et scénarios.
Les utilisateurs peuvent attribuer plusieurs voix à un même projet et ajuster la prononciation, la vitesse, la hauteur, le rythme, l’emphase et les pauses. Les lexiques, phonèmes et alias personnalisés aident à améliorer la prononciation des noms de marque, de la terminologie technique, des abréviations et des mots inhabituels.
De la musique et des effets sonores peuvent également être ajoutés directement à la narration générée.
Les outils de clonage vocal de DupDub permettent aux utilisateurs autorisés de créer des voix synthétiques réutilisables pour les vidéos, les podcasts, les publicités, l’e-learning et le contenu multilingue.
Son espace de travail d’avatars IA peut animer des présentateurs intégrés ou des photos humaines et animales téléversées. Les avatars photo, gestuels et animés peuvent parler à partir d’un script écrit, d’une voix enregistrée ou d’un fichier audio téléversé, tout en appliquant une synchronisation labiale automatique et une animation faciale.
Pour la localisation, DupDub peut transcrire l’audio et la vidéo, traduire les sous-titres et le contenu parlé, remplacer la narration originale et synchroniser la parole traduite avec le locuteur visible.
La traduction vidéo prend actuellement en charge plus de 40 langues, tandis que les workflows vocaux et de sous-titrage plus larges couvrent un catalogue de langues plus étendu. Son outil d’alignement des sous-titres peut également synchroniser un script fourni avec un enregistrement téléversé et exporter le résultat sous forme de fichier SRT.
La plateforme comprend l’enregistrement d’écran, de webcam et de microphone directement depuis le navigateur, ainsi qu’un éditeur permettant de séparer l’audio, d’ajouter des sous-titres, de remplacer la narration et de préparer les vidéos finalisées.
Les développeurs peuvent intégrer la synthèse vocale, le clonage vocal, les avatars, la traduction et la transcription via les API DupDub.
Un essai de trois jours est disponible, tandis que les forfaits payants utilisent différentes allocations et crédits de génération.