SpeechText.AI

SpeechText.AI est une plateforme de transcription automatisée et une API pour convertir l'audio et la vidéo en texte modifiable, consultable, traduit et exportable.

Tarification: 10 Video & Audio

Transcription IADiscours en texteAudio en texteTranscription vidéoReconnaissance des intervenantsGénérateur de sous-titresAPI de transcriptionTranscription multilingue

SpeechText.AI est une plateforme de reconnaissance vocale alimentée par l'IA, conçue pour les entreprises, les chercheurs, les journalistes, les podcasteurs, les équipes juridiques, les professionnels de la santé, les développeurs et d'autres utilisateurs qui ont besoin de convertir un discours enregistré en texte. Les utilisateurs téléchargent un fichier audio ou vidéo, sélectionnent la langue parlée, choisissent un type audio et un domaine industriel, et permettent à la plateforme de générer automatiquement une transcription. Des modèles spécifiques à un domaine sont disponibles pour améliorer la reconnaissance de la terminologie spécialisée utilisée dans des domaines tels que la médecine, le droit, les interviews, les podcasts et les conférences téléphoniques.

La plateforme prend en charge plus de 50 langues, variantes régionales et accents non natifs. Elle peut automatiquement ajouter de la ponctuation et distinguer les différents participants grâce à l'identification des intervenants, ce qui facilite la révision des transcriptions pour les interviews, les réunions, les groupes de discussion et les enregistrements à plusieurs intervenants. SpeechText.AI propose également un moteur de recherche audio permettant aux utilisateurs de rechercher du contenu parlé via des requêtes en langage naturel.

Les transcriptions générées peuvent être consultées et corrigées dans un éditeur en ligne interactif. Les utilisateurs peuvent rechercher le texte, modifier les erreurs de reconnaissance, vérifier les étiquettes des intervenants et exporter le résultat final dans des formats tels que TXT, DOCX, PDF, HTML, XLSX, SRT et VTT. Il peut également transcrire et traduire l'audio dans un flux de travail unique, avec des résultats traduits disponibles pour l'exportation de documents ou de sous-titres.

Pour les développeurs, SpeechText.AI propose une API REST pour intégrer la transcription multilingue dans les applications et les flux de travail automatisés. L'API prend en charge les formats multimédias courants, les modèles adaptés au domaine, les changements de locuteurs, l'audio bruyant, les résumés de transcription et la mise en surbrillance automatique des mots-clés importants. Une documentation officielle SDK et API est également disponible.

SpeechText.AI utilise des forfaits basés sur l'utilisation plutôt que des transcriptions illimitées. Les limites de taille de fichier, les minutes incluses, l'accès aux modèles et les tarifs API dépendent du forfait sélectionné. La société déclare que ses serveurs sont hébergés en Europe, que les données transmises sont cryptées et que le service est conforme au RGPD.