SpeechText.AI

SpeechText.AI is an automated transcription platform and API for converting audio and video into editable, searchable, translated, and exportable text.

Tarification: 10 Video & Audio

Transcription de l'IAParole en texteAudio en texteTranscription vidéoReconnaissance du locuteurGénérateur de sous-titresAPI de transcriptionTranscription multilingue

SpeechText.AI est une plateforme de reconnaissance vocale basée sur l’IA, conçue pour les entreprises, les chercheurs, les journalistes, les podcasteurs, les équipes juridiques, les professionnels de santé, les développeurs et les autres utilisateurs qui ont besoin de convertir la parole enregistrée en texte.

Les utilisateurs téléversent un fichier audio ou vidéo, sélectionnent la langue parlée, choisissent un type d’audio et un domaine d’activité, puis laissent la plateforme générer automatiquement une transcription.

Des modèles spécifiques à certains domaines sont disponibles pour améliorer la reconnaissance de la terminologie spécialisée utilisée dans des secteurs comme la médecine, le droit, les entretiens, les podcasts et les conférences téléphoniques.

La plateforme prend en charge plus de 50 langues, variantes régionales et accents non natifs.

Elle peut ajouter automatiquement la ponctuation et distinguer les différents participants grâce à l’identification des locuteurs, ce qui facilite la révision des transcriptions pour les entretiens, les réunions, les groupes de discussion et les enregistrements multi-intervenants.

SpeechText.AI fournit également un moteur de recherche audio qui permet aux utilisateurs de rechercher du contenu parlé à l’aide de requêtes en langage naturel.

Les transcriptions générées peuvent être révisées et corrigées dans un éditeur en ligne interactif.

Les utilisateurs peuvent rechercher dans le texte, corriger les erreurs de reconnaissance, vérifier les étiquettes des locuteurs et exporter le résultat final dans des formats tels que TXT, DOCX, PDF, HTML, XLSX, SRT et VTT.

La plateforme peut également transcrire et traduire l’audio dans un seul workflow, avec des résultats traduits disponibles pour l’exportation sous forme de documents ou de sous-titres.

Pour les développeurs, SpeechText.AI fournit une API REST permettant d’intégrer la transcription multilingue dans des applications et des workflows automatisés.

L’API prend en charge les formats multimédias courants, les modèles adaptés au domaine, les changements de locuteurs, l’audio bruyant, les résumés de transcription et la mise en évidence automatique des mots-clés importants.

La documentation officielle du SDK et de l’API est également disponible.

SpeechText.AI utilise des forfaits basés sur l’utilisation plutôt qu’une transcription illimitée.

Les limites de taille de fichier, les minutes incluses, l’accès aux modèles et le prix de l’API dépendent du forfait sélectionné.

L’entreprise indique que ses serveurs sont hébergés en Europe, que les données transmises sont chiffrées et que le service est conforme au RGPD.