Fonctionnalités de VexaScribe
VexaScribe — transcription par IA en 99 langues. Détection des locuteurs, horodatages, résumés IA et traduction de transcription intégrée (133 langues). Importez des fichiers ou envoyez un bot de réunion à Zoom, Meet ou Teams. À partir de $2/mois.
Ce qu'est VexaScribe, en 80 mots
VexaScribe est une application web qui transforme l'audio et la vidéo en transcriptions recherchables, horodatées et étiquetées par locuteur, propulsée par OpenAI Whisper. Déposez un fichier (jusqu'à 5 Go), collez un lien YouTube / TikTok / Instagram / URL directe, ou envoyez un bot à votre réunion Zoom, Google Meet ou Teams. Obtenez une transcription en 99 langues en ~5 à 10 minutes par heure d'audio, un résumé IA optionnel avec actions, et des exports en TXT, DOCX, SRT, VTT ou JSON. 30 minutes gratuites, puis $2 à $20/mois. Aucune carte bancaire requise pour commencer.
Fonctionnalités principales
99 langues prises en charge
Transcrivez de l'audio et de la vidéo en 99 langues avec détection automatique de la langue. De l'anglais au japonais, de l'espagnol à l'arabe — nous vous couvrons.
Détection des locuteurs
La détection automatique des locuteurs identifie et étiquette les différentes voix. Parfait pour les entretiens, les podcasts et les réunions avec plusieurs participants.
Horodatages
Chaque transcription inclut des horodatages précis. Cliquez sur n'importe quel horodatage pour aller directement à ce moment dans votre audio. Indispensable pour la navigation et les sous-titres vidéo.
5 formats d'export
Exportez en TXT (texte brut), DOCX (Word), SRT ou VTT (sous-titres vidéo), ou JSON (données structurées avec horodatages). Choisissez le format qui correspond à votre workflow.
Traitement rapide
La transcription par IA se termine en minutes, pas en heures. Un enregistrement d'1 heure est généralement traité en 5 à 10 minutes.
Éditeur intégré
Relisez et modifiez vos transcriptions directement dans le navigateur. Corrigez les erreurs, renommez les locuteurs et peaufinez votre transcription avant l'export.
Bot de réunion
Envoyez un bot IA à vos réunions Zoom, Google Meet ou Teams. Il enregistre, transcrit et génère des résumés structurés avec actions et décisions. Utilise 3× les crédits de transcription.
Résumés IA
Transformez n'importe quelle transcription en points clés structurés, actions, marqueurs de chapitres et décisions. Fonctionne sur les réunions, cours, entretiens et podcasts. Inclus dans tous les forfaits payants.
Traduction de transcription
Traduisez n'importe quelle transcription dans 133 langues via Google Translate — sans coût supplémentaire, sans compte tiers nécessaire. Disponible sur tous les forfaits.
Import groupé — 50 fichiers à la fois
Importez jusqu'à 50 fichiers audio ou vidéo en une seule fois. Tous traités en parallèle — pas un par un. Mélangez les formats librement et téléchargez le tout dans un ZIP.
Chat IA avec votre transcription
Posez des questions en langage naturel sur n'importe quelle transcription que vous possédez et obtenez des réponses appuyées par des citations directes de l'audio. « Quelles actions ont été attribuées ? », « Qu'a décidé Sarah ? », « Trouvez la citation la plus forte sur X » — les questions pour lesquelles vous réécouteriez normalement un enregistrement deviennent une seule requête. Chaque réponse est accompagnée de citations horodatées cliquables qui amènent le lecteur audio au moment exact où la citation a été prononcée. Les citations sont validées côté serveur contre la transcription réelle — l'IA est limitée à votre enregistrement et ne peut inventer ni horodatage ni citation. Les conversations sont conservées 90 jours, avec contexte multi-tours et prise en charge de 99 langues (posez la question dans une langue à propos d'un enregistrement dans une autre). Disponible sur les forfaits payants.
Formats pris en charge
Formats audio
Formats vidéo
Formats d'export (5)
Texte brut
Document Word
Sous-titres
Sous-titres web
Données structurées
Cas d'usage
Transcription de réunions
Un bot IA rejoint les réunions Zoom, Meet ou Teams
Transcription de podcasts
Transformez les épisodes en notes d'émission et articles de blog
Transcription d'entretiens
Transcrivez avec détection des locuteurs
Transcription de cours
Convertissez les enregistrements de cours en notes de révision
Vidéo vers texte
Extrayez les transcriptions et créez des sous-titres
MP3 vers texte
Convertissez les fichiers audio en documents texte
Transcription audio
Conversion audio-vers-texte générale
Propulsé par une IA de pointe
VexaScribe utilise des modèles de reconnaissance vocale à la pointe entraînés sur des millions d'heures d'audio. La même technologie que celle des assistants vocaux, adaptée pour une transcription précise.
Précision pour un audio clair
Langues prises en charge
Temps de traitement par heure
Disponibilité des fonctionnalités par forfait
Tous les forfaits incluent un essai gratuit. Aucune carte bancaire requise pour commencer.
| Fonctionnalité | Essai gratuit | Starter ($2/mois) | Pro ($10/mois) |
|---|---|---|---|
| Transcription audio & vidéo | ✓ | ✓ | ✓ |
| 99 langues prises en charge | ✓ | ✓ | ✓ |
| Détection des locuteurs | ✓ | ✓ | ✓ |
| Horodatages | ✓ | ✓ | ✓ |
| Export : TXT, DOCX, SRT, VTT, JSON | ✓ | ✓ | ✓ |
| Traduction de transcription (133 langues) | ✓ | ✓ | ✓ |
| Éditeur intégré | ✓ | ✓ | ✓ |
| Résumés IA | — | ✓ | ✓ |
| Bot de réunion (Zoom, Meet, Teams) | — | ✓ | ✓ |
| Transcription groupée | ✓ | ✓ | ✓ |
Transcrire depuis une URL — aucun téléchargement nécessaire
Collez un lien et obtenez une transcription. Nous gérons le téléchargement en arrière-plan. Même précision, même résultat, même coût en minutes qu'un import de fichier — vous évitez l'étape « télécharger la vidéo d'abord, puis l'importer ».
| Source | Statut | Ce qu'elle accepte |
|---|---|---|
| YouTube | ✓ Disponible | Toute URL de vidéo publique. L'audio est extrait et transcrit avec détection des locuteurs. Bascule sur les sous-titres si le téléchargement audio échoue. |
| TikTok | ✓ Disponible | Toute URL de vidéo TikTok publique — les clips courts de type Reels et les vidéos plus longues fonctionnent. |
| ✓ Disponible | Reels publics, publications vidéo et Stories vidéo. Les publications photo renvoient une erreur claire « aucun contenu vidéo ». | |
| URL directe | ✓ Disponible | Tout lien HTTPS vers un fichier audio ou vidéo — MP3 de podcast, lien S3, partage Google Drive, téléchargement de bot Telegram, Dropbox, etc. |
| Spotify | ⏳ Bientôt disponible | Reconnu mais pas encore développé. Collez un lien et une invite « Voter pour l'accélérer » apparaît afin que nous puissions prioriser selon la demande. |
Modèle de coût : Les imports par URL puisent dans le même pool mensuel de minutes que les imports de fichiers — 1 minute d'audio = 1 minute de votre forfait. Pas de palier URL séparé.
Ce que VexaScribe ne fait pas
Cinq choses pour lesquelles VexaScribe n'est vraiment pas conçu, avec l'outil que nous recommanderions dans chaque cas. Si votre usage figure dans cette liste, épargnez-vous l'inscription à l'essai.
Pas de sous-titrage en direct en temps réel
Les transcriptions sont générées après l'import, pas pendant que vous parlez. Un fichier d'1 heure prend 5 à 10 minutes à traiter — parfait pour les réunions à revoir, inadapté aux événements en direct.
Utilisez plutôt : Otter Live, les sous-titres intégrés de Google Meet, ou Web Captioner pour du sous-titrage en direct gratuit dans le navigateur.
Pas d'API REST publique
VexaScribe est une application web pour humains, pas un service backend. Il n'y a pas d'API développeur, pas de SDK, pas de webhook pour les imports programmatiques.
Utilisez plutôt : OpenAI Whisper API ($0.006/min), Deepgram Nova-3 (~$0.0043/min) ou AssemblyAI (~$0.012/min).
Pas de montage vidéo
Vous pouvez exporter des sous-titres SRT/VTT à intégrer dans votre éditeur, mais VexaScribe ne coupe pas de clips, ne supprime pas les mots parasites et n'incruste pas les sous-titres dans la vidéo.
Utilisez plutôt : Descript ou Vrew pour le montage vidéo basé sur la transcription ; Premiere/Final Cut/DaVinci pour les workflows NLE traditionnels.
Pas d'ajustement de vocabulaire personnalisé
Vous ne pouvez pas importer un dictionnaire de noms de marques, de médicaments ou de jargon technique pour orienter le modèle. Whisper est utilisé tel quel, sans fine-tuning par compte.
Utilisez plutôt : Le « word boost » d'AssemblyAI ou le paramètre « keywords » de Deepgram pour les domaines chargés de noms propres.
Pas de déploiement on-premise / auto-hébergement entreprise
L'audio est traité dans notre cloud — il n'y a pas de déploiement air-gapped ni signé HIPAA-BAA disponible. Pour du contenu avocat-client, thérapie clinique ou classifié où une fuite crée une responsabilité juridique directe, aucun outil cloud (le nôtre inclus) n'est le bon choix.
Utilisez plutôt : installez OpenAI Whisper localement (gratuit, tourne sur votre machine, l'audio ne sort jamais), ou pour une précision juridique à 100 %, utilisez la transcription humaine (Rev, GoTranscript) à $1.25–$1.99/min.
Précision honnête — ce que les chiffres signifient vraiment
VexaScribe utilise OpenAI Whisper (spécifiquement des modèles de classe large-v3). Les pages marketing adorent dire « 99 % de précision » — ce n'est pas honnête. La précision réelle de Whisper dépend fortement de la qualité audio, de l'accent et du nombre de locuteurs. Voici à quoi vous attendre.
Précision de transcription (Whisper)
- Anglais studio propre, un seul locuteur~92–97 %
- Anglais accentué (non natif, régional)~85–92 %
- Environnements bruyants (cafés, téléphone, extérieur)~80–90 %
- Espagnol, français, allemand, italien, portugais, néerlandais propres~88–94 %
- Coréen, japonais, indonésien, turc, arabe, polonais~85–92 %
Source : Open ASR Leaderboard + benchmarks du papier Whisper (LibriSpeech, FLEURS, Common Voice).
Précision de la détection des locuteurs
- 2 locuteurs, aucun chevauchement95 %+
- 3–4 locuteurs, chevauchement occasionnel~88–94 %
- 5–6 locuteurs, dynamique de réunion~80–90 %
- 7–15 locuteurs, panel ou groupe de discussion~70–82 %
- Jusqu'à 50 locuteurs (maximum pris en charge)variable
Meilleure précision avec 2 à 6 locuteurs distincts. Vous pouvez renommer Locuteur 1/2/3 dans l'éditeur ensuite.
Ce qui fait vraiment la différence
Trois choses qui comptent plus que de choisir le « meilleur » outil de transcription :
- Un micro correct (un casque USB ou un micro-cravate bat le micro intégré du portable de 5 à 15 points de précision).
- Un locuteur à la fois — les chevauchements détruisent à la fois la transcription et la détection des locuteurs.
- Peu de bruit de fond. Enregistrez dans une pièce fermée, pas à côté d'un ventilateur ou d'une bouche de CVC.
Si vous avez besoin d'une précision juridique à 100 % (dépôts au tribunal, recherche réglementée), utilisez des services de transcription humaine comme Rev ou GoTranscript à $1.25–$1.99/min. L'IA vous amène à ~95 % pour 1 à 2 % du coût — parfait pour la plupart des usages, inadapté pour certains.
FAQ sur les fonctionnalités
Quelles langues VexaScribe prend-il en charge et quelle est leur précision ?
99 langues, toutes propulsées par OpenAI Whisper. La précision dépend de la langue et de la qualité audio : ~92–97 % sur un audio anglais propre (selon l'Open ASR Leaderboard), ~88–94 % sur de l'espagnol, français, allemand, italien, portugais et néerlandais propres, et ~85–92 % sur le coréen, japonais, indonésien, turc, polonais et arabe. Un accent très marqué, des locuteurs qui se chevauchent ou un environnement bruyant abaissent ces chiffres de 5 à 10 points. La langue est détectée automatiquement, ou vous pouvez la forcer manuellement.
VexaScribe dispose-t-il d'une API REST publique ?
Pas encore — VexaScribe est une application web, pas un produit API. Si vous devez intégrer la transcription dans votre propre logiciel, utilisez l'API OpenAI Whisper ($0.006/min), Deepgram (~$0.0043/min sur Nova-3) ou AssemblyAI (~$0.012/min). Les trois disposent de SDK et de documentation appropriés. Si vous voulez un workflow no-code qui importe des fichiers et télécharge des transcriptions, VexaScribe est le bon choix — mais pas via API.
Quels formats de fichiers VexaScribe peut-il transcrire ?
Audio : MP3, WAV, M4A, FLAC, OGG, AAC, WMA, OPUS. Vidéo : MP4, MOV, AVI, MKV, WebM, WMV, FLV. La piste audio est extraite automatiquement des fichiers vidéo — aucune étape de conversion séparée. Exports : TXT, DOCX, SRT, VTT, JSON.
Quelle taille de fichier puis-je importer ?
Jusqu'à 5 Go par fichier, ce qui représente environ 90 heures de MP3 à 128 kbps ou environ 8 heures de vidéo 1080p. C'est bien au-delà de la limite de 25 Mo de la plupart des convertisseurs gratuits et de la limite d'environ 200 Mo de l'offre gratuite d'Otter. Pour les fichiers de plus de 5 Go, découpez le fichier dans Audacity ou ffmpeg et importez les morceaux séparément.
VexaScribe entraîne-t-il des modèles IA sur mon audio ?
Non. Votre audio et vos transcriptions ne sont pas utilisés pour entraîner un quelconque modèle — ni le nôtre ni celui d'OpenAI (nous utilisons Whisper via API, qui ne s'entraîne pas sur les entrées). Vous pouvez supprimer n'importe quel fichier depuis votre tableau de bord à tout moment, et l'audio comme la transcription sont supprimés. L'audio est chiffré en transit (TLS) et au repos. Pour du contenu avocat-client, clinique ou classifié où une fuite créerait une responsabilité juridique directe, installez plutôt OpenAI Whisper localement — aucun outil cloud, y compris le nôtre, ne vaut ce risque.
Qu'est-ce qui est inclus dans l'essai gratuit ?
30 minutes de crédit de transcription, les 99 langues, la détection des locuteurs, les horodatages, tous les formats d'export (TXT/DOCX/SRT/VTT/JSON), l'éditeur intégré, l'import groupé (jusqu'à 50 fichiers) et la traduction de transcription dans 133 langues. Aucune carte bancaire requise. Les résumés IA et le bot de réunion (Zoom/Meet/Teams) sont réservés aux forfaits payants — ils commencent à $2/mois sur le forfait Starter.
Prêt à commencer à transcrire ?
Essayez VexaScribe gratuitement avec 30 minutes de transcription. Aucune carte bancaire requise.