Convertir un audio en texte : gratuit, privé, directement dans votre navigateur
Déposez un fichier audio ou vidéo et récupérez une transcription. Le modèle vocal Whisper s'exécute dans votre navigateur, votre enregistrement ne quitte donc jamais votre appareil.
- Aucun envoi
- Sans inscription
- 90+ langues
Déposez ici votre fichier audio ou vidéo
ou cliquez pour choisir un fichier
- MP3
- WAV
- M4A
- AAC
- OGG
- FLAC
- MP4
- MOV
- WEBM
Tout se passe en local : votre fichier est traité dans votre navigateur et n'est jamais envoyé. Seul le modèle vocal (environ 77 Mo) est téléchargé une fois depuis Hugging Face.
Envie de dicter directement dans n'importe quelle app, sans passer par un enregistrement ?
Ownvox écrit ce que vous dites à votre curseur, sur Mac et Windows: un raccourci, n'importe quelle app, et aussi privé que cet outil.
Comment ça marche
- 01
Choisir un fichier
Déposez un fichier MP3, WAV, M4A, OGG ou une vidéo sur la page. Rien n'est envoyé, le fichier reste dans la mémoire de votre navigateur.
- 02
Whisper se charge une fois
Le modèle Whisper d'OpenAI (environ 77 Mo) est téléchargé une seule fois, puis mis en cache. Ensuite, il démarre immédiatement, même hors ligne.
- 03
Copier ou télécharger
Regardez le texte apparaître, puis copiez-le ou téléchargez-le en .txt ou en sous-titres .srt avec horodatage.
Pourquoi transcrire en local ?
La plupart des convertisseurs en ligne gratuits envoient votre enregistrement sur un serveur, le conservent un certain temps et s'en servent souvent pour entraîner leurs modèles. Cet outil ne le fait pas, parce qu'il ne le peut pas : le modèle tourne sur votre machine.
Rien à envoyer
Les entretiens, réunions, mémos vocaux et cours contiennent souvent les paroles d'autres personnes. Les garder sur votre appareil est le moyen le plus simple de rester conforme au RGPD.
Sans inscription, sans limite
Pas de compte, pas de minutes à acheter, pas de filigrane. Les fichiers longs fonctionnent aussi ; un GPU récent transcrit plusieurs fois plus vite que le temps réel.
Fonctionne hors ligne
Une fois le modèle en cache, la transcription n'a plus besoin d'aucune connexion. Coupez le Wi-Fi et vérifiez par vous-même.
Formats, langues et limites
Formats
- MP3
- WAV
- M4A
- AAC
- OGG
- FLAC
- MP4
- MOV
- WEBM
L'outil accepte tout fichier que votre navigateur sait décoder : audio MP3, WAV, M4A/AAC, OGG et FLAC, ainsi que la piste audio des vidéos MP4, MOV et WEBM. Il n'y a pas de limite de durée stricte, mais les enregistrements très longs demandent beaucoup de mémoire au navigateur et, sans GPU, de la patience : sur le CPU, comptez à peu près le temps réel, ou un peu moins.
Langues
Whisper comprend plus de 90 langues. Choisissez la langue parlée avant de lancer la transcription : elle indique au modèle à quoi s'attendre, ce qui compte surtout pour les extraits courts et les accents marqués. Le modèle transcrit, il ne traduit pas.
Précision
Cette page utilise Whisper « base », bien adapté à une parole claire dans une pièce calme. Les accents marqués, le bruit de fond, plusieurs personnes qui parlent en même temps et le vocabulaire spécialisé font baisser la qualité. L'outil n'identifie pas les locuteurs ; les horodatages sont disponibles dans l'export .srt.
Questions fréquentes
Vous n'êtes pas lent.C'est votre clavier.
Un raccourci, une voix, un curseur. Le texte arrive là où vous travaillez, instantanément.
7 jours gratuits, puis à partir de 9,99 €/mois · résiliable à tout moment pour la fin de la période