Outil gratuit

Convertir un audio en texte : gratuit, privé, directement dans votre navigateur

Déposez un fichier audio ou vidéo et récupérez une transcription. Le modèle vocal Whisper s'exécute dans votre navigateur, votre enregistrement ne quitte donc jamais votre appareil.

  • Aucun envoi
  • Sans inscription
  • 90+ langues

Déposez ici votre fichier audio ou vidéo

ou cliquez pour choisir un fichier

  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • MP4
  • MOV
  • WEBM

Tout se passe en local : votre fichier est traité dans votre navigateur et n'est jamais envoyé. Seul le modèle vocal (environ 77 Mo) est téléchargé une fois depuis Hugging Face.

Envie de dicter directement dans n'importe quelle app, sans passer par un enregistrement ?

Ownvox écrit ce que vous dites à votre curseur, sur Mac et Windows: un raccourci, n'importe quelle app, et aussi privé que cet outil.

Découvrir Ownvox
3 étapes

Comment ça marche

  1. 01

    Choisir un fichier

    Déposez un fichier MP3, WAV, M4A, OGG ou une vidéo sur la page. Rien n'est envoyé, le fichier reste dans la mémoire de votre navigateur.

  2. 02

    Whisper se charge une fois

    Le modèle Whisper d'OpenAI (environ 77 Mo) est téléchargé une seule fois, puis mis en cache. Ensuite, il démarre immédiatement, même hors ligne.

  3. 03

    Copier ou télécharger

    Regardez le texte apparaître, puis copiez-le ou téléchargez-le en .txt ou en sous-titres .srt avec horodatage.

Confidentialité

Pourquoi transcrire en local ?

La plupart des convertisseurs en ligne gratuits envoient votre enregistrement sur un serveur, le conservent un certain temps et s'en servent souvent pour entraîner leurs modèles. Cet outil ne le fait pas, parce qu'il ne le peut pas : le modèle tourne sur votre machine.

Rien à envoyer

Les entretiens, réunions, mémos vocaux et cours contiennent souvent les paroles d'autres personnes. Les garder sur votre appareil est le moyen le plus simple de rester conforme au RGPD.

Sans inscription, sans limite

Pas de compte, pas de minutes à acheter, pas de filigrane. Les fichiers longs fonctionnent aussi ; un GPU récent transcrit plusieurs fois plus vite que le temps réel.

Fonctionne hors ligne

Une fois le modèle en cache, la transcription n'a plus besoin d'aucune connexion. Coupez le Wi-Fi et vérifiez par vous-même.

Bon à savoir

Formats, langues et limites

Formats

  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • MP4
  • MOV
  • WEBM

L'outil accepte tout fichier que votre navigateur sait décoder : audio MP3, WAV, M4A/AAC, OGG et FLAC, ainsi que la piste audio des vidéos MP4, MOV et WEBM. Il n'y a pas de limite de durée stricte, mais les enregistrements très longs demandent beaucoup de mémoire au navigateur et, sans GPU, de la patience : sur le CPU, comptez à peu près le temps réel, ou un peu moins.

Langues

Whisper comprend plus de 90 langues. Choisissez la langue parlée avant de lancer la transcription : elle indique au modèle à quoi s'attendre, ce qui compte surtout pour les extraits courts et les accents marqués. Le modèle transcrit, il ne traduit pas.

Précision

Cette page utilise Whisper « base », bien adapté à une parole claire dans une pièce calme. Les accents marqués, le bruit de fond, plusieurs personnes qui parlent en même temps et le vocabulaire spécialisé font baisser la qualité. L'outil n'identifie pas les locuteurs ; les horodatages sont disponibles dans l'export .srt.

FAQ

Questions fréquentes

Dernière étape

Vous n'êtes pas lent.C'est votre clavier.

Un raccourci, une voix, un curseur. Le texte arrive là où vous travaillez, instantanément.

Démarrer l'essai gratuit

7 jours gratuits, puis à partir de 9,99 €/mois · résiliable à tout moment pour la fin de la période