Herramienta gratuita

Convertir audio a texto: gratis, privado y en su propio navegador

Arrastre un archivo de audio o vídeo y obtenga la transcripción. El modelo de voz Whisper funciona dentro de su navegador, así que su grabación nunca sale de su dispositivo.

  • Sin subir nada
  • Sin registro
  • 90+ idiomas

Suelte aquí su archivo de audio o vídeo

o haga clic para elegir un archivo

  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • MP4
  • MOV
  • WEBM

Todo ocurre en local: su archivo se procesa en su navegador y nunca se sube. Solo el modelo de voz (unos 77 MB) se descarga una vez desde Hugging Face.

¿Prefiere dictar directamente en cualquier app, sin grabar antes?

Ownvox escribe lo que dice en su cursor, en Mac y Windows: un atajo, cualquier app, y tan privado como esta herramienta.

Descubrir Ownvox
3 pasos

Cómo funciona

  1. 01

    Elegir un archivo

    Arrastre un MP3, WAV, M4A, OGG o un vídeo a la página. No se sube nada, el archivo se queda en la memoria de su navegador.

  2. 02

    Whisper se carga una vez

    El modelo Whisper de OpenAI (unos 77 MB) se descarga una sola vez y se guarda en caché. A partir de ahí arranca al instante, incluso sin conexión.

  3. 03

    Copiar o descargar

    Vea aparecer el texto y después cópielo o descárguelo como .txt o como subtítulos .srt con marcas de tiempo.

Privacidad

¿Por qué transcribir en local?

La mayoría de los conversores online gratuitos suben su grabación a un servidor, la conservan un tiempo y a menudo la usan para entrenar sus modelos. Esta herramienta no lo hace, porque no puede: el modelo se ejecuta en su propio ordenador.

Nada que subir

Las entrevistas, reuniones, notas de voz y clases contienen a menudo palabras de otras personas. Mantenerlas en su dispositivo es la forma más sencilla de cumplir el RGPD.

Sin registro, sin límite

Sin cuenta, sin minutos que comprar, sin marca de agua. Los archivos largos también funcionan; una GPU moderna transcribe muchas veces más rápido que el tiempo real.

Funciona sin conexión

Una vez que el modelo está en caché, la transcripción no necesita conexión alguna. Apague el wifi y compruébelo usted mismo.

Conviene saber

Formatos, idiomas y límites

Formatos

  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • MP4
  • MOV
  • WEBM

La herramienta acepta cualquier archivo que su navegador sepa decodificar: audio MP3, WAV, M4A/AAC, OGG y FLAC, además de la pista de audio de vídeos MP4, MOV y WEBM. No hay un límite de duración fijo, pero las grabaciones muy largas necesitan mucha memoria del navegador y, sin GPU, paciencia: en la CPU cuente con aproximadamente el tiempo real, o algo menos.

Idiomas

Whisper entiende más de 90 idiomas. Elija el idioma hablado antes de empezar: le indica al modelo qué esperar, lo que importa sobre todo en clips cortos y acentos marcados. El modelo transcribe, no traduce.

Precisión

Esta página usa Whisper «base», adecuado para un habla clara en una sala tranquila. Los acentos marcados, el ruido de fondo, varias personas hablando a la vez y el vocabulario especializado bajan la calidad. No distingue quién habla; las marcas de tiempo están en la exportación .srt.

FAQ

Preguntas frecuentes

Último paso

No eres lento.Lo es tu teclado.

Un atajo, una voz, un cursor. El texto aparece donde estás trabajando, al instante.

Empiece la prueba gratuita

7 días gratis, luego desde 9,99 €/mes · cancela cuando quieras, con efecto al final del periodo