Skip to content

100% local — tu archivo nunca sale del navegador

Transcribir Audio a Texto

Conversor de audio a texto gratuito que se ejecuta enteramente en tu navegador: tu archivo nunca sale de tu dispositivo.

  • Gratis
  • Sin registro
  • Sin marca de agua
100% local — tu archivo nunca sale del navegadorReady

Cómo funciona

  1. 01

    Elige tu grabación

    Selecciona un archivo de audio — MP3, WAV, M4A, AAC, OGG o FLAC — o un archivo de vídeo, y la pista de audio se extrae por ti. No se sube nada en ningún momento.

  2. 02

    Selecciona el idioma hablado

    Elige el idioma en lugar de dejar que se adivine. Una suposición errónea no falla de forma evidente: produce un texto fluido e inventado, difícil de detectar como incorrecto.

  3. 03

    Copia o exporta

    La transcripción aparece abajo, lista para copiar. Exporta TXT para texto plano, o SRT y VTT si necesitas las marcas de tiempo para subtítulos.

Por qué elegir TranscriptSnap

Pensado para grabaciones que no puedes subir

Notas de pacientes, declaraciones, entrevistas con fuentes, audio de campañas sin lanzar. Procesar en local no reduce el riesgo de divulgación: elimina la divulgación, porque no interviene ningún tercero en ningún momento.

Sin límite de duración ni de cantidad

No hay servidor que imponga un límite. Las grabaciones largas se dividen en ventanas solapadas y se recomponen automáticamente; el único techo real es la memoria de tu dispositivo.

Sigue funcionando sin conexión

Tras la primera ejecución el modelo queda en caché, así que puedes transcribir en un avión o en una oficina con la red restringida. También es la prueba más sencilla de que la herramienta es local: desconéctate e inténtalo.

Todos los formatos de audio habituales, y vídeo

MP3, WAV, M4A, AAC, OGG y FLAC funcionan, y también MP4, MOV y WebM, de los que se extrae la pista de audio por ti. Sin convertir nada antes.

Conviene saber

Un conversor de audio a texto con privacidad real

La mayoría de las herramientas de transcripción suben tu grabación a un servidor. Esta no: el modelo de voz se ejecuta dentro de tu navegador mediante WebAssembly, así que el audio permanece en tu equipo. Eso la hace segura para entrevistas, notas médicas, grabaciones legales y cualquier cosa que prefieras no entregar a terceros.

Funciona sin conexión una vez cargado

El modelo queda en caché tras la primera ejecución, así que puedes transcribir audio a texto más tarde sin conexión alguna. No hay coste por minuto ni límite de subida.

Formatos admitidos y qué conviene darle

Funcionan MP3, WAV, M4A, AAC, OGG y FLAC, y también los contenedores de vídeo habituales como MP4, MOV y WebM: la pista de audio se extrae por ti. Importa mucho más la calidad de lo que grabas que el formato: una grabación a 128 kbps de alguien hablando claro cerca del micrófono gana a un archivo sin pérdida capturado desde el otro lado de la sala. Si puedes elegir, graba en mono a 16 kHz o más y mantén al hablante cerca del micro.

Cómo se manejan los archivos largos

Los modelos de voz trabajan sobre ventanas cortas, así que las grabaciones largas se parten en fragmentos solapados y se vuelven a coser. Ese solape es lo que evita que las frases se corten por la mitad en los empalmes: si alguna vez has visto una transcripción donde desaparecen palabras a intervalos sospechosamente regulares, es una herramienta que se saltó este paso. Los archivos muy largos dependen de la memoria de tu dispositivo y no de ningún límite de subida, así que una hora de audio va cómoda en un portátil y puede pesar en un móvil.

Para quién está pensado

El argumento de privacidad no es abstracto. Subir audio identificable de un paciente a un servicio sin un acuerdo firmado es un problema de cumplimiento en sanidad. Las grabaciones de clientes están amparadas por el secreto profesional en el ámbito jurídico. En periodismo, las grabaciones de fuentes son el trabajo entero, y un procesador externo es una vía de ataque real. El material de campaña sin publicar y bajo acuerdo de confidencialidad directamente no puede enviarse a proveedores no aprobados. En todos esos casos, procesar en local no solo reduce el riesgo: elimina la cesión de datos por completo, porque no hay ningún tercero de por medio.

Cómo corregir el resultado sin perder tiempo

Repasa la transcripción contra el audio de una pasada y a buen ritmo, en lugar de ir corrigiendo palabra por palabra. Los errores se concentran en nombres de personas, nombres de producto y términos técnicos, así que un buscar y reemplazar sobre el puñado de nombres propios de la grabación suele arreglar la mayor parte. La puntuación se deduce, no se oye, así que los finales de frase en habla rápida merecen un segundo vistazo. El resto normalmente está lo bastante bien como para dejarlo tal cual.

Preguntas frecuentes

¿Este conversor de audio a texto es realmente gratis?

Sí, e ilimitado. Como la transcripción ocurre en tu propio dispositivo, no hay coste de servidor que repercutir.

¿Se sube mi audio a algún sitio?

No. El archivo se lee localmente y se procesa en tu navegador. No se envía nada a un servidor.

¿Qué formatos admite?

MP3, WAV, M4A, AAC, OGG, FLAC y vídeos comunes como MP4 y MOV.

¿Qué precisión tiene?

Usa OpenAI Whisper, la misma familia de modelos que emplean la mayoría de los servicios de pago. Con habla clara, el resultado suele quedar muy cerca del literal.

¿Por qué la primera vez es más lenta?

El modelo se descarga una vez y luego queda en caché. Las transcripciones siguientes empiezan de inmediato.

¿Puedo comprobar que no se sube nada?

Sí, y deberías hacerlo. Abre el panel de red del navegador antes de transcribir: verás cómo se descargan los archivos del modelo en la primera ejecución y nada más. O desconéctate de la red una vez cacheado el modelo y transcribe igualmente: eso es algo que ninguna herramienta puede fingir.

¿Funciona en el móvil?

Sí, aunque un móvil es bastante más lento que un portátil y las grabaciones largas pueden agotar su memoria. Para clips cortos va perfecto.

¿Qué es lo que no hace bien?

Los puntos débiles son las voces superpuestas, los nombres propios y el habla con acento marcado sobre ruido de fondo. Tampoco identifica quién está hablando.

Transcribe audio a texto gratis, sin entregar el archivo a nadie

La mayoría de herramientas que transcriben audio a texto son herramientas de servidor: subes, su máquina escucha, recibes el texto y los minutos se contabilizan. Ese modelo está bien para un pódcast que va a ser público de todos modos, y no sirve para buena parte de lo que la gente graba en realidad. Este conversor de audio a texto compila el modelo de voz dentro de tu navegador con WebAssembly, así que la grabación se lee de tu disco y se procesa donde ya estaba. El resultado es la misma salida de Whisper que usan los servicios de pago, sin cuenta, sin cargo por minuto y sin una subida que justificar.