Skip to content

100% local — tu archivo nunca sale del navegador

Generador de Transcripción de Vídeo

Suelta un archivo de audio o vídeo y obtén una transcripción limpia en segundos: gratis, sin registro, con SRT y VTT.

  • Gratis
  • Sin registro
  • Sin marca de agua
100% local — tu archivo nunca sale del navegadorReady

Cómo funciona

  1. 01

    Añade tu archivo

    Elige un archivo de audio o vídeo de tu dispositivo, o arrástralo directamente a la página.

  2. 02

    Lo transcribimos

    Elige el idioma hablado y la voz se convierte en texto: 16 idiomas disponibles.

  3. 03

    Copia o exporta

    Copia la transcripción o descárgala en TXT, SRT o VTT para subtítulos.

Por qué elegir TranscriptSnap

El vídeo nunca llega a un servidor

El modelo de voz se ejecuta dentro de esta pestaña, así que el archivo se lee del disco y ahí se queda. No es «cifrado en tránsito»: nunca se transmite. Puedes comprobarlo en el panel de red mientras funciona.

Sin límite, porque no hay nada que medir

Los servicios cobran por minuto porque cada minuto les cuesta tiempo de GPU. Aquí el trabajo ocurre en el dispositivo que ya tienes en la mano, así que no hay coste por minuto que repercutir ni motivo para ponerte cuota.

Los subtítulos salen de la misma pasada

Las marcas de tiempo se generan junto al texto, así que una sola ejecución te da transcripción y archivo de subtítulos. Exporta SRT para el editor de vídeo o VTT para vídeo HTML5, ya sincronizado.

Eliges el idioma; no se adivina

Hay 16 idiomas en la lista y cada uno se midió antes de incluirlo. Tú eliges cuál aplica, porque una suposición errónea no falla de forma visible: produce un texto fluido que nadie dijo.

Conviene saber

Por qué funciona dentro de tu navegador

El modelo de voz se ejecuta dentro de tu propio navegador y no en nuestros servidores. Esa única decisión explica casi todo lo demás: no se envía nada a ninguna parte, así que una grabación que jamás entregarías a un tercero se puede transcribir aquí sin problema; no hay coste por minuto que medir, así que no hay límite de cuánto transcribes; y una vez que el modelo queda en caché sigue funcionando sin conexión alguna. El precio es una descarga única del modelo y unos segundos de trabajo de tu propio equipo: en cualquier dispositivo moderno, el cambio compensa.

Para qué sirve de verdad una transcripción

Casi nadie quiere la transcripción en sí. Quiere lo que permite hacer: subtítulos para un vídeo que se verá sin sonido, un pie de publicación escrito con lo que realmente se dijo y no de memoria, marcas de tiempo que señalan los veinte segundos que merece la pena recortar, o un registro consultable de una reunión de la que nadie tomó notas. El texto además se traduce bien, cosa que el audio no: una transcripción suele ser el primer paso para llegar a un público en otro idioma.

Precisión, dicho con honestidad

El audio limpio con una sola persona hablando sale casi literal, y corregir el resultado es más rápido que escribir desde cero. La precisión se degrada de formas predecibles: dos personas hablando a la vez se mezclan en un solo hilo, los nombres propios y la jerga técnica concentran la mayoría de los errores, y las grabaciones lejanas o con ruido salen bastante peor. El modelo prefiere adivinar una palabra plausible antes que dejar un hueco, así que los errores se leen con total seguridad. Trátalo como un buen primer borrador, no como un documento definitivo.

Por qué no cuesta nada

Los servicios de transcripción cobran por minuto porque cada minuto que les envías les cuesta tiempo de GPU. Aquí ese trabajo se traslada al dispositivo que ya tienes en la mano, así que no hay coste por minuto que repercutir ni incentivo para medirte. El modelo se descarga una vez, más o menos lo que ocupa un episodio corto de pódcast, y a partir de ahí se reutiliza desde la caché. No hay plan de pago que reserve más precisión o más duración, porque no hay ningún coste por minuto que tengamos que recuperar.

Qué no guardamos

No hay nada que guardar: el archivo lo lee tu propio navegador desde el disco y nunca llega hasta nosotros, y la transcripción se genera y se muestra sin ninguna ida y vuelta. Como no hay cuenta, no hay historial que explotar ni nada que se pueda filtrar. Y no hace falta que nos creas: abre el panel de red del navegador mientras se transcribe y verás que el audio no va a ninguna parte, una garantía más fuerte que cualquier política de privacidad.

Preguntas frecuentes

¿Es gratis este generador de transcripción de vídeo?

Sí, sin ningún límite. La transcripción se ejecuta enteramente dentro de tu navegador, así que no hay coste de servidor por minuto que repercutirte: sin cuenta, sin prueba, sin plan de pago.

¿Necesito crear una cuenta?

No. No hay registro, no pedimos correo electrónico y nada de lo que exportas lleva marca de agua.

¿Qué idiomas admite?

Hay 16 idiomas en el menú de idioma del audio, incluidos español, inglés, portugués, vietnamita, ruso y chino. La lista es corta a propósito: un idioma solo se incluye después de medirlo, porque una transcripción con un 25% de error sigue leyéndose con fluidez y cuesta darse cuenta de que está mal. Eliges el idioma en lugar de dejar que se adivine: una suposición equivocada no falla de forma evidente, produce un texto fluido pero inventado, así que la decisión es tuya. El chino puede escribirse en caracteres simplificados o tradicionales.

¿Puedo generar subtítulos a partir de la transcripción?

Sí. Cada transcripción se puede exportar en SRT o VTT con marcas de tiempo, listas para cualquier editor de vídeo.

¿Cuánto puede durar el audio?

En modo subida no hay límite del lado del servidor, porque no hay servidor. Las grabaciones muy largas dependen de la memoria de tu dispositivo: los archivos de varias horas van cómodos en un ordenador y pueden atascarse en un móvil.

¿Identifica quién habla?

No. Etiquetar hablantes (diarización) requiere un segundo modelo que no es viable ejecutar en el navegador. El resultado es un único texto continuo.

¿Se sube mi archivo a algún sitio?

No. El archivo lo lee tu propio navegador desde el disco y se transcribe en la misma pestaña. Abre el panel de red mientras funciona y verás que el modelo se descarga una vez y no sale nada más.

¿Qué formatos de archivo funcionan?

Vídeo en MP4, MOV, WebM, MKV y AVI, y audio en MP3, WAV, M4A, AAC, OGG y FLAC. En el caso del vídeo, la pista de audio se extrae por ti.

Un generador de transcripción de vídeo gratuito que funciona en tu propio equipo

Llámalo transcriptor de vídeo, convertir vídeo a texto o simplemente generador de transcripción gratis: el trabajo es el mismo, coger una grabación y devolver palabras que se puedan buscar, citar, subtitular y traducir. Lo que cambia entre herramientas es dónde ocurre ese trabajo. Casi todo en esta categoría sube tu archivo a un servidor y factura los minutos. Esta compila el modelo de voz dentro de tu navegador, lo que elimina la subida, la cuenta y el límite de una sola vez, a cambio de una descarga única del modelo y unos segundos de tu propio procesador. Para cualquier cosa que dudarías en entregar a un tercero, ese intercambio es justamente el motivo.