Saltar al contenido principal
CONVERSIÓN LOCAL DE VOZ A TEXTO

Transcripción de video local en Windows y macOS

Crea transcripciones TXT y subtítulos SRT a partir de videos descargados en tu propia computadora. Desktop prepara el audio con FFmpeg y ejecuta el modelo de voz sin subir los medios.

  • Reconocimiento de voz local
  • TXT + SRT con marcas de tiempo
  • Sin carga de medios
Ventana de configuración real de SnapVideoTools Desktop para reconocimiento de voz local
Ventana de configuración real de Desktop 1.0.1 en macOS mostrando el reconocimiento de voz local habilitado y sus idiomas.
Soporte y límites

Qué maneja la transcripción sin conexión

Desktop prepara audio a 16 kHz con FFmpeg, detecta la voz y luego reconoce un segmento a la vez con el modelo local.

Entrada soportada
Una tarea de video descargado con Extraer Texto y Subtítulos seleccionados. Los idiomas de voz soportados incluyen mandarín, cantonés, inglés, japonés y coreano.
Gratis
Disponible para tareas de video descargado compatibles; Free tiene 10 análisis exitosos de un solo video por día y no permite la extracción de perfiles.
Desktop Pro
Análisis ilimitado de un solo video y extracción de perfiles; la transcripción aún se realiza en el dispositivo.
Paginación de perfiles
La transcripción no tiene paginación. En un lote de perfiles Pro, solo se pueden transcribir las tareas de video en cola accesibles.
Resultados
Tanto TXT en UTF-8 como SRT con marcas de tiempo se escriben junto con el medio descargado compatible.
Sistemas
Windows de 64 bits; macOS Apple Silicon e Intel. La velocidad depende de la CPU local y la duración del medio.
Flujo de trabajo real

Cómo crear transcripciones locales

Cada paso se asigna a un estado de control o tarea en la aplicación de escritorio mostrado arriba.

  1. 01

    Seleccionar Extraer Texto y Subtítulos

    Habilitar TXT + SRT antes de iniciar la descarga de un video compatible.

  2. 02

    Habilitar el modelo local

    En el primer uso, confirmar la configuración y esperar hasta que Configuración indique Habilitado o Listo.

  3. 03

    Dejar que la tarea termine

    Desktop descarga el video, prepara el audio y procesa la transcripción de manera secuencial.

  4. 04

    Abrir los resultados

    Encontrar los archivos .txt y .srt correspondientes junto al medio descargado.

Cuando una tarea se detiene

Razones comunes de fallo

Los fallos permanecen vinculados a su tarea, por lo que los elementos completados en la misma cola permanecen disponibles.

El modelo de voz no está listo

Abrir Configuración y dejar que Desktop termine de descargar y cargar el modelo local antes de intentar nuevamente.

No se detecta voz

Confirmar que el video contiene voz audible. Audio solo de música, silencioso o con ruido extremo puede producir archivos vacíos.

La preparación del audio falla

Mantener el video descargado disponible y volver a intentar. Un archivo dañado o no compatible puede impedir que FFmpeg prepare el audio.

Windows · macOS

Descarga SnapVideoTools Desktop

Elige el paquete actual para tu ordenador. Las cartas de lanzamiento aparecen solo cuando ese paquete está disponible.

Gratis: 10 análisis exitosos de vídeo único por día; No hay extracción de perfil. Desktop Pro: 9,90 $/mes o 79,90 $/año por análisis ilimitado y extracción de perfiles soportados. Comparar planes.

FAQ

Preguntas sobre este flujo de trabajo

¿Se ha subido el video para transcripción?

No. La preparación del audio y el reconocimiento de voz se ejecutan localmente en el ordenador.

¿Qué idiomas son compatibles?

La pantalla actual de Configuración lista mandarín, cantonés, inglés, japonés y coreano.

¿Se garantiza la precisión?

No. Los resultados dependen del idioma, la claridad del habla, el ruido de fondo, la superposición y la grabación original.