El modelo de voz no está listo
Abrir Configuración y dejar que Desktop termine de descargar y cargar el modelo local antes de intentar nuevamente.
Crea transcripciones TXT y subtítulos SRT a partir de videos descargados en tu propia computadora. Desktop prepara el audio con FFmpeg y ejecuta el modelo de voz sin subir los medios.
Desktop prepara audio a 16 kHz con FFmpeg, detecta la voz y luego reconoce un segmento a la vez con el modelo local.
Cada paso se asigna a un estado de control o tarea en la aplicación de escritorio mostrado arriba.
Habilitar TXT + SRT antes de iniciar la descarga de un video compatible.
En el primer uso, confirmar la configuración y esperar hasta que Configuración indique Habilitado o Listo.
Desktop descarga el video, prepara el audio y procesa la transcripción de manera secuencial.
Encontrar los archivos .txt y .srt correspondientes junto al medio descargado.
Los fallos permanecen vinculados a su tarea, por lo que los elementos completados en la misma cola permanecen disponibles.
Abrir Configuración y dejar que Desktop termine de descargar y cargar el modelo local antes de intentar nuevamente.
Confirmar que el video contiene voz audible. Audio solo de música, silencioso o con ruido extremo puede producir archivos vacíos.
Mantener el video descargado disponible y volver a intentar. Un archivo dañado o no compatible puede impedir que FFmpeg prepare el audio.
Elige el paquete actual para tu ordenador. Las cartas de lanzamiento aparecen solo cuando ese paquete está disponible.
Gratis: 10 análisis exitosos de vídeo único por día; No hay extracción de perfil. Desktop Pro: 9,90 $/mes o 79,90 $/año por análisis ilimitado y extracción de perfiles soportados. Comparar planes.
No. La preparación del audio y el reconocimiento de voz se ejecutan localmente en el ordenador.
La pantalla actual de Configuración lista mandarín, cantonés, inglés, japonés y coreano.
No. Los resultados dependen del idioma, la claridad del habla, el ruido de fondo, la superposición y la grabación original.