O modelo de fala não está pronto
Abra Configurações e aguarde o Desktop terminar de baixar e carregar o modelo local antes de tentar novamente.
Crie transcrições TXT e legendas SRT a partir de vídeos baixados em seu próprio computador. O Desktop prepara o áudio com FFmpeg e executa o modelo de fala sem enviar a mídia.
O Desktop prepara áudio a 16 kHz com FFmpeg, detecta fala e reconhece um segmento de cada vez com o modelo local.
Cada etapa corresponde a um controle ou estado de tarefa na aplicação Desktop mostrada acima.
Habilite TXT + SRT antes de iniciar o download de um vídeo compatível.
No primeiro uso, confirme a configuração e aguarde até que Configurações indique Habilitado ou Pronto.
O Desktop baixa o vídeo, prepara o áudio e processa a transcrição em série.
Encontre os arquivos .txt e .srt correspondentes ao lado do mídia baixada.
Falhas permanecem associadas à sua tarefa, então itens concluídos na mesma fila continuam disponíveis.
Abra Configurações e aguarde o Desktop terminar de baixar e carregar o modelo local antes de tentar novamente.
Confirme que o vídeo contém fala audível. Apenas música, áudio silencioso ou extremamente ruidoso pode gerar arquivos vazios.
Mantenha o vídeo baixado disponível e tente novamente. Um arquivo danificado ou não suportado pode impedir o FFmpeg de preparar o áudio.
Escolha o pacote atual para o seu computador. Cartões de lançamento aparecem apenas quando esse pacote está disponível.
Grátis: 10 análises de vídeo único bem-sucedidas por dia; sem extração de perfil. Desktop Pro: $9,90/mês ou $79,90/ano para análise ilimitada e extração de perfil suportada. Comparar planos.
Não. A preparação do áudio e o reconhecimento de fala são executados localmente no computador.
A tela de Configurações atual lista Mandarim, Cantonês, Inglês, Japonês e Coreano.
Não. Os resultados dependem do idioma, clareza da fala, ruído de fundo, sobreposição e da gravação original.