Model mowy nie jest gotowy
Otwórz Ustawienia i pozwól Desktopowi zakończyć pobieranie i ładowanie lokalnego modelu przed ponowną próbą.
Twórz transkrypcje TXT i napisy SRT z pobranego wideo na własnym komputerze. Desktop przygotowuje dźwięk za pomocą FFmpeg i uruchamia model mowy bez przesyłania mediów.
Desktop przygotowuje dźwięk w 16 kHz za pomocą FFmpeg, wykrywa mowę, następnie rozpoznaje jeden segment na raz przy użyciu lokalnego modelu.
Każdy krok odpowiada kontrolce lub stanowi zadania w aplikacji Desktop pokazanej powyżej.
Włącz TXT + SRT przed rozpoczęciem pobierania zgodnego wideo.
Przy pierwszym użyciu potwierdź konfigurację i poczekaj, aż w Ustawieniach pojawi się raport Włączony lub Gotowy.
Desktop pobiera wideo, przygotowuje audio i przetwarza transkrypcję kolejno.
Znajdź odpowiadające pliki .txt i .srt obok pobranego materiału.
Niepowodzenia pozostają przypisane do swojego zadania, więc ukończone elementy w tej samej kolejce pozostają dostępne.
Otwórz Ustawienia i pozwól Desktopowi zakończyć pobieranie i ładowanie lokalnego modelu przed ponowną próbą.
Upewnij się, że wideo zawiera słyszalną mowę. Materiał muzyczny, cichy lub o bardzo hałaśliwym dźwięku może skutkować pustymi plikami.
Zachowaj pobrane wideo i spróbuj ponownie. Uszkodzony lub nieobsługiwany plik może uniemożliwić FFmpeg przygotowanie audio.
Wybierz aktualny pakiet dla swojego komputera. Karty wydania pojawiają się tylko wtedy, gdy pakiet jest dostępny.
Darmowy: 10 udanych analiz pojedynczych wideo dziennie; brak ekstrakcji profilu. Desktop Pro: 9,90 USD/miesiąc lub 79,90 USD/rok za nieograniczoną analizę i obsługiwaną ekstrakcję profilu. Porównaj plany.
Nie. Przygotowanie audio i rozpoznawanie mowy odbywa się lokalnie na komputerze.
Aktualny ekran ustawień wymienia mandaryński, kantoński, angielski, japoński i koreański.
Nie. Wyniki zależą od języka, wyrazistości mowy, szumów tła, nakładania się dźwięków i nagrania źródłowego.