Zum Hauptinhalt springen
LOKALE SPRACHERKENNUNG

Lokale Videotranskription unter Windows und macOS

Erstelle TXT-Transkripte und SRT-Untertitel aus heruntergeladenen Videos auf deinem eigenen Computer. Desktop bereitet Audio mit FFmpeg vor und führt das Sprachmodell aus, ohne die Medien hochzuladen.

  • Lokale Spracherkennung
  • TXT + zeitgestempelte SRT
  • Kein Medien-Upload
Tatsächliches SnapVideoTools Desktop-Fenster für lokale Sprach-zu-Text-Einstellungen
Tatsächliches Desktop 1.0.1-Einstellungsfenster auf macOS, das aktivierte lokale Sprach-zu-Text-Funktion und deren Sprachen zeigt.
Support & Limits

Was Offline-Transkription verarbeitet

Desktop bereitet 16 kHz Audio mit FFmpeg vor, erkennt Sprache und transkribiert dann jeweils ein Segment mit dem lokalen Modell.

Unterstützte Eingabe
Eine heruntergeladene Videoaufgabe mit ausgewähltem Text- & Untertitel-Extrahieren. Unterstützte Sprachen sind Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch.
Free
Verfügbar für kompatible heruntergeladene Videoaufgaben; Free hat täglich 10 erfolgreiche Einzelvideo-Parses und keine Profilextraktion.
Desktop Pro
Unbegrenztes Einzelvideo-Parsing und Profilextraktion; Die Transkription läuft weiterhin auf dem Gerät.
Profilpaging
Die Transkription hat kein Paging. In einem Pro-Profil-Batch können nur zugängliche Warteschlangen-Videoaufgaben transkribiert werden.
Ausgaben
Sowohl UTF-8 TXT als auch zeitgestempeltes SRT werden neben den kompatiblen heruntergeladenen Medien geschrieben.
Systeme
Windows 64-Bit; macOS, Apple, Silicon und Intel. Die Geschwindigkeit hängt von der lokalen CPU und der Mediendauer ab.
Tatsächlicher Arbeitsablauf

Wie man lokale Transkripte erstellt

Jeder Schritt entspricht einer Steuerung oder einem Aufgabenstatus in der oben gezeigten Desktop-Anwendung.

  1. 01

    Auswählen Text und Untertitel

    Aktiviere TXT + SRT, bevor du einen kompatiblen Video-Download startest.

  2. 02

    Aktiviere das lokale Modell

    Beim ersten Gebrauch bestätigen Sie die Einrichtung und warten Sie, bis die Einstellungen als aktiviert oder bereit angezeigt werden.

  3. 03

    Lass die Aufgabe zu Ende gehen

    Der Desktop lädt das Video herunter, bereitet Audio vor und verarbeitet die Transkription seriell.

  4. 04

    Öffnen Sie die Ausgaben

    Finde die passenden .txt und .srt Dateien neben den heruntergeladenen Medien.

Wenn eine Aufgabe stoppt

Häufige Fehlerursachen

Fehler bleiben an ihre Aufgabe gebunden, sodass abgeschlossene Elemente in derselben Warteschlange verfügbar bleiben.

Das Sprachmodell ist noch nicht bereit

Öffne die Einstellungen und lass den Desktop das lokale Modell herunterladen und laden, bevor du es erneut versuchst.

Es wird keine Sprache erkannt

Bestätigen Sie, dass das Video hörbare Sprache enthält. Reine Musik, stummes oder extrem lautes Audio kann leere Dateien erzeugen.

Audiovorbereitung fehlschlägt

Halten Sie das heruntergeladene Video verfügbar und versuchen Sie es erneut. Eine beschädigte oder nicht unterstützte Datei kann FFmpeg daran hindern, Audio vorzubereiten.

Windows · macOS

SnapVideoTools Desktop holen

Wählen Sie das aktuelle Paket für Ihren Computer. Freigabekarten erscheinen nur, wenn dieses Paket verfügbar ist.

Kostenlos: 10 erfolgreiche Einzelvideo-Analysen pro Tag; keine Profilextraktion. Desktop Pro: $9,90/Monat oder $79,90/Jahr für unbegrenzte Analysen und unterstützte Profilextraktion. Pläne vergleichen.

FAQ

Fragen zu diesem Arbeitsablauf

Wird das Video für die Transkription hochgeladen?

Nein. Die Audio-Vorbereitung und Spracherkennung erfolgen lokal auf dem Computer.

Welche Sprachen werden unterstützt?

Der aktuelle Einstellungsbildschirm listet Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch auf.

Ist die Genauigkeit garantiert?

Nein. Die Ergebnisse hängen von der Sprache, der Sprachklarheit, dem Hintergrundgeräusch, Überlappungen und der Ausgangsaufnahme ab.