メインコンテンツにスキップ
ローカル音声認識

WindowsおよびmacOSでのローカル動画文字起こし

ダウンロードした動画からTXT文字起こしとSRT字幕を自分のコンピュータで作成します。DesktopはFFmpegで音声を準備し、メディアをアップロードせずに音声モデルを実行します。

  • ローカル音声認識
  • TXT + タイムスタンプ付きSRT
  • メディアアップロードなし
実際のSnapVideoTools Desktopのローカル音声認識設定ウィンドウ
macOS上のDesktop 1.0.1設定ウィンドウで有効なローカル音声認識とその言語が表示されている様子。
サポート & 制限

オフライン文字起こしで対応されるもの

DesktopはFFmpegで16kHzの音声を準備し、音声を検出してから、ローカルモデルで1セグメントずつ認識します。

サポートされる入力
「テキスト&字幕を抽出」を選択したダウンロード動画タスク。サポートされる言語は、マンダリン、広東語、英語、日本語、韓国語です。
無料
互換性のあるダウンロード済みビデオタスクに利用可能; 無料版は1日10件の単一ビデオ解析が成功し、プロフィール抽出はなし。
デスクトッププロ
単一ビデオ解析とプロフィール抽出が無制限; 文字起こしは依然としてデバイス上で実行。
プロフィールページング
文字起こしにはページングなし。プロのプロフィールバッチでは、アクセス可能なキューに入ったビデオタスクのみが文字起こし可能。
出力
互換性のあるダウンロードメディアの横にUTF-8 TXTとタイムスタンプ付きSRTの両方が書き込まれる。
システム
Windows 64ビット; macOS Apple SiliconおよびIntel。速度はローカルCPUとメディアの長さに依存。
実際のワークフロー

ローカル文字起こしの作成方法

各ステップは上に示されたデスクトップアプリケーションのコントロールまたはタスク状態に対応します。

  1. 01

    テキスト&字幕を抽出を選択

    互換性のあるビデオをダウンロード開始する前にTXT + SRTを有効化。

  2. 02

    ローカルモデルを有効化

    初回使用時にセットアップを確認し、設定が有効または準備完了と報告されるまで待つ。

  3. 03

    タスクを終了させる

    デスクトップがビデオをダウンロードし、音声を準備し、文字起こしを順次処理。

  4. 04

    出力を開く

    ダウンロード済みメディアの横にある対応する.txtおよび.srtファイルを探す。

タスクが停止したとき

一般的な失敗の理由

失敗はタスクに付随したままなので、同じキュー内の完了したアイテムは引き続き利用可能です。

音声モデルが準備できていない

設定を開き、デスクトップがローカルモデルをダウンロードおよび読み込み完了するまで待ってから再試行。

音声が検出されない

ビデオに聴覚可能な音声が含まれていることを確認。音楽のみ、無音、または非常にノイズが多い音声は空ファイルを作成する可能性あり。

音声準備が失敗

ダウンロード済みビデオを保持して再試行。破損またはサポートされていないファイルはFFmpegによる音声準備を妨げる可能性あり。

Windows · macOS

SnapVideoTools デスクトップを入手

ご使用のコンピュータに適した現在のパッケージを選択してください。リリースカードは、そのパッケージが利用可能な場合のみ表示されます。

無料: 1日あたり10件の単一動画の解析に成功;プロフィール抽出は不可。 デスクトッププロ: 月額$9.90 または年額$79.90で無制限の解析とサポートされているプロフィール抽出が利用可能。 プランを比較.

FAQ

このワークフローに関する質問

動画は文字起こしのためにアップロードされていますか?

いいえ。音声の準備と音声認識はコンピューター上でローカルに実行されます。

どの言語がサポートされていますか?

現在の設定画面では、中国語(普通話)、広東語、英語、日本語、韓国語が表示されています。

精度は保証されますか?

いいえ。結果は言語、音声の明瞭さ、背景雑音、重なり、元の録音に依存します。