주요 콘텐츠로 건너뛰기
로컬 음성 인식

Windows 및 macOS에서 로컬 비디오 전사

다운로드한 비디오에서 TXT 전사본 및 SRT 자막을 직접 생성하세요. Desktop은 FFmpeg로 오디오를 준비하고, 미디어를 업로드하지 않고 로컬 모델로 음성을 인식합니다.

  • 로컬 음성 인식
  • TXT + 시간표시 SRT
  • 미디어 업로드 없음
실제 SnapVideoTools Desktop 로컬 음성 인식 설정 창
macOS에서 실행되는 Desktop 1.0.1 설정 창에 로컬 음성 인식과 지원 언어가 활성화되어 표시됨.
지원 및 한도

오프라인 전사가 처리하는 내용

Desktop은 FFmpeg로 16 kHz 오디오를 준비하고, 음성을 감지한 후 로컬 모델로 한 번에 한 구간씩 인식합니다.

지원 입력
텍스트 및 자막 추출이 선택된 다운로드 비디오 작업. 지원 음성: 중국어(만다린), 광둥어, 영어, 일본어, 한국어.
무료
호환 가능한 다운로드된 비디오 작업에서 사용 가능; 무료 버전은 하루에 10개의 단일 비디오 파싱만 성공 가능하며 프로필 추출은 불가능합니다.
Desktop Pro
무제한 단일 비디오 파싱 및 프로필 추출; 전사 작업은 여전히 장치에서 실행됩니다.
프로필 페이지 처리
전사는 페이지 처리가 없습니다. Pro 프로필 배치에서는 접근 가능한 대기 중 비디오 작업만 전사할 수 있습니다.
출력
호환 가능한 다운로드된 미디어 옆에 UTF-8 TXT 및 타임스탬프 포함 SRT가 작성됩니다.
시스템
Windows 64비트; macOS Apple Silicon 및 Intel. 속도는 로컬 CPU와 미디어 길이에 따라 다릅니다.
실제 워크플로

로컬 전사본 생성 방법

각 단계는 위에 표시된 데스크톱 애플리케이션에서 컨트롤 또는 작업 상태에 매핑됩니다.

  1. 01

    텍스트 & 자막 추출 선택

    호환되는 비디오 다운로드를 시작하기 전에 TXT + SRT를 활성화합니다.

  2. 02

    로컬 모델 활성화

    첫 사용 시, 설정을 확인하고 Settings에서 Enabled 또는 Ready로 표시될 때까지 기다립니다.

  3. 03

    작업 완료 대기

    Desktop이 비디오를 다운로드하고, 오디오를 준비하며, 전사 작업을 순차적으로 처리합니다.

  4. 04

    출력 열기

    다운로드된 미디어 옆에서 일치하는 .txt 및 .srt 파일을 찾습니다.

작업이 중지될 때

일반적인 실패 원인

실패한 작업은 여전히 해당 작업에 첨부되어 있어 동일한 대기열의 완료된 항목은 이용 가능합니다.

음성 모델이 준비되지 않음

설정을 열고 Desktop이 로컬 모델 다운로드 및 로드를 완료할 때까지 기다린 후 다시 시도합니다.

음성이 감지되지 않음

비디오에 들을 수 있는 음성이 포함되어 있는지 확인합니다. 음악만 있는 경우, 무음 또는 매우 시끄러운 오디오는 빈 파일을 생성할 수 있습니다.

오디오 준비 실패

다운로드된 비디오를 계속 사용 가능 상태로 두고 다시 시도합니다. 손상되었거나 지원되지 않는 파일은 FFmpeg가 오디오를 준비하지 못하게 할 수 있습니다.

Windows · macOS

SnapVideoTools 데스크톱 받기

컴퓨터에 맞는 현재 패키지를 선택하세요. 패키지가 제공될 때만 릴리스 카드가 표시됩니다.

무료: 하루에 10개의 단일 비디오 파싱 성공; 프로필 추출은 불가. 데스크톱 프로: 무제한 파싱 및 지원되는 프로필 추출을 위해 $9.90/월 또는 $79.90/년. 요금제 비교.

FAQ

이 워크플로에 대한 질문

비디오가 전사(Transcription)를 위해 업로드되었나요?

아니요. 오디오 준비와 음성 인식은 컴퓨터에서 로컬로 실행됩니다.

어떤 언어가 지원되나요?

현재 설정 화면에는 중국어 표준어(만다린), 광동어, 영어, 일본어, 한국어가 나열되어 있습니다.

정확도가 보장되나요?

아니요. 결과는 언어, 발음 명확성, 배경 소음, 겹침, 원본 녹음에 따라 달라집니다.