Chuyển đến nội dung chính
CHUYỂN GIỌNG NÓI THÀNH VĂN BẢN CỤC BỘ

Phiên âm video cục bộ trên Windows và macOS

Tạo bản ghi TXT và phụ đề SRT từ video đã tải về trên máy tính của bạn. Desktop chuẩn bị âm thanh bằng FFmpeg và chạy mô hình giọng nói mà không cần tải lên phương tiện.

  • Nhận dạng giọng nói cục bộ
  • TXT + SRT có dấu thời gian
  • Không tải lên phương tiện
Cửa sổ Cài đặt giọng nói thành văn bản cục bộ của SnapVideoTools trên máy tính để bàn
Cửa sổ Cài đặt Desktop 1.0.1 thực tế trên macOS hiển thị chuyển giọng nói thành văn bản cục bộ và các ngôn ngữ của nó.
Hỗ trợ & giới hạn

Xử lý việc phiên âm ngoại tuyến như thế nào

Desktop chuẩn bị âm thanh 16 kHz với FFmpeg, phát hiện giọng nói, sau đó nhận diện từng đoạn một với mô hình cục bộ.

Đầu vào được hỗ trợ
Một tác vụ video đã tải về với mục Trích xuất Văn bản & Phụ đề được chọn. Các ngôn ngữ hỗ trợ bao gồm tiếng Quan Thoại, tiếng Quảng Đông, tiếng Anh, tiếng Nhật và tiếng Hàn.
Miễn phí
Có sẵn cho các nhiệm vụ video đã tải xuống tương thích; Bản miễn phí có 10 lần phân tích video đơn thành công mỗi ngày và không trích xuất hồ sơ.
Desktop Pro
Phân tích video đơn và trích xuất hồ sơ không giới hạn; chuyển văn bản vẫn chạy trên thiết bị.
Trang hồ sơ
Chuyển văn bản không có phân trang. Trong một lô hồ sơ Pro, chỉ các nhiệm vụ video đang xếp hàng có thể được chuyển văn bản.
Đầu ra
Cả TXT UTF-8 và SRT có dấu thời gian đều được ghi bên cạnh phương tiện đã tải xuống tương thích.
Hệ thống
Windows 64-bit; macOS Apple Silicon và Intel. Tốc độ phụ thuộc vào CPU cục bộ và độ dài phương tiện.
Quy trình làm việc thực tế

Cách tạo bản chuyển văn bản cục bộ

Mỗi bước ánh xạ đến một điều khiển hoặc trạng thái tác vụ trong ứng dụng Máy tính để bàn được hiển thị ở trên.

  1. 01

    Chọn Trích Xuất Văn Bản & Phụ Đề

    Bật TXT + SRT trước khi bắt đầu tải video tương thích xuống.

  2. 02

    Bật mô hình cục bộ

    Lần đầu sử dụng, xác nhận cài đặt và chờ cho đến khi Cài đặt báo Bật hoặc Sẵn sàng.

  3. 03

    Để nhiệm vụ hoàn thành

    Desktop tải video xuống, chuẩn bị âm thanh và xử lý chuyển văn bản tuần tự.

  4. 04

    Mở các đầu ra

    Tìm các tệp .txt và .srt tương ứng bên cạnh phương tiện đã tải xuống.

Khi một tác vụ dừng lại

Những lý do thất bại phổ biến

Các thất bại vẫn gắn với tác vụ của chúng, vì vậy các mục đã hoàn thành trong cùng hàng đợi vẫn có thể dùng được.

Mô hình giọng nói chưa sẵn sàng

Mở Cài đặt và để Desktop hoàn tất tải xuống và nạp mô hình cục bộ trước khi thử lại.

Không phát hiện giọng nói

Xác nhận video có giọng nói nghe được. Chỉ nhạc, im lặng hoặc âm thanh quá ồn có thể tạo ra tệp rỗng.

Chuẩn bị âm thanh thất bại

Giữ video đã tải xuống sẵn có và thử lại. Một tệp bị hỏng hoặc không được hỗ trợ có thể ngăn FFmpeg chuẩn bị âm thanh.

Windows · macOS

Nhận SnapVideoTools cho Máy tính để bàn

Chọn gói hiện tại cho máy tính của bạn. Thẻ phát hành chỉ xuất hiện khi gói đó có sẵn.

Miễn phí: 10 phân tích video đơn thành công mỗi ngày; không trích xuất hồ sơ. Desktop Pro: $9.90/tháng hoặc $79.90/năm cho phân tích không giới hạn và trích xuất hồ sơ được hỗ trợ. So sánh các gói.

FAQ

Câu hỏi về quy trình làm việc này

Video đã được tải lên để chuyển giọng nói thành văn bản chưa?

Chưa. Chuẩn bị âm thanh và nhận dạng giọng nói chạy cục bộ trên máy tính.

Ngôn ngữ nào được hỗ trợ?

Màn hình Cài đặt hiện tại liệt kê tiếng Quan Thoại, Quảng Đông, Tiếng Anh, Tiếng Nhật và Tiếng Hàn.

Độ chính xác có được đảm bảo không?

Không. Kết quả phụ thuộc vào ngôn ngữ, độ rõ ràng của giọng nói, tiếng ồn nền, sự chồng chéo và bản ghi nguồn.