Mô hình giọng nói chưa sẵn sàng
Mở Cài đặt và để Desktop hoàn tất tải xuống và nạp mô hình cục bộ trước khi thử lại.
Tạo bản ghi TXT và phụ đề SRT từ video đã tải về trên máy tính của bạn. Desktop chuẩn bị âm thanh bằng FFmpeg và chạy mô hình giọng nói mà không cần tải lên phương tiện.
Desktop chuẩn bị âm thanh 16 kHz với FFmpeg, phát hiện giọng nói, sau đó nhận diện từng đoạn một với mô hình cục bộ.
Mỗi bước ánh xạ đến một điều khiển hoặc trạng thái tác vụ trong ứng dụng Máy tính để bàn được hiển thị ở trên.
Bật TXT + SRT trước khi bắt đầu tải video tương thích xuống.
Lần đầu sử dụng, xác nhận cài đặt và chờ cho đến khi Cài đặt báo Bật hoặc Sẵn sàng.
Desktop tải video xuống, chuẩn bị âm thanh và xử lý chuyển văn bản tuần tự.
Tìm các tệp .txt và .srt tương ứng bên cạnh phương tiện đã tải xuống.
Các thất bại vẫn gắn với tác vụ của chúng, vì vậy các mục đã hoàn thành trong cùng hàng đợi vẫn có thể dùng được.
Mở Cài đặt và để Desktop hoàn tất tải xuống và nạp mô hình cục bộ trước khi thử lại.
Xác nhận video có giọng nói nghe được. Chỉ nhạc, im lặng hoặc âm thanh quá ồn có thể tạo ra tệp rỗng.
Giữ video đã tải xuống sẵn có và thử lại. Một tệp bị hỏng hoặc không được hỗ trợ có thể ngăn FFmpeg chuẩn bị âm thanh.
Chọn gói hiện tại cho máy tính của bạn. Thẻ phát hành chỉ xuất hiện khi gói đó có sẵn.
Miễn phí: 10 phân tích video đơn thành công mỗi ngày; không trích xuất hồ sơ. Desktop Pro: $9.90/tháng hoặc $79.90/năm cho phân tích không giới hạn và trích xuất hồ sơ được hỗ trợ. So sánh các gói.
Chưa. Chuẩn bị âm thanh và nhận dạng giọng nói chạy cục bộ trên máy tính.
Màn hình Cài đặt hiện tại liệt kê tiếng Quan Thoại, Quảng Đông, Tiếng Anh, Tiếng Nhật và Tiếng Hàn.
Không. Kết quả phụ thuộc vào ngôn ngữ, độ rõ ràng của giọng nói, tiếng ồn nền, sự chồng chéo và bản ghi nguồn.