Почему Speech_Recognition от Google не выдает никаких результатов?
Пытаюсь перевести в текст речь из видеозаписи. Использовал следующий туториал (https://towardsdatascience.com/extracting-speech-from-video-using-python-f0ec7e312d38). Однако, гугл мне упорно выдает пустую строку, не распознавая ни одного слова из 3 минутного видео. Код следующий:
import speech_recognition as sr
import moviepy.editor as mp
clip = mp.VideoFileClip("1111.mp4")
clip.audio.write_audiofile("converted.wav")
r = sr.Recognizer()
audio = sr.AudioFile("converted.wav")
with audio as source:
audio_file = r.record(source)
result = r.recognize_google(audio_file, language="ru-RU", show_all=True)
print(result)
В чем может быть проблема? Видел на гитхабе похожие посты, но там советуют только указать True для show_all, что помогает далеко не всем. Сформированную аудиозапись converted.wav проверял, звук там есть и он отчетливо слышен.
Update: попробовал записать свое видео, и результат распознавания весьма хороший. В таком случае возникает вопрос, что может так пагубно влиять на файл, что у него не распознается ни единого слова? Возможно, будет от скорости потока аудио что-то зависеть? Потому, что на нераспознаваемой видеозаписи она 159 кбит/сек, а на записанной мной - 116 кбит/сек.