Локальный Whisper распознаёт речь; для запуска нужны Python и FFmpeg. Инструкции проекта и список моделей — в официальном репозитории.
В приложенном GUIDE.md — отдельные шаги для Windows и macOS, создание окружения и проверка установки.
Установи пакет в активированном окружении:
python -m pip install -U openai-whisper
Перейди в папку с роликом. Эта команда целиком занимает одну строку:
whisper video.mp4 --model small --language Russian --output_format srt
Для пути с пробелами используй кавычки. При первом запуске потребуется скачать модель. Вариант small здесь выбран как стартовый для русской речи, а не как самый точный для любой записи.
Формат SRT содержит пронумерованные фрагменты текста с временем начала и конца. Мини-пример лежит в example.srt. Параметры вывода доступны в исходном коде CLI.
После импорта в редактор проверь имена, цифры, паузы и таймкоды. У Whisper бывают ошибки и выдуманные фразы, особенно на сложном аудио; это описано в model card.
Промпт для обработки папки:
«Напиши локальный скрипт для запуска установленного Whisper над видео в выбранной папке. Сохраняй SRT в отдельную папку и не меняй оригиналы. Обрабатывай файлы последовательно. Поддержи пробелы в путях, пропуск готовых результатов и журнал ошибок. Проверяй существование непустого SRT после каждого запуска. Покажи команду запуска для моей ОС. Сначала обработай один короткий файл».
Сначала проверь качество на небольшом фрагменте своей записи — так проще выбрать модель.
Whisper: установка и запуск
Ниже локальная установка официального openai-whisper. Ориентир для окружения — Python 3.11, входящий в диапазон совместимости, указанный в README проекта. Первому запуску нужен интернет для скачивания модели; распознавание затем выполняется на твоём компьютере.
Windows
- Установи Python 3.11 и pip с python.org. Проверь в новом терминале:
py -3.11 --version.
- Установи FFmpeg. Если уже есть Chocolatey, выполни
choco install ffmpeg. Другой путь: возьми сборку по ссылкам со страницы FFmpeg, распакуй её и добавь каталог bin в пользовательский PATH.
- Открой новый терминал и проверь:
ffmpeg -version.
- В папке для работы выполни команды. Активация окружения не требуется — указан полный путь к программе внутри него.
py -3.11 -m venv .venv
.venv\Scripts\python.exe -m pip install -U openai-whisper
.venv\Scripts\whisper.exe "video.mp4" --model small --language Russian --output_format srt --output_dir subtitles
В командах выше обратные слеши обозначают обычные разделители пути Windows. После распаковки используй команды из файла command_windows.txt, где они записаны готовыми для вставки.
macOS
- Установи Python 3.11 с python.org, если его ещё нет.
- При установленном Homebrew запусти
brew install ffmpeg, затем ffmpeg -version.
- В рабочей папке выполни:
python3.11 -m venv .venv
.venv/bin/python -m pip install -U openai-whisper
.venv/bin/whisper "video.mp4" --model small --language Russian --output_format srt --output_dir subtitles
Заменяй video.mp4 на свой путь. Папка subtitles появится автоматически. Скорость зависит от модели, процессора или видеокарты и длины записи. Если нет ускорителя, распознавание может занять заметное время.
После запуска
Проверь, что subtitles/video.srt появился и не пустой. Импортируй его в редактор с поддержкой SRT. Оформление и переносы строк подбирай в редакторе, затем сверь распознанную речь с оригиналом.
example.srt — вручную написанный учебный пример формата, не результат обработки реального видео. PROMPT.txt — задание для создания скрипта обработки папки.
Параметры вывода: Whisper CLI. Ограничения распознавания: model card.
Файлы к ролику
Скачать все файлы этого гайда.