Сто гигабайт видеозаписей — в аудио для расшифровки
Пакетная конвертация видео в MP3 одним двойным кликом. Наши 100 ГБ записей интервью превратились в 16 ГБ аудио за 15 минут работы. Готовые файлы можно скачать здесь.
Какую задачу решает
Превратить папку видеозаписей в аудиофайлы, пригодные для расшифровки, не конвертируя каждый ролик руками
Задача
Записей накопилось много: совещания, интервью, вебинары, съёмки сессий. Их надо расшифровать, а сервисы распознавания речи принимают аудио, а не видео — и берут файлы куда меньшего размера, чем исходный ролик.
Конвертировать каждый файл руками — часы механической работы. Онлайн-конвертеры отпадают сразу: во-первых, объём, во-вторых, на них нельзя выкладывать служебные записи.
Наш собственный случай: 200 с лишним записей глубинных интервью для диссертационного исследования — 100 ГБ видео. После обработки получилось 16 ГБ аудио, около пятнадцати минут активной работы вместо двух-трёх дней. Коэффициент сжатия зависит от исходников: чем выше было качество видео, тем сильнее упадёт размер.
Решение работает только под Windows. Это BAT-файл — сценарий командной строки Windows. Под macOS и Linux нужен аналогичный скрипт на shell; в этом рецепте его нет.
Шаг 1. Поставить FFmpeg
FFmpeg — свободный конвертер медиафайлов, вся тяжёлая работа делается им.
Нажмите Win + X, выберите «Терминал (Администратор)» и введите команду:
winget install ffmpeg
Дождитесь окончания установки и закройте окно терминала.
Проверено в июле 2026 года: команда находит пакет Gyan.FFmpeg версии 8.1.2 —
это официальная сборка FFmpeg под Windows. Права администратора нужны только на
этом шаге.
Шаг 2. Скачать сценарий
Три варианта под разные задачи. Отличаются они одной строкой — параметрами качества звука.
| Файл | Битрейт | Частота | Когда брать |
|---|---|---|---|
| Минимум, 64 кбит/с | 64 кбит/с | 16 кГц, моно | только под расшифровку речи, самые лёгкие файлы |
| Оптимально, 96 кбит/с | 96 кбит/с | 22 кГц, моно | расшифровка плюс возможность послушать самому |
| Максимум, 192 кбит/с | 192 кбит/с | как в оригинале, стерео | запись пойдёт в подкаст или в архив |
Для распознавания речи берите первый: 16 кГц моно — стандартный вход почти всех систем распознавания, и файл получается вчетверо меньше.
Файлы лежат на нашем сервере, а не на файлообменнике: ссылка не протухнет.
Шаг 3. Запустить
- Положите скачанный BAT-файл в папку с видеозаписями.
- Двойной клик.
- В окне видно, какой файл обрабатывается и сколько уже готово.
Сценарий сам подхватывает все видео в папке: WEBM, MP4, AVI, MKV, MOV, FLV, WMV, M4V, MPG, MPEG. Вложенные папки он не обходит — если записи разложены по подпапкам, запускайте в каждой.
Шаг 4. Забрать результат
- Папка output рядом с видео — готовые MP3 с теми же именами.
- Файл log.txt — отчёт по каждой записи: обработана или нет. Если какой-то ролик не поддался, в логе будет причина.
- Исходные видео остаются нетронутыми. Сценарий ничего не удаляет.
Что именно внутри файла
Мы выкладываем сценарий как есть и считаем правильным сказать, что он делает. Откройте его блокнотом — там двадцать строк. Содержательная часть одна:
ffmpeg -i "%%f" -vn -acodec libmp3lame -b:a 64k -ar 16000 -ac 1 "output\%%~nf.mp3" -y
Здесь -vn выбрасывает видеодорожку, -b:a задаёт битрейт, -ar — частоту
дискретизации, -ac 1 сводит звук в моно. Всё остальное в файле — счётчик
обработанных записей и запись лога. Сценарий не обращается в сеть, не трогает
реестр и не удаляет ничего, кроме собственного лога от прошлого запуска.
Хотите другое качество — поменяйте цифры в этой строке и сохраните файл.
Где ещё применимо
- Совещания и планёрки — видеозапись встречи весит десятки гигабайт, аудио той же встречи умещается в сотню мегабайт.
- Архив мероприятий — многолетние записи занимают место на дисках, а нужен из них обычно только звук.
- Подготовка к анализу — цепочка «видео — аудио — текст — разбор» начинается именно с этого шага, и без пакетной обработки дальше идти бессмысленно.
