Двадцать минут говорящей головы на таймлайне выглядят так: между фразами висят паузы в секунду-полторы, в начале мысли — «ээ» и «ну короче». Резать это руками долго, и на выходе речь звучит рвано. Показываю по шагам, как убрать паузы из видео автоматически, вырезать слова-паразиты и запикать мат — с показом каждого выреза до сборки, без веры в одну кнопку.
Коротко
- Тот же ролик без длинных пауз и «ээ», мат запикан, SRT пересчитан по новым таймингам
- Не одна кнопка, а список правок перед сборкой — виден каждый вырез и каждая заглушка
- Три переключателя независимы: паузы, паразиты, мат — включаешь что нужно
- Распознавание находит не всё, поэтому финальный просмотр готового ролика обязателен
Что я получу на выходе?
На выходе — тот же ролик, но без длинных зависаний между фразами, без заминок «ээ/эм» и с запиканным матом. Плюс SRT, пересчитанный под новые тайминги: субтитры не разъезжаются после того, как из дорожки вырезали куски. Картинка и смысл остаются твоими — меняется только лишнее.
Работает это в два шага, а не одной кнопкой. Сначала разбор раскладывает ролик на пословный таймлайн с паузами, паразитами и матом. Потом ты проходишь по списку: снимаешь галочки там, где пауза смысловая, отмечаешь кликом слова под заглушку, видишь итог «уйдёт N секунд» — и только после этого собираешь ролик. Три переключателя — паузы, паразиты, мат — работают независимо, так что можно убрать только тишину и не трогать остальное.
Какие паузы резать, а какие оставить?
Не всякая пауза лишняя. Пауза перед выводом или после вопроса держит ритм и работает на удержание — её оставляй. Убирать стоит технические зависания: человек собрался с мыслями, замешкался, вдохнул между фразами. Детектор их находит, но решение «резать или нет» остаётся за тобой — именно поэтому список правок показывают до сборки, а не вырезают молча.
Порог тишины считается не фиксированным числом, а от громкости самого ролика: детектор берёт за точку отсчёта средний уровень звука и ищет то, что заметно тише речи. Конкретные значения по умолчанию видно в настройках инструмента — их стоит открыть перед сборкой. С каждой стороны выреза остаётся небольшой запас, чтобы не срезать дыхание и начало слова, иначе на стыке получится резкий «клац» в первой букве следующей фразы.
- Оставляй: паузу перед ключевой мыслью, после вопроса к зрителю, на смене темы — это ритм
- Режь: зависания между фразами, долгое молчание в начале и в конце ролика
- Подстрой порог под свой темп: быстрая речь терпит более короткие паузы, медленная — нет
Почему паузы ищут по звуку, а не по промежуткам между словами?
Казалось бы, проще: распознали речь, нашли дырки между словами, вырезали. На практике это режет речь. Распознавание может не записать тихий кусок речи или сдвинуть тайминг — и промежуток в тексте окажется длиннее реального. Резать по таким промежуткам значит вырезать слова, поэтому паузы ищут по акустической тишине, а не по дыркам между словами.
Детектор смотрит на реальную громкость, а не на то, что успела записать нейросеть. А из найденного отрезка тишины вычитаются распознанные слова: тихое слово детектор может принять за тишину, но текст подскажет, что там речь. Так вырезается именно молчание, а не недослышанная фраза.
Проверить это просто. Возьми 30 секунд записи, загрузи в инструмент и открой список найденных пауз. Если в списке есть место, где ты говорил, а не молчал, — речь там тише обычного: сдвинь порог тишины вверх и проверь список снова. Детектор по звуку такое место не трогает.
Как убрать «ээ» и слова-паразиты и не получить рваный ролик?
Заминки и словесные паразиты разводятся по разным правилам. Звуки-заминки — «ээ», «эмм», «ммм» — режутся всегда, когда включён переключатель: смысла они не несут. Словесные паразиты — «ну», «как бы», «короче», «типа», «в общем», «значит» — убираются только галочкой, потому что бывают смысловыми. «Ну и что?» — здесь «ну» часть фразы, а не мусор.
Чтобы ролик не стал рваным, вырез паразита проходит строго между соседними словами, а на каждом стыке звук склеивается с коротким перекрытием. Шва не слышно: переход идёт не встык, а внахлёст. По той же причине удаление десятка «ээ» подряд не превращает речь в пулемётную очередь — стыки сглажены.
- Заминки «ээ/эм/ммм» — режутся автоматически при включённом переключателе
- Словесные паразиты — по галочке, список редактируемый; спорные оставляй
- Каждый вырез — между словами, стык сглажен коротким перекрытием
Как запикать мат — писком или тишиной?
Заглушка ставится по маске: ты видишь слово в списке правок и выбираешь, чем его закрыть — звуком или тишиной. В субтитрах слово тоже остаётся закрытым, так что SRT уходит чистым. Варианты заглушки видно прямо в интерфейсе инструмента, когда помечаешь слово.
Есть нюанс распознавания: короткого ругательства, которого нет в распознанном тексте, автоматика не найдёт — для машины его просто не существует. Поэтому список правок показывают до сборки: спорное место ты слушаешь в плеере и помечаешь слово под заглушку вручную.
Как это сделать самому по шагам?
Возьми ролик со вступлением на 40 секунд, где человек дважды сбивается. После правок вступление сжимается, но фраза не начинается с середины слова — вырез идёт между словами, а не по кадру. Дальше шаги по интерфейсу — способ получить ровно это.
- 1
Дай ролик
Открой инструмент «Тишина и мат» и загрузи ролик — файлом, из медиатеки или по ссылке. Включи нужные переключатели: паузы, паразиты, мат.
- 2
Дождись разбора
Распознавание разложит ролик на пословный таймлайн: отмеченные паузы, заминки, словесные паразиты и слова с флагом мата. Это платный шаг — работает распознавание речи.
- 3
Пройди по списку правок
Сними галочки там, где пауза смысловая или паразит на самом деле часть фразы. Отметь кликом слова под заглушку, выбери, чем закрыть. Итог «уйдёт N секунд» пересчитывается на каждом движении ползунка порога.
- 4
Собери ролик и SRT
Запусти сборку. На выходе — ролик без лишних пауз и заминок, мат запикан, SRT пересчитан по новым таймингам. Перед публикацией проверь стыки на слух. Пересобрать с другими решениями можно без нового разбора.
Список правок до сборки — твоя страховка от молча вырезанного слова, которое в готовом ролике уже не вернуть.
Сколько это стоит и от чего зависит время сборки?
Инструмент «Тишина и мат» платится минутами исходника из тарифа, сверх лимита — с баланса. Минуты зависят от тарифа: у «Старта» их 60, у «Автора» — 480, у «Про» — 1500. Деньги списываются по факту длины разбора; упавший или отменённый разбор возвращает минуты. Платный шаг — именно разбор, то есть распознавание речи. Сборка бесплатна и повторяема: пересобрать с другими галочками можно сколько угодно раз.
По времени сборка зависит от того, есть ли вырезы. Если правишь только мат и ничего не режешь, картинка копируется из исходника без перекодирования — собирается фактически только звук, это быстро. Как только появляются вырезы пауз и паразитов, картинка пересобирается кусками, и ролик в высоком разрешении идёт дольше, чем в низком.
| Что делаешь | Что происходит с картинкой |
|---|---|
| Только запикал мат, без вырезов | Копируется из исходника без перекодирования — собирается в основном звук |
| Режешь паузы и паразиты | Пересобирается кусками по оставленным отрезкам — дольше |
| Высокое разрешение против низкого | Больше данных на каждый кусок, поэтому сборка дольше |
Где автоматика меня подведёт?
Заминок «ээ» автоматика находит мало — и это не баг, а природа распознавания. Модель пишет текст по смыслу, а не дословно, поэтому проглоченное «ээ» в тексте часто не появляется вовсе. В интерфейсе инструмента это сказано прямо: заминки находятся не все. Часть длинных «ээ» уходит не как паразиты, а как тишина — если они тихие, их режет детектор молчания. Но рассчитывать, что инструмент выловит каждую заминку по тексту, не стоит.
Пропущенное слово не запикать: его нет в тексте — значит, нет и в списке. Детектор тишины не отличит драматическую паузу от зависания, это твоё решение. А длинные интервью в высоком разрешении собираются дольше. Поэтому финальный шаг один для всех случаев — просмотреть готовый ролик целиком.
Как проверить на своём ролике перед публикацией?
Перед публикацией открой список правок и прослушай спорные паузы в плеере — так видно, что именно уйдёт, до того как это станет необратимым. Порог тишины подстрой под свой темп речи: быстрая речь терпит более короткие паузы, медленная — нет.
- Смысловые паузы на месте — перед выводами и после вопросов ничего не схлопнулось
- Мат закрыт — прошёл ушами по вероятным местам, пропущенное пометил вручную
- SRT совпадает — субтитры не разъехались после вырезов
- Ролик просмотрен целиком — финальный просмотр, а не только список правок
Что делать, если пауза нужна, а детектор её режет?
Сними галочку с этой паузы в списке правок до сборки — она останется в ролике. Детектор только предлагает вырезы, финальное решение за тобой.
Вернутся ли деньги, если разбор упал?
Да. Минуты списываются по факту длины разбора, а упавший или отменённый разбор возвращает их обратно.
Можно ли собрать ролик ещё раз с другими галочками?
Да, сборка повторяема и бесплатна: меняешь решения и пересобираешь без нового разбора.
Нужно ли переплачивать за SRT?
Нет. SRT пересчитывается под новые тайминги на выходе сборки, отдельной платы за него нет.
Тишина и мат
Собери чистый ролик без часа в монтажке
Тишина, «ээ» и мат уходят по списку правок, а SRT пересчитывается под новые тайминги.
Попробовать «Тишину и мат»

