Кратко
Практический набор бесплатных инструментов для случаев, когда запись «не читается», слишком тёмная, размытая или шумная, — и принципиальный отказ от ИИ: не потому, что плохо работает, а потому, что результат невоспроизводим, а воспроизводимость нужна в суде. Видео: подбор кодеков, перекодирование без потерь, метаданные, осветление через работу с цветом, снятие размытия по соседним кадрам, суперразрешение для пиксельного лица, отражения в стекле, синхронизация нескольких съёмок на монтажных дорожках. Звук: сначала честный список того, что вытащить нельзя, затем разбор типов помех по спектрограмме и фильтры в Audacity. Доклад начинается с опроса зала и им же проверяется: бывший фоноскопист прямо говорит, что уровень методов — «шестой-седьмой год», и доносит то, чего не было в докладе.
Главное
- Начало — опрос зала: чем чистят плохое видео и звук. Отвечают: модель-апскейлер и сбор номера автомобиля по соседним кадрам, Amped FIVE и алгоритмы деконволюции для фото, Audition и iZotope по паттерну шума для звука. На вопрос, подшивают ли вывод ИИ в дело, ответ из зала: «Ну конечно, нет».
- Реплика из зала против ИИ в звуке: «очень сильно искажает и абсолютно даже транскрибация это полная лажа».
- Постановка задачи: нужного лицензионного ПО обычно нет под рукой или к нему нет доступа, поэтому «в основном опера заканчивают все исследования, из серии такой… Ну, не видно».
- Рамка доклада: только бесплатное и широкодоступное, «можете их свободно скачать, не взламывая», и только то, что даёт воспроизводимый результат — иначе в криминалистике нельзя. ИИ исключён: «волшебной кнопки нет», приходится самому быть фоторедактором, монтажёром и звуковиком.
- Видео не открывается стандартным плеером (снято регистратором или специфическим устройством): наборы кодеков K-Lite Codec Pack и плеер VLC, который «жрет практически 95% всего медиаконтента».
- Если не воспроизводится — перекодировать в Shutter Encoder: бесплатный, «позволяет перекодировать любое видео в любое видео» без потери качества и показывает метаданные файла.
- MediaInfo — полные метаданные: менялся ли файл по пути от источника, когда и чем сделан. Та же задача «сделать видео читаемым, но без сжатия с потерями, чтобы не уничтожить мелкие детали» — снова Shutter Encoder.
- Проверить, с какого телефона снято видео, предоставленное стороной защиты, — Metadata++: вытаскивает метаданные почти из любого файла и годится как каталогизатор.
- Тёмная ночная запись: крутить яркость и контраст «в 99% случаев… вас ни к чему не приведет». Надо понимать природу кадра: если в пикселях нет данных, вытащить нечего; работать следует с цветами — пересветами и затемнениями. Инструмент — бесплатный DaVinci Resolve.
- Номер автомобиля: основная помеха — размытие и «шевеленка» (тряска камеры, бег, движение машины). Метод — синхронизироваться с картинкой, взять соседние кадры и восстанавливать номер, убирая размытие.
- Инструменты для этого: VideoCleaner — старый, «наверное, лет 7», бесплатный криминалистический продукт, до сих пор годный для простых операций, и тот же DaVinci Resolve. Подробный разбор обещан в статье на юбилейном портале MFD.
- Лицо как пиксельное пятно: при кадре 64×64 ИИ «начинает так фантазировать… они, к сожалению, с реальностью никак не соприкасаются». Вместо него — суперразрешение и интерполяция по соседним пикселям: «не всегда это работает», но может выделить области, полезные для идентификации.
- Блик на стекле: отражение несёт много информации, которую «почему-то коллеги не замечают», и задача здесь обратная — «не улучшить картинку, а, наоборот, ухудшить ее таким способом, чтобы вытащить это самое отражение». Инструменты — GIMP как бесплатный аналог Photoshop и DaVinci Resolve.
- Несколько свидетелей снимали драку с разных точек: сложить все записи на монтажные дорожки DaVinci Resolve, синхронизировать по общему событию (вспышка света, резкий звук) и переключаться между дорожками.
- Звук начинается с границ возможного: полностью перекрытый звук не восстановить, «мы не можем дорисовать отсутствующие слова», ИИ не годится — «каждый раз… мы получим совершенно разные варианты». Можно выровнять громкость, повысить разборчивость и убрать трение микрофона о лацкан — «самый часто встречающийся артефакт».
- Дальше — «исключительно исходя из физики звука». Типы помех: постоянный фон (кондиционер), низкочастотный грохот города и стройки, ветер (по картине совпадает с трением о поверхность), шипение, дождь, городской шум, щелчки и клиппинг, когда аппаратура обрезает перегруженный сигнал.
- Инструмент один — бесплатный Audacity, «для каждой помехи в этом плане свой фильтр».
- Диагностика перед обработкой: постоянный шум или меняющийся, щелчки или шипение, где на спектре сосредоточены помехи, перекрывают ли они сигнал полностью. Для этого включают два типа спектрограммы.
- Монотонный шум: найти участок без полезного сигнала, вырезать образец шума и отдать автоматическому шумодаву — но это работает «в идеальных условиях. Редко такое случается».
- Грохот, вибрации и касания микрофона (энергия в нижней части спектрограммы): эквалайзер и высокочастотный фильтр; с ветром то же самое. Шипение — верхний диапазон, убирается фильтром.
- Городской шум — самый трудный случай: картина постоянно меняется, источники появляются и исчезают, поэтому работают по всему спектру графическим эквалайзером, размечая самые явные помехи. Завершающие шаги — компрессия (выравнивание перепадов громкости) и нормализация.
- Презентация выкладывается в Telegram-канал докладчика сразу после выступления, статья уже доступна на юбилейном портале MFD.
Инструменты, артефакты, технологии
- Видео: K-Lite Codec Pack, VLC Media Player, Shutter Encoder (перекодирование без потерь), MediaInfo и Metadata++ (метаданные), VideoCleaner, DaVinci Resolve (цветокоррекция, монтажные дорожки, синхронизация нескольких съёмок).
- Фото: GIMP; методы — суперразрешение и интерполяция, снятие размытия по соседним кадрам, работа с отражениями через намеренное «ухудшение» кадра.
- Звук: Audacity — спектрограммы двух типов, вырезание образца шума и шумодав, эквалайзер с высоко- и низкочастотными фильтрами, графический эквалайзер, компрессия, нормализация.
- Названо в репликах зала: Amped FIVE, алгоритмы деконволюции (Ричардсона — Люси), «Фотоэксперт», Adobe Audition, iZotope, Юстифон (снятие гармонических составляющих), «Дозор» (источник видеозаписей).
- Типы помех: постоянный фон, низкочастотный грохот, ветер и трение, шипение, дождь, городской шум, щелчки, клиппинг.
Правовой и организационный контекст
Главный правовой мотив доклада — воспроизводимость как условие допустимости: всё показанное выбрано именно потому, что шаги можно повторить и предъявить. На прямой вопрос о позиции адвоката ответ такой: если при обработке применялся ИИ, защита скажет, что «оно придумало», а поскольку описанные действия воспроизводимы, «после выступления эксперта… или специалиста эта запись обычно принимается судом». Отдельно важна реплика из зала, что результат ИИ в дело не подшивают. Организационный фон — нехватка лицензий на местах, из-за которой исследование часто не начинается вовсе.
Вопросы из зала
- 1 (имя не названо): если очищенную запись представили как доказательство, может ли адвокат заявить, что запись изменена, — примет ли её суд? → При использовании ИИ возражение будет обоснованным; при воспроизводимых действиях запись обычно принимается после пояснений эксперта или специалиста.
- 2 (бывший фоноскопист, имя не названо): прямая критика — «то, что вы рассказали, это примерно уровень, может, шестого-седьмого года», и совет набрать методов. Конкретика: шумы с гармонической структурой снимаются легко, не повреждая речь, — этим умеет программа «Юстифон», где есть демонстрация разговора на фоне органа: когда помеха математически выражена, её можно вычесть, не тронув сигнал под ней. По видео — «особо не доверять тому, что видно на первый взгляд», методов названо не всё. Из практики: при реконструкции перестрелки в Wildberries собрали около 45 записей из разных источников (стационарные камеры, видеорегистраторы, «Дозор», мобильные) и вручную складывали потоки в один широкий кадр, чтобы смотреть их одновременно, а не переключаться, — так видно, кто стреляет и у кого пистолет был раньше в кармане. → Ответ: согласен, «2006-2008 год, безусловно», но доклад о другом — «что мы можем использовать, когда под рукой у нас ничего нет» и когда специальных знаний нет, а делать надо.
- 3 (продолжение той же темы): реконструкция событий по множеству источников — «под сотню свидетелей», привязка к карте, высоте, виду и таймингу. → Тизер: команда докладчика готовит такой инструмент для реконструкции по видеоданным с привязкой к местности, «скорее всего, бесплатный».
Позиция спикера
Позиция прагматичная и осознанно приземлённая: доклад не про лучшие методы, а про минимум, доступный любому оперативнику без лицензий и без подготовки. Отказ от ИИ обоснован не качеством, а процессуальной непригодностью невоспроизводимого результата, и это самая сильная мысль выступления. Критику из зала спикер принимает без спора и сразу переформулирует свою задачу. Ограничения проговариваются регулярно («не всегда работает», «в идеальных условиях», «если в пикселях нет данных — ничего не вытащите»), обещаний нет, продукт не продаётся.
Цитаты
- «…в основном опера заканчивают все исследования, из серии такой… Ну, не видно».
- «Делает волшебную кнопку. Но, к сожалению, такой волшебной кнопки нет».
- «…когда у нас изображение 64 на 64 пикселя, в лучшем случае искусственный интеллект начинает так фантазировать… они, к сожалению, с реальностью никак не соприкасаются».
- «…наша главная задача не улучшить картинку, а, наоборот, ухудшить ее таким способом, чтобы вытащить это самое отражение».
- «…то, что вы рассказали, это примерно уровень, может, шестого-седьмого года».