Как устроено опознание лиц на видеозаписях концертов — Digercules

Как устроено опознание лиц на видеозаписях концертов

Если в архиве кроме аудио есть и видео — те же концерты, снятые на камеру, — программа умеет узнавать не только голос исполнителя, но и лица в кадре: и того, кто на сцене, и, если это важно для архива, тех, кто в зале.

Видео не разбирается покадрово: система находит места реальной смены плана — не по таймкоду через равные интервалы, а по факту смены композиции кадра — и предлагает опознание только по представительным кадрам в этих точках. Статичная запись концерта, где камера почти не двигалась два часа, даёт для этого единицы кадров, а не тысячи.

Решение всегда за тем, кто разбирает архив

Система не решает сама, кто в кадре, — она показывает похожесть и эталонный снимок для сравнения, а подтверждает или отклоняет человек. Подтверждённое один раз имя система дальше узнаёт по всему архиву без повторного вопроса. Ни одно решение не переписывается — только дополняется отменой, если потребовалось передумать, поэтому историю разбора всегда можно проследить, даже если он растянулся на месяцы или его продолжает другой человек.

Лицо, которое никто не узнал, не выдаётся за опознанное — оно остаётся отмеченным и ждёт того, кто действительно видел этих людей. Для архива живых выступлений, где часть аудитории и исполнителей может быть известна только старожилам, это не ограничение, а честная работа с тем, что реально можно узнать, а что нет.

Что это даёт на практике

По каждой записи видно: кто на сцене и в какие моменты, кто в зале, если это опознано, и что осталось неопознанным и ждёт подтверждения. Работа, проделанная сегодня, никуда не девается — ни при возврате к архиву через полгода, ни при передаче разбора другому человеку.