Методика EvidPic
Как EvidPic проверяет изображения
EvidPic проверяет само изображение и данные внутри файла. Нейросети ищут признаки генерации, а метаданные могут подсказать, какой камерой или программой пользовались. Ниже объясняем, как читать результаты этих проверок и где возможны ошибки.
Обновлено
01 / Что внутри проверки
Что проверяем
Мы анализируем изображение несколькими способами. Одни ищут признаки в пикселях, другие читают данные о создании и обработке файла.
Как нейросети анализируют изображение
Для анализа мы используем несколько нейросетевых моделей — детекторов, которые ищут признаки генерации в изображении. Их оценки показаны в отчёте. Если одна модель дала высокий балл, а другая низкий, однозначного вывода по ним сделать нельзя.
Несколько моделей могут ошибиться на одном и том же изображении. Поэтому важно смотреть и на другие результаты проверки.
Метаданные и отметки генераторов
Метаданные — это сведения, сохранённые внутри файла: например, модель камеры или название редактора. Часть таких записей хранится в формате EXIF. Мы также ищем отметки, которые оставляют программы для генерации изображений.
Эти записи можно изменить или удалить. Например, название редактора в EXIF — подсказка о возможной обработке, но не подтверждение того, что именно делали с изображением.
C2PA и водяные знаки
C2PA — стандарт для записи истории создания и обработки файла. Такие записи называют Content Credentials. Они могут содержать цифровую подпись. При проверке важно отдельно выяснить, есть ли запись, прошла ли проверку подпись и можно ли доверять тому, кто подписал данные.
Цифровая подпись помогает проверить, не изменились ли подписанные данные и связаны ли они с этим файлом. При этом сама сцена на фото может быть постановочной: подпись этого не проверяет. Подробнее о C2PA.
Некоторые генераторы добавляют в изображение невидимые метки — водяные знаки. SynthID — одна из таких технологий. Наша модель может обнаружить признаки водяного знака. Этот результат нужно отличать от ответа официального сервиса проверки. Если доступна отдельная проверка SynthID/C2PA через OpenAI, изображение отправляется туда только после нажатия кнопки этой проверки.
02 / Читаем отчёт
Как читать отчёт
Открыть пример отчёта — посмотрите, где находятся итог, основания вывода и подробные результаты проверок.
- Посмотрите, на чём основан вывод. Модель нашла признаки генерации? В файле есть название редактора? Найдены данные с цифровой подписью? Это разные результаты.
- Посмотрите, какие проверки выполнены. «Не найдено» означает, что проверка прошла, но не нашла нужных признаков. Статусы «Проверка недоступна» и «данных недостаточно» означают, что по этой проверке нельзя сделать вывод.
- Прочитайте пояснения. Посмотрите, согласны ли модели друг с другом и есть ли предупреждения о формате, сжатии или другой обработке файла.
Балл — не процент вероятности
Балл показывает, насколько сильные признаки использования ИИ нашёл сервис. Например, 80 из 100 не означает, что изображение создано нейросетью с вероятностью 80%. Чтобы понять оценку, посмотрите, какие результаты на неё повлияли.
03 / На практике
Что означают результаты
Разберём три условных примера. Они показывают, как читать отчёт, а не насколько точен детектор.
Модель дала высокий балл, метаданных нет
Модель нашла признаки генерации в самом изображении. Но данных о том, как создали файл, нет. Они могли исчезнуть при пересылке — стоит запросить оригинал и проверить его.
В метаданных указан редактор
Название программы не объясняет, что в ней делали. Изображение могли обрезать, изменить цвета или обработать с помощью ИИ. По одной записи выбрать между этими вариантами нельзя.
Проверка не нашла признаков ИИ
Выполненные проверки не нашли признаков ИИ. Это ещё не значит, что перед вами фотография с камеры или что изображение никто не редактировал.
04 / Ограничения
Где возможны ошибки
- Скриншоты и пересылка. Скриншот не сохраняет исходные метаданные. При пересылке сервисы также могут удалить их или сжать изображение.
- Сжатие, обрезка и изменение размера. После такой обработки модели могут оценить изображение иначе, чем оригинал.
- Новые генераторы и необычные изображения. Детекторы могут пропустить незнакомые признаки генерации или ошибочно принять особенности обычного изображения за следы ИИ.
- Изменение отдельного участка. Общая оценка может не отражать небольшую правку. Если в отчёте есть экспериментальная карта подозрительных областей, она показывает, куда стоит присмотреться. Подсветка не доказывает, что этот участок изменили.
- Недоступная проверка. Не каждый метод подходит для любого файла. Отдельная модель или внешний сервис также могут быть недоступны — это отмечается в отчёте.
Мы не указываем один процент точности для всех изображений. Чтобы такое число имело смысл, нужно объяснить, на каких файлах, какими версиями моделей и в каких условиях его получили.
05 / Следующий шаг
Если от результата зависит решение
Сохраните исходный файл. Попробуйте найти первую публикацию: когда и где появилось изображение, кто его разместил и что о нём написал. Если у вас только скриншот или пересланная копия, запросите оригинал.
Отчёт поможет разобраться в файле. Установить, кто создал изображение и произошло ли показанное событие на самом деле, по нему одному нельзя.
Перейти к проверкеЧто происходит с файлом
Для проверки изображение загружается на сервер. Исходный файл хранится до 30 минут, чтобы вы могли выполнить дополнительные действия с ним.
Условия обработки данных