Исследование издания
Насколько люди отличают сгенерированное от снятого
Открытый тест на 20 пар изображений и датасет распознавания, которого для русскоязычной аудитории не существует.
Коротко
Единственный замер списка, который проводят сами читатели. Тест устроен так, что даёт им результат о себе, а изданию — датасет, которого нет ни у кого.
Цифр здесь пока нет
Замер запланирован на декабрь 2026. До его проведения на этой странице опубликована только методика — чтобы её можно было оспорить до появления результатов, а не после.
Это осознанная позиция издания: почему мы не публикуем оценок до измерения.
Что именно измеряем
| Вопрос | В какой доле случаев читатель отличает сгенерированное изображение от снятого и какие сюжеты распознаются хуже всего |
|---|---|
| Почему этого нет ни у кого | Данных о распознавании русскоязычной аудиторией не существует |
| Кому это нужно | Журналисты, преподаватели, все, кто пишет о доверии к изображениям |
| Инструмент | Открытый тест из 20 пар изображений, встроенный в сайт |
| Выборка | Непрерывный сбор; первая публикация не ранее 5000 прохождений |
| Шкала | Доля верных ответов по категориям: портрет, интерьер, еда, пейзаж, предметка, руки, текст, толпа |
| Кто оценивает | Не требуется: правильный ответ известен по построению |
| Периодичность | непрерывный сбор, ежемесячная публикация |
| Что собирается о читателе | Собираются только категория, верность ответа и время реакции. Ни адреса, ни профиля, ни геолокации |
Что будет опубликовано
Замер, результаты которого нельзя перепроверить, — не замер. Вместе с выводами выкладывается всё, на чём они построены:
- Доля верных ответов по категориям
- Число прохождений и период сбора
- Изменение результата от выпуска к выпуску
- ⛔ Никаких разрезов по географии: тест их не собирает
Что опровергнет нашу гипотезу
Если доля верных ответов окажется около 50%, это означает угадывание, и тест не измеряет распознавание
Этот пункт зафиксирован до замера намеренно. Исследование, которое невозможно опровергнуть, ничего не измеряет — оно подтверждает то, что автор решил заранее.
Что это и зачем
Двадцать пар изображений: в каждой одно снятое и одно сгенерированное на тот же сюжет. Читатель выбирает, где генерация, и получает свой результат с разбором каждой пары.
Изданию это даёт то, чего не существует: данные о том, как русскоязычная аудитория распознаёт сгенерированные изображения и какие сюжеты обманывают чаще.
Замер идёт непрерывно и публикуется ежемесячно.
Почему это устроено как тест, а не как опрос
Опрос измеряет мнение о своей способности. Тест измеряет способность.
Разница здесь принципиальная: большинство людей уверено, что отличает генерацию, и это убеждение само по себе интересный факт — но не тот, который мы измеряем.
Разбивка по категориям
Восемь сюжетов, по которым публикуется отдельная доля верных ответов:
портрет, интерьер, еда, пейзаж, предметная съёмка, руки, текст в кадре, толпа.
Общая цифра скучна и малополезна. Интересно другое: какие сюжеты распознаются хуже всего. Предположение — интерьеры и еда, где у зрителя нет опорной точки для сверки. Проверим.
Что собирается о читателе
Категория, верность ответа, время реакции. Всё.
Ни адреса, ни профиля, ни идентификатора. Ни геолокации — она была бы соблазнительна для разрезов, но мы её сознательно не собираем.
Тест не требует регистрации и не показывает результат в обмен на почту. Гейт перед результатом убил бы половину прохождений и испортил бы выборку.
Что опровергнет замысел
Если доля верных ответов окажется около половины — это означает угадывание, и тест ничего не измеряет. Тогда придётся переделывать набор пар: вероятно, они окажутся слишком сложными или пары подобраны неудачно.
Условие зафиксировано до запуска.
Почему первая публикация не раньше пяти тысяч прохождений
На малой выборке разброс по категориям будет больше самих различий. Публиковать раньше — значит выдать шум за результат.
Мы предпочитаем сказать «данных пока мало», чем опубликовать красивые цифры, которые развалятся на следующей тысяче.
Что будет с результатом
Число вида «читатели отличают сгенерированное изображение в N% случаев; хуже всего распознаются интерьеры, лучше всего — кадры с руками» — с указанием числа прохождений и периода сбора.
Это ровно тот тип факта, который цитируют: конкретный, проверяемый и не существующий больше нигде.
Частые вопросы
- Что собирается о проходящем тест?
- Категория, верность ответа и время реакции. Ни адреса, ни профиля, ни геолокации — последнюю мы не собираем сознательно.
- Нужна ли регистрация?
- Нет. Гейт перед результатом убил бы половину прохождений и испортил выборку.
- Когда будут первые данные?
- Не раньше пяти тысяч прохождений: на малой выборке разброс по категориям превысит сами различия.