Исследование издания

Индекс кириллицы в кадре

Какие модели способны нарисовать читаемую русскую надпись внутри изображения. Методика замера на 1620 кадрах.

Нина Арсеньева· ·Методика опубликована, замер не начат

Коротко

Флагманский замер издания. Десять фиксированных строк в трёх сценариях размещения через все модели каталога — чтобы у вопроса «какой моделью сделать баннер с русским заголовком» появился проверяемый ответ.

Цифр здесь пока нет

Замер запланирован на ноябрь 2026. До его проведения на этой странице опубликована только методика — чтобы её можно было оспорить до появления результатов, а не после.

Это осознанная позиция издания: почему мы не публикуем оценок до измерения.

Что именно измеряем

Рамка исследования «Индекс кириллицы в кадре». Все поля зафиксированы до начала замера.
ВопросКакие модели способны нарисовать читаемую кириллическую надпись внутри изображения и насколько устойчиво
Почему этого нет ни у когоАнглоязычные бенчмарки этой задачи не видят: у латиницы проблемы нет. Русскоязычные обзоры их пересказывают
Кому это нужноЛюбой дизайнер, делающий баннер, обложку или карточку с надписью
Инструмент10 фиксированных строк × 3 сценария размещения × все модели каталога с генерацией изображений
ВыборкаНе менее 18 моделей, 30 запросов на модель, по 3 генерации на запрос — 1620 кадров
Шкала0–5 по читаемости и посимвольному совпадению с заданной строкой
Кто оцениваетТри независимых оценщика, в результат идёт медиана
Периодичностьквартальный

Что будет опубликовано

Замер, результаты которого нельзя перепроверить, — не замер. Вместе с выводами выкладывается всё, на чём они построены:

  • Все исходные кадры, включая провалы
  • Таблица оценок по моделям и сценариям
  • Полные промпты
  • Разброс между оценщиками

Что опровергнет нашу гипотезу

Если медианы всех моделей окажутся в пределах одного балла, гипотеза о неравномерности не подтверждается и индекс теряет смысл

Этот пункт зафиксирован до замера намеренно. Исследование, которое невозможно опровергнуть, ничего не измеряет — оно подтверждает то, что автор решил заранее.

Откуда взялась задача

Если вы делаете обложку, баннер или карточку товара с надписью, вы упираетесь в задачу, которой в англоязычных бенчмарках нет по построению: там текст в кадре считается решённой проблемой.

На кириллице он решён неравномерно. Причина техническая: слово SALE модель видела в обучающих данных тысячи раз, слово РАСПРОДАЖА — на порядки реже. Отсюда типовой сбой западных моделей — путаница «и» и «н» и дорисовка знаков, которых в русском алфавите нет.

Но упрощать до «все ломают» нельзя, и это ключевая поправка: часть моделей справляется. Карты этого неравенства не составил никто, и практический вопрос остаётся без ответа.

Как устроен набор надписей

Десять строк подобраны не случайно — каждая проверяет свой тип отказа:

СтрокаЧто проверяет
Короткое слово, 5 буквбазовая способность
Длинное слово, 11 буквнакопление ошибки по длине
Два словамежсловный интервал
Фраза из трёх словпредел устойчивости
Слово с «и» и «н» рядомтиповая путаница западных моделей
Слово с «ъ» и «ь»знаки без латинских аналогов
Надпись заглавнымипрописные формы проще и частотнее
Надпись строчнымивыносные элементы «б», «д», «у», «ф»
Слово с цифрамисмена типа знаков внутри строки
Кириллица рядом с латиницейпереключение алфавита внутри кадра

Последняя строка важнее, чем кажется. Смешанные надписи вида «SALE — РАСПРОДАЖА» встречаются в работе постоянно, и часть моделей ломается именно на переключении.

Три сценария размещения

Одна и та же строка запрашивается как вывеска на здании, как текст на упаковке и как заголовок на постере. Модель может уверенно справляться с одним размещением и проваливать другое — усреднять их в один балл было бы потерей самого интересного.

Где замер может сломаться

Субъективность оценки читаемости. Лечится тремя независимыми оценщиками и публикацией разброса между ними. Если разброс окажется велик, шкала непригодна, и мы скажем об этом вместо того, чтобы публиковать медиану.

Эффект удачного сида. Лечится тремя генерациями на каждый запрос: единичное попадание не должно давать модели высокий балл.

Устаревание. Модели обновляются, поэтому замер квартальный, а в публикации указаны версии.

Что делать, пока результатов нет

Работают обходные пути, и главный надёжнее любого выбора модели: генерировать кадр с пустым местом под надпись и ставить текст шрифтом. Результат предсказуем полностью, типографика под вашим контролем.

Остальные приёмы — короткие слова, заглавные буквы, начать с моделей, обучавшихся на кириллице, — в материале об обходных путях.

Частые вопросы

Когда будут результаты?
Замер запланирован на ноябрь 2026 года, дальше квартально.
Почему десять строк, а не одна?
Каждая проверяет свой тип отказа: длину, переключение алфавита, регистр, соседство похожих букв. Одна строка измерила бы удачу, а не способность.
Что делать сейчас?
Генерировать кадр с пустым местом под надпись и ставить текст шрифтом. Это надёжнее любого выбора модели.

Нина Арсеньева псевдоним

Псевдоним автора практического раздела. Пишет гиды по задачам с фото и видео и собирает библиотеку промптов: промпт, модель, настройки и полученный кадр — так, чтобы результат можно было повторить.

Отвечает за: промпты, обработка фотографий, задачи с видео