Исследование издания
Индекс кириллицы в кадре
Какие модели способны нарисовать читаемую русскую надпись внутри изображения. Методика замера на 1620 кадрах.
Коротко
Флагманский замер издания. Десять фиксированных строк в трёх сценариях размещения через все модели каталога — чтобы у вопроса «какой моделью сделать баннер с русским заголовком» появился проверяемый ответ.
Цифр здесь пока нет
Замер запланирован на ноябрь 2026. До его проведения на этой странице опубликована только методика — чтобы её можно было оспорить до появления результатов, а не после.
Это осознанная позиция издания: почему мы не публикуем оценок до измерения.
Что именно измеряем
| Вопрос | Какие модели способны нарисовать читаемую кириллическую надпись внутри изображения и насколько устойчиво |
|---|---|
| Почему этого нет ни у кого | Англоязычные бенчмарки этой задачи не видят: у латиницы проблемы нет. Русскоязычные обзоры их пересказывают |
| Кому это нужно | Любой дизайнер, делающий баннер, обложку или карточку с надписью |
| Инструмент | 10 фиксированных строк × 3 сценария размещения × все модели каталога с генерацией изображений |
| Выборка | Не менее 18 моделей, 30 запросов на модель, по 3 генерации на запрос — 1620 кадров |
| Шкала | 0–5 по читаемости и посимвольному совпадению с заданной строкой |
| Кто оценивает | Три независимых оценщика, в результат идёт медиана |
| Периодичность | квартальный |
Что будет опубликовано
Замер, результаты которого нельзя перепроверить, — не замер. Вместе с выводами выкладывается всё, на чём они построены:
- Все исходные кадры, включая провалы
- Таблица оценок по моделям и сценариям
- Полные промпты
- Разброс между оценщиками
Что опровергнет нашу гипотезу
Если медианы всех моделей окажутся в пределах одного балла, гипотеза о неравномерности не подтверждается и индекс теряет смысл
Этот пункт зафиксирован до замера намеренно. Исследование, которое невозможно опровергнуть, ничего не измеряет — оно подтверждает то, что автор решил заранее.
Откуда взялась задача
Если вы делаете обложку, баннер или карточку товара с надписью, вы упираетесь в задачу, которой в англоязычных бенчмарках нет по построению: там текст в кадре считается решённой проблемой.
На кириллице он решён неравномерно. Причина техническая: слово SALE модель видела в обучающих данных тысячи раз, слово РАСПРОДАЖА — на порядки реже. Отсюда типовой сбой западных моделей — путаница «и» и «н» и дорисовка знаков, которых в русском алфавите нет.
Но упрощать до «все ломают» нельзя, и это ключевая поправка: часть моделей справляется. Карты этого неравенства не составил никто, и практический вопрос остаётся без ответа.
Как устроен набор надписей
Десять строк подобраны не случайно — каждая проверяет свой тип отказа:
| Строка | Что проверяет |
|---|---|
| Короткое слово, 5 букв | базовая способность |
| Длинное слово, 11 букв | накопление ошибки по длине |
| Два слова | межсловный интервал |
| Фраза из трёх слов | предел устойчивости |
| Слово с «и» и «н» рядом | типовая путаница западных моделей |
| Слово с «ъ» и «ь» | знаки без латинских аналогов |
| Надпись заглавными | прописные формы проще и частотнее |
| Надпись строчными | выносные элементы «б», «д», «у», «ф» |
| Слово с цифрами | смена типа знаков внутри строки |
| Кириллица рядом с латиницей | переключение алфавита внутри кадра |
Последняя строка важнее, чем кажется. Смешанные надписи вида «SALE — РАСПРОДАЖА» встречаются в работе постоянно, и часть моделей ломается именно на переключении.
Три сценария размещения
Одна и та же строка запрашивается как вывеска на здании, как текст на упаковке и как заголовок на постере. Модель может уверенно справляться с одним размещением и проваливать другое — усреднять их в один балл было бы потерей самого интересного.
Где замер может сломаться
Субъективность оценки читаемости. Лечится тремя независимыми оценщиками и публикацией разброса между ними. Если разброс окажется велик, шкала непригодна, и мы скажем об этом вместо того, чтобы публиковать медиану.
Эффект удачного сида. Лечится тремя генерациями на каждый запрос: единичное попадание не должно давать модели высокий балл.
Устаревание. Модели обновляются, поэтому замер квартальный, а в публикации указаны версии.
Что делать, пока результатов нет
Работают обходные пути, и главный надёжнее любого выбора модели: генерировать кадр с пустым местом под надпись и ставить текст шрифтом. Результат предсказуем полностью, типографика под вашим контролем.
Остальные приёмы — короткие слова, заглавные буквы, начать с моделей, обучавшихся на кириллице, — в материале об обходных путях.
Частые вопросы
- Когда будут результаты?
- Замер запланирован на ноябрь 2026 года, дальше квартально.
- Почему десять строк, а не одна?
- Каждая проверяет свой тип отказа: длину, переключение алфавита, регистр, соседство похожих букв. Одна строка измерила бы удачу, а не способность.
- Что делать сейчас?
- Генерировать кадр с пустым местом под надпись и ставить текст шрифтом. Это надёжнее любого выбора модели.