Задачи с фотографией
Обложка для видео нейросетью
Обложка решает, откроют ли ролик. Что в ней работает и почему текст лучше набирать шрифтом.
Коротко
Обложку смотрят полсекунды на маленьком экране. Отсюда всё: крупный объект, высокий контраст, два-три цвета и текст, набранный шрифтом, а не сгенерированный.

Условия, в которых работает обложка
Размер с ноготь. Полсекунды внимания. Соседство десятка конкурентов в ленте.
Из этого следуют требования, противоположные обычной композиции: не тонкость, а читаемость на предельно малом размере.
Что работает
Один крупный объект. Не сцена, а предмет или лицо, занимающее половину кадра.
Высокий контраст. Обложка конкурирует с соседями по ленте, и выигрывает та, что заметнее.
Два-три цвета. Ограниченная палитра читается на маленьком размере, пёстрая превращается в шум.
Пустое место под текст. Заранее, а не поиск на готовом кадре.
Что не работает
Мелкие детали. Сложные сцены. Тонкие градации. Всё, что требует разглядывания.
Про текст
Заголовок на обложке нужен почти всегда, и генерировать его не стоит: кириллица разваливается у большинства моделей, а типографика в обложке значит не меньше картинки.
Правильный порядок: сгенерировать кадр с пустой областью, набрать текст шрифтом, проверить читаемость в уменьшенном виде.
Проверка, единственная нужная
Уменьшите готовую обложку до размера ногтя и посмотрите с расстояния вытянутой руки.
Если читается объект и заголовок — работает. Если нет, дело не в качестве кадра, а в композиции и контрасте, и добавление деталей не поможет.
Каркас промпта
[объект] крупно, занимает половину кадра, [ракурс],
высокий контраст, палитра из двух цветов,
однотонная область справа под заголовок, без текста,
[свет с явным направлением]
Строка «без текста» обязательна: без неё модель дорисует надпись, и её придётся закрывать.
Обложка почти всегда часть более крупной задачи; что берут под визуал для лент, собрано отдельно.
Симптом, причина, решение
| Что видите | Почему так | Что делать |
|---|---|---|
| Сгенерированная надпись похожа на текст, но не читается | Модель воспроизводит форму букв по частотности, а кириллицу видела реже латиницы | Оставить в кадре пустое место и набрать заголовок шрифтом |
| В редакторе обложка хорошая, в ленте мутная | Ленту смотрят с мелкого размера, и мелкие детали при уменьшении сливаются в шум | Оценивать результат уменьшенным, а не на весь экран |
| Нижний угол обложки перекрыт | Поверх картинки ложится плашка с длительностью ролика | Держать нижнюю полосу кадра служебной, ключевой объект — выше |
| Заголовок обрезан по краю | Обложка показывается в разных пропорциях: в ленте одни, на странице ролика другие | Собирать текст внутри поля с отступом от всех четырёх краёв |
| Обложка теряется среди соседей | Соседи по ленте контрастнее, а обложка оценивалась в одиночку | Смотреть не на обложку, а на ленту с ней: она конкурирует не сама с собой |
| На тёмной теме обложка выглядит иначе | Интерфейс подкладывает под картинку разный фон, и края с ним сливаются | Проверять в обеих темах, край кадра держать контрастным к обеим |
Безопасные зоны
Обложка никогда не показывается целиком и в одиночку. Поверх неё ложится интерфейс, и ложится он в предсказуемые места: длительность ролика в нижнем углу, полоса просмотра вдоль нижнего края, значок канала и служебные метки поверх картинки в ленте.
Отсюда правило: нижняя полоса кадра — служебная. Всё, что должно быть прочитано, живёт выше неё.
Второе ограничение — кадрирование. Одна и та же обложка показывается в ленте, в поиске, в блоке рекомендаций и на странице ролика, и пропорции у этих мест разные. Значит, композиция строится с запасом по краям: объект и заголовок внутри поля, по краям — только фон, который не жалко потерять.
Тот же размерный класс — аватар: его тоже опознают, а не разглядывают, и требования к нему выведены из того же ограничения.
Развилка по формату
Горизонтальный ролик. Обложка соревнуется с соседями по сетке. Выигрывает контраст, а не сложность: один объект, крупно, с явным светом.
Вертикальный формат. Обложкой часто работает кадр из самого ролика, и он же становится плиткой в сетке профиля. Значит, кадр планируется как обложка заранее — с пустым местом под подписи, которые лягут поверх, и с объектом, читаемым в плитке. Про то, как собирается вертикальное видео, разобрано отдельно.
Серия роликов. Здесь работает не отдельная обложка, а узнаваемость ряда: одна палитра, одно положение заголовка, один тип кадра. Ряд читается как канал, разнобой — как случайные ролики.
Вторая проверка: обесцвечивание
Уменьшение ловит композицию. Оно не ловит контраст — на маленьком размере глаз достраивает разницу, которой в кадре нет.
Переведите обложку в оттенки серого. Если объект и фон слились в одно пятно, вы держались на разнице цветов, а не на разнице яркостей. В ленте, где рядом чужие цвета, эта разница пропадёт первой.
Чего обложка не делает
Она отвечает за открытие и больше ни за что. Если обложка обещает не то, что в ролике, вы получаете открытие и уход с первых секунд — то есть потратили чужое внимание и своё место в ленте.
Отсюда практическая граница: обложку делают из того, что в ролике есть. Кадр, которого в материале нет, придётся либо снимать, либо отказываться от обещания.
Обложку меняют, ролик нет
Там, где обложка загружается отдельным файлом, она правится без перезалива — единственная часть опубликованного ролика, которую можно переделать. Слабую обложку меняют, а не смиряются с ней. Оговорка одна: у ролика, который уже разошёлся, смена обложки обнуляет узнавание — ровно как смена аватара.
Частые вопросы
- Почему текст на обложке лучше набирать шрифтом?
- Кириллица в генерации разваливается у большинства моделей, а типографика в обложке значит не меньше картинки. Плюс текст можно поменять без перегенерации.
- Как проверить обложку?
- Уменьшить до размера ногтя и посмотреть с расстояния вытянутой руки. Читается объект и заголовок — работает.
- Что писать в промпте обязательно?
- «Без текста» — иначе модель дорисует надпись, и её придётся закрывать.