# Нейросеть для обложек: как собрать картинку, на которую нажимают

_Владимир Ижмуков · автор системы роста Instagram через короткие ролики_

Обложка решает, откроют ваш материал или пролистают. У ролика на неё есть доля секунды, у статьи в ленте чуть больше. При этом обложка это единственная часть контента, которую машина сегодня делает почти целиком, и делает хорошо, если правильно поставить задачу.

Мы собираем обложки каждый день: под ролики, под карусели, под статьи блога. Ниже то, что осталось после сотен генераций и десятков забракованных кадров.

Проверено 6 сентября 2026 года: приёмы из статьи проверены на своей серии обложек в день публикации.

## Сначала формат, потом красота

Половина брака рождается до первого запроса, потому что человек не решил, где картинка будет жить.

| Где живёт обложка | Пропорции | Что важнее всего |
|---|---|---|
| Обложка ролика в ленте | 4:5 вертикальная | крупный объект, читаемость с ладони |
| Превью видео на YouTube | 16:9 горизонтальная | лицо и три-четыре слова текста |
| Обложка статьи в блоге | 16:9 или 3:2 | смысл темы без мелких деталей |
| Обложка подборки в сохранённом | квадрат | центр кадра, поля не обрезаются |

Дальше правило, которое экономит больше всего перегенераций: **композицию просите под самый узкий формат из тех, где картинка появится.** Кадр, собранный под 16:9, при обрезке до вертикали теряет края вместе с половиной смысла.

## Структура запроса: пять частей

Запрос под обложку я собираю всегда одинаково, меняется только наполнение:

1. **Объект и сцена.** `рабочий стол сверху, ноутбук, блокнот, чашка кофе`.
2. **Композиция.** `объект в верхних двух третях кадра, нижняя часть пустой фон`.
3. **Стиль и свет.** `документальная фотография, мягкий боковой свет, зерно плёнки, без глянца`.
4. **Запреты.** `без текста, без логотипов, без лишних предметов`.
5. **Формат.** `вертикальный кадр 4:5`.

Пункт про запрет текста нужен даже тогда, когда надпись вам нужна. Текст надёжнее положить сверху в редакторе: он встанет ровно, нужным шрифтом и без опечаток.

## Надпись прямо на картинке: правила, которых нет в инструкциях

Иногда надпись нужна именно внутри изображения, иначе она не ложится в стиль. Тогда действуют отдельные правила, и мы их вывели дорогой ценой.

- **Просите воспроизвести текст посимвольно** и отдельно запрещайте перевод и пересказ. Кириллицу модели рисуют хуже латиницы, и без такой строки они начинают «улучшать» слова.
- **Числа пишите словами.** Модель при абсолютно верном запросе заменяет слово цифрой. У нас на слайде вместо слов «вечер» и «год» встали «7» и «1».
- **Запретите кавычки.** Модель добавляет свою кавычку в начало фразы, которой в запросе не было.
- **Необычное написание объявляйте намеренным.** Двоеточие внутри слова машина считает опечаткой и меняет на точку, поэтому про него пишется отдельная строка.
- **Проверяйте текст глазами на каждом кадре.** Ни одна машинная проверка этого брака не видит: файл целый, размер верный, всё формально в порядке, а слово на картинке другое.

## Безопасные поля: кадр обрежут, и это нормально

Одна и та же обложка живёт в нескольких местах, и каждое место режет её по-своему.

Мы решаем это так: **в запрос идёт строка про пустой низ.** Дословно смысл такой: нижние двадцать процентов кадра остаются чистым фоном, весь смысл и весь текст живут в верхних восьмидесяти. Дальше картинка приводится к нужным пропорциям обрезкой снизу.

Почему именно обрезка. Поле в тон подложки видно в ленте как замытый край, и такую картинку сразу читаешь как самодельную. Мы пробовали три способа добора полей, включая заливку по краю и зеркальное отражение, и забраковали все: край выдаёт себя при любом способе.

Отдельная проверка перед выкладкой: посмотреть на полосу, которая уйдёт под обрез. Если в ней оказался текст или часть объекта, кадр отправляется на перегенерацию.

## Серия обложек: они обязаны различаться

Отдельная обложка может быть отличной, а серия из пяти таких провалится. В ленте они встают рядом и читаются одной публикацией.

Что мы делаем, чтобы этого не было:

- **Разводим типы кадра.** Крупный план человека, предметный или макро, общий план с пространством. Три предметных кадра подряд это брак, даже когда предметы разные.
- **Разводим тональность.** Тёмная, светлая, цветная. Если все пять тёмные, серия сливается.
- **Смотрим их вместе.** Готовые обложки складываются в один лист и оцениваются рядом. По одной штуке это не видно. Похожесть видна только в сравнении.

## Лицо на обложке: три референса и разные ракурсы

Обложка с человеком работает сильнее предметной почти всегда, но у неё своя ловушка.

- Референсов нужно минимум три, и все настоящие. По одной фотографии машина рисует просто похожего человека.
- Сгенерированное лицо обратно в референсы не подаётся никогда: через два круга внешность уплывает окончательно.
- Неизменное держите в одной части запроса: возраст, телосложение, борода, сдержанная улыбка, поры кожи, зерно. Ракурс, крупность, поза и одежда пишутся отдельно для каждого кадра.
- Если общая часть одна на всю серию, вы получите один и тот же портрет во всех кадрах при разных описаниях локаций. Мы ловили это на серии из десяти изображений.

## Что делает обложку кликабельной

Здесь всё измеряется, поэтому говорю прямо о том, что показывает практика:

1. **Один смысловой объект.** Глаз в ленте цепляется за одну вещь, две конкурируют и проигрывают обе.
2. **Крупно.** Мелкие детали в ленте не читаются с телефона вовсе, проверяйте картинку на экране размером с ладонь.
3. **Контраст между объектом и фоном.** Серое на сером не читается даже при отличной композиции.
4. **Три-четыре слова текста, если он есть.** Заголовок целиком в обложку не помещается, его дочитают в подписи.
5. **Отсутствие пустых третей.** Пустота в кадре читается как незаконченность.

## Частые вопросы

### Какая нейросеть лучше рисует обложки?

Для фотографических обложек подходят большие генераторы изображений, включая российские Шедеврум и Кандинский. Разница между ними меньше, чем разница между хорошим и плохим запросом: один и тот же сервис даёт и отличный, и пустой кадр.

### Как сделать обложку с текстом на русском?

Надёжнее нарисовать фон генератором, а надпись положить сверху в редакторе. Если текст нужен внутри картинки, требуйте посимвольного воспроизведения, числа словами и прямо запрещайте кавычки.

### Какой размер обложки нужен для ролика?

Вертикальный кадр в пропорции 4:5 закрывает ленту, для полноэкранного просмотра берут 9:16. Собирайте композицию под самый узкий формат и обрезайте под остальные.

### Почему мои обложки похожи одна на другую?

Скорее всего, у вас один шаблон запроса на всю серию. Разводите тип кадра и тональность специально: крупный план, предмет, общий план, и разная яркость.

### Можно ли использовать машинную обложку в коммерческих целях?

Условия зависят от сервиса и его лицензии, читайте их до публикации. Отдельно проверяйте, что в кадр не попали узнаваемые чужие лица, логотипы и товарные знаки.

### Сколько времени занимает одна обложка?

При готовом шаблоне запроса от одной до трёх минут вместе с перегенерациями. Первый раз уйдёт час, потому что вы будете собирать сам шаблон.

## Забери шаблон запроса

Сделайте себе один запрос-заготовку из пяти частей: объект, композиция, стиль и свет, запреты, формат. Дальше меняете первую часть, остальное остаётся неизменным. Это и есть то, что превращает случайные удачные картинки в серию, где каждая обложка выглядит вашей.

Обложка приводит человека внутрь, а дальше работает то, что вы ему говорите и куда ведёте. Полный порядок работы с короткими роликами лежит на странице [набора для роста через Reels](https://vladimir-izhmukov.ru/reels-chatgpt/), а разборы по кодовому слову я отдаю в [боте](https://t.me/izhmukov777_bot).

Дальше по теме: [как сделать вирусный Reels](/guides/kak-sdelat-virusnyy-reels/), [нейросеть для генерации изображений](/guides/neyroset-dlya-generacii-izobrazheniy/), [нейросеть для фото](/guides/neyroset-dlya-foto/) и [сценарий для рилса](/guides/scenariy-dlya-rilsa/).
