Пост почти готов: тема есть, мысль сложилась, осталось написать текст и приложить картинку. Вы открываете поиск и ищете нейросеть, которая делает и текст, и картинку, – сервис с одной кнопкой: ввел тему, получил готовую публикацию с иллюстрацией. Так ищут сотни людей в месяц, и почти всем нужна именно кнопка.
Честный ответ: в чистом виде такой кнопки нет, и это меньшая проблема, чем кажется. Текст и изображение генерируют разные модели, а сервисы, которые берутся за оба дела сразу, обычно делают оба на троечку. Зато связка из двух специализированных нейросетей собирает пост, карточку товара или обложку статьи минут за пятнадцать – и результат заметно лучше.
В этой статье – какие сервисы взять под текст и под картинку, чтобы все работало из России и бесплатно, как из готового текста получить промт для изображения и что сделать, чтобы картинка не разошлась с текстом по смыслу.
Почему «текст и картинка» – это две разные нейросети
Внутри у них мало общего. Языковая модель предсказывает следующее слово и собирает из слов связный текст. Модель для изображений устроена иначе: она шаг за шагом превращает случайный шум в пиксели, приближая пятно к тому, что описано в промте. Два разных класса технологий, обученных на разных данных.
Даже когда оба умения живут в одном окне, под капотом работают две системы. В GigaChat текст пишет языковая модель Сбера, а рисует Кандинский – отдельная нейросеть, которой чат просто пересылает запрос. Кнопка одна, моделей две.
Отсюда практический вывод. Сервис, который силен в русском тексте, редко так же силен в картинках, и наоборот. Если вам нужен результат для работы, а не эксперимент на вечер, выгоднее собрать связку: лучшая доступная текстовая модель плюс бесплатный генератор изображений. Дальше разберем обе половины.
Что взять под текст
НейроПеро – сервис генерации текста на моделях Claude: посты, карточки товаров, статьи и письма на русском, без VPN и зарубежных карт. Сразу оговорка, чтобы не было ложных ожиданий: картинки НейроПеро не рисует. Зато он закрывает ту часть связки, где решается судьба публикации, – пишет текст и по запросу превращает его в готовый промт для генератора изображений. На тарифе «Проба пера» дается 10 000 символов бесплатно, разово, – хватит на десяток постов вместе с промтами под картинки.
GigaChat и Алиса – бесплатные, тоже работают из России напрямую. Для коротких простых текстов подходят, на длинных и продающих начинают штамповать одинаковые обороты. Подробный разбор бесплатных вариантов – в обзоре «7 бесплатных нейросетей для текста на русском».
Где бесплатно генерировать картинки
Шедеврум от Яндекса работает на собственной модели YandexART. Бесплатный, понимает промты на русском, доступен через сайт и мобильное приложение. Есть платная подписка с дополнительными возможностями. Если картинка пойдет в рекламу или магазин, условия коммерческого использования проверьте в самом сервисе перед публикацией.
Кандинский от Сбера живет внутри GigaChat: пишете «нарисуй...» прямо в чате, вход по Сбер ID, генерации бесплатные. Русский промт понимает, стили держит от фотореализма до иллюстрации. В часы наплыва бывают очереди – обычная плата за бесплатность.
Зарубежные генераторы вроде Midjourney и DALL-E внутри ChatGPT рисуют отлично, но из России к ним три барьера подряд: VPN, зарубежный номер для регистрации, а у платных еще и подписка, которую российской картой не оплатить. Для поста в соцсети и карточки товара бесплатных российских хватает с запасом, так что тратить вечер на обходные пути смысла мало.
Важно. Лимиты и условия бесплатных генераторов меняются без предупреждения: сегодня генерации без ограничений, завтра очередь и суточный потолок. Перед рабочей задачей со сроком проверьте условия на месте, а не по чужой статье – включая эту.
Рабочий процесс: сначала текст, потом картинка
Порядок принципиален. Текст несет смысл, картинка его иллюстрирует. Если начать с картинки, придется натягивать текст на случайное изображение, и по смыслу разъедутся оба.
Шаг 1. Напишите текст и доведите его до готовности. Именно до готовности: правки в тексте после того, как картинка уже сгенерирована, – главный источник рассинхрона. Поменяли акцент в тексте – промт для картинки устарел, а перегенерировать ее почти никто не возвращается.
Шаг 2. Попросите ту же нейросеть составить промт для картинки. По готовому тексту, а не по теме. Готовый промт для этого шага – в следующем разделе.
Шаг 3. Сгенерируйте три-четыре варианта. Первый результат почти никогда не лучший. Меняйте не весь промт, а одну деталь за раз – ракурс, свет, фон, – иначе не поймете, что именно сработало.
Шаг 4. Надписи добавьте в обычном редакторе. Просить генератор нарисовать текст на картинке не стоит: с буквами, особенно с кириллицей, модели справляются плохо – слова плывут и превращаются в узор. Заголовок поверх картинки за минуту ставится в любом бесплатном редакторе.
Промт, который превращает текст в задание для картинки
Самое слабое звено связки – переход от текста к изображению. Если написать промт для картинки по памяти, туда попадет тема, но не настроение и не акценты. Поэтому промт должен собираться из готового текста, и делать это лучше поручить самой текстовой нейросети.
Прочитай текст ниже и составь по нему промт для нейросети, которая генерирует изображения. В промте укажи: – главный объект или сцену (только одну, без перечислений) – обстановку и фон – стиль: [фотография / иллюстрация / 3D / акварель] – свет и настроение – теми же словами, какими они заданы в тексте – что рисовать нельзя: текст, надписи, логотипы, лишних людей Формат: один абзац до 400 знаков, без вступлений. Текст: [вставьте готовый текст]
Этот запрос работает в любой текстовой нейросети. Если генератор картинок зарубежный, добавьте строку «переведи промт на английский»: Шедеврум и Кандинский спокойно понимают русский, а Midjourney на английском слушается точнее. Про то, как вообще устроен хороший запрос к нейросети, есть отдельный гайд – «Как составить промт для нейросети», принципы там те же.
Текстовая половина связки – за пару минут
НейроПеро напишет пост, карточку или статью на моделях Claude и сразу составит промт для картинки. 10 000 символов бесплатно на пробу.
Создать текст бесплатно →Как не разойтись по смыслу
Классическая беда связки выглядит так: текст про уютную семейную кофейню, а картинка – глянцевый интерьер с неоном, как из каталога барной мебели. Формально все по промту. По ощущению – чужая публикация. Четыре правила, которые это лечат.
Один объект на картинку. Генераторы плохо держат композицию из многих сущностей: попросите «бариста, латте, круассан, интерьер и вывеска» – получите кашу, где у бариста три руки. Выберите то, вокруг чего построен текст, и рисуйте только это.
Настроение – словами из текста. Если в тексте «тихое утро» и «мягкий свет», ровно эти слова должны стоять в промте для картинки. Настроение теряется первым, когда промт пишут по памяти, – и именно оно склеивает текст с изображением.
Запреты работают не хуже пожеланий. Строка «без текста и надписей, без логотипов, без толпы людей» убирает половину брака еще до генерации. Генератор охотно добавляет лишнее, если его не остановить.
Для серии – один стиль, зафиксированный дословно. Когда картинок несколько (карусель в соцсети, набор слайдов), скопируйте описание стиля в каждый промт без изменений, вплоть до запятых. Пересказ «в похожем стиле» своими словами каждый раз дает разнобой, который виден в ленте сразу.
Три связки под частые задачи
Пост для соцсети. Разберем на сквозном примере: кофейня анонсирует осенний напиток. Сначала текст – промт с темой, аудиторией и тоном (готовые шаблоны под десяток задач собраны в подборке «100 промтов для текстов»):
Напиши пост для телеграм-канала кофейни. Тема: новый осенний напиток – раф с соленой карамелью. Аудитория: постоянные гости, тон теплый, без восклицаний и рекламных штампов. Объем – до 600 знаков. Финал – приглашение зайти на этой неделе.
Готовый пост прогоняете через промт из раздела выше, и текстовая нейросеть возвращает задание для генератора – примерно такое:
Фотография: керамическая чашка рафа с карамельным узором на деревянном столе у окна кофейни, за окном осенняя улица, мягкий теплый свет, тихое уютное настроение. Без текста и надписей, без логотипов, без людей.
Обратите внимание: «теплый», «тихое», «уютное» пришли из текста поста, а не придуманы заново – в этом и смысл шага. Дальше три-четыре генерации, выбор варианта, и публикация собрана. На весь цикл уходит минут десять.
Карточка товара. Описание для маркетплейса пишет текстовая нейросеть – как именно, разобрано в гайде про карточки товара для WB и Ozon. С картинкой здесь осторожнее: покупатель ждет настоящие фото товара, и сгенерированное изображение годится для фона или инфографики, а не вместо предметной съемки. Нарисованный нейросетью «товар» в карточке подрывает доверие быстрее, чем слабый текст.
Обложка статьи или презентации. Здесь связка раскрывается лучше всего. Попросите текстовую нейросеть выделить главную метафору материала и построить промт вокруг нее. Обложка по метафоре выглядит осмысленной, а не случайной – в отличие от абстрактного градиента, который ставят, когда думать некогда.
Какие пропорции просить у генератора
Формат картинки задается до генерации, а не после. Растянутое или обрезанное на четверть изображение выглядит хуже, чем сгенерированное сразу в нужной пропорции, – композиция строится под кадр целиком.
Лента соцсетей. Квадрат 1:1 – универсальный вариант, вертикальный 4:5 занимает больше места на экране телефона. Для сторис и вертикальных видеообложек – 9:16.
Карточка маркетплейса. Вертикальный формат, обычно 3:4. Точные требования к размерам в пикселях у каждой площадки свои и периодически меняются – сверяйтесь с правилами в кабинете продавца, а не со статьями.
Обложка статьи, письма или презентации. Горизонтальная, чаще всего 16:9 – под слайд и превью ссылки.
Пропорцию можно выставить настройкой в самом генераторе, а если такой настройки нет – указать словами в промте: «вертикальное изображение 4:5». Когда сервис умеет только квадрат, генерируйте с запасом по краям и кадрируйте в редакторе. А вот переделывать готовую горизонтальную картинку в вертикальную не стоит: проще перегенерировать с той же формулировкой и новой пропорцией.
Частые вопросы
Есть ли одна нейросеть, которая делает и текст, и картинки?
Да, GigaChat пишет тексты и рисует Кандинским в одном окне, для простых задач этого хватает. Но текст там получается средним, поэтому для рабочих публикаций выгоднее связка: сильная текстовая модель плюс отдельный генератор изображений.
Какие нейросети для создания картинок и текста работают бесплатно?
Текст: НейроПеро (10 000 символов разово на пробном тарифе), GigaChat, Алиса. Картинки: Шедеврум и Кандинский. Все перечисленные работают из России без VPN.
НейроПеро рисует картинки?
Нет. НейроПеро генерирует только текст на моделях Claude. Зато он составит промт для генератора изображений по вашему тексту – это тот шаг связки, где чаще всего теряется смысл.
Можно ли писать промт для картинки на русском?
В Шедевруме и Кандинском – да, они обучены на русских запросах. Зарубежные генераторы точнее слушаются английского: попросите текстовую нейросеть перевести промт, это одна лишняя строка в запросе.
Почему картинка получается не про то, о чем текст?
Почти всегда потому, что промт для картинки писали отдельно от текста, по памяти. Составляйте его из готового текста: один главный объект, настроение словами из текста и явные запреты. Расхождения пропадают.
Итог
Кнопки «сделай текст и картинку сразу» можно не ждать: рабочая связка из двух бесплатных сервисов уже есть. Текстовая нейросеть пишет публикацию и промт для изображения, генератор картинок рисует по этому промту, надписи ставятся в редакторе. Весь процесс укладывается в пятнадцать минут после пары тренировок.
Самое ценное звено в этой паре – текст. Картинку читатель разглядывает секунду и листает дальше, а решение – читать, купить, подписаться – принимает по словам. Поэтому начинать стоит с текстовой половины, а картинку подгонять под нее, и никогда наоборот.
10 000 символов бесплатно на пробу
НейроПеро пишет тексты на моделях Claude и превращает их в промты для картинок. Регистрация за минуту по email.
Получить бесплатные символы →