Картинки · надпись в кадре

Текст на картинке нейросетью: 4 способа без кривых букв

Картинка отличная, а надпись из несуществующих букв. Разберём, почему так выходит, и четыре способа получить читаемый текст, включая самый надёжный.

Кирилл СандаковКирилл СандаковВайбкодер, предприниматель, продюсерОпубликовано 13.09.202612 мин чтения

Нейросеть коверкает надписи, потому что рисует буквы как часть картинки, а не набирает их шрифтом: для модели текст это узор, который надо повторить похоже. С кириллицей выходит хуже, чем с латиницей, а длинная фраза ломается почти всегда. Рабочих способов получить читаемый текст четыре: взять модель, обученную рендерить надписи, правильно построить запрос, наложить текст поверх готовой картинки или заменить надпись по маске. Самый надёжный из них третий.

Ниже разбираем каждый способ, таблицу «симптом, причина, действие», арифметику перебора генераций по ценам OpenAI и вопрос прав на картинки, о котором вспоминают уже после того, как поставили баннер в рекламу. Всё проверено 13 сентября 2026 года.

Что узнаешь из гайда

  • Почему буквы превращаются в химеры
  • Как построить запрос, чтобы надпись вышла
  • Способ, который работает в ста случаях из ста
  • Что делать с уже готовой картинкой
  • Кому принадлежит картинка с бесплатного плана

Часть 1 · Причина

Почему буквы плывут

Главное

Модель не знает, что такое буква. Она воспроизводит форму, и на месте слова у неё появляется то, что похоже на слово.

Генератор изображений строит картинку целиком: небо, лицо, вывеска на здании. Для него надпись ничем не отличается от кирпичной кладки, это такая же текстура. Когда узор простой и знакомый, получается похоже. Когда узор сложный, модель дорисовывает по смыслу формы, а не по смыслу языка, и появляются буквы, которых нет ни в одном алфавите.

У кириллицы к этому добавляется вторая проблема: в обучающих наборах русских надписей заметно меньше, чем английских. Отсюда практическое наблюдение, знакомое всем, кто делает обложки: одно короткое слово латиницей выходит с первого раза, а русский слоган приходится перегенерировать десять раз и всё равно править.

Связь с выдуманными фактами

Это тот же механизм, что и у текстовых моделей, которые уверенно сочиняют несуществующие цитаты. Сеть продолжает правдоподобный паттерн и не умеет остановиться и сказать «не знаю». Подробно про механизм написано в гайде про галлюцинации нейросетей.


Часть 2 · Определитель

Таблица: симптом, причина, действие

Что видно на картинке, почему так и что делать
СимптомПричинаДействие
Буквы похожи на русские, но их нет в алфавитедлинная надпись, мало данных на кириллицесократить до одного-двух слов
Слово написано с ошибкоймодель рисует форму, не проверяет смыслнакладывать текст поверх
Текст мелкий и размазанныйне задан размер и место надписипопросить крупно и по центру
Надпись сливается с фономпёстрый фон под текстомоднотонная плашка под надписью
Появился лишний текст, которого не просилиописание похоже на вывеску или обложкупрямо написать: без текста в кадре
Правильно только на английскомразница в обучающих данныхоставить латиницу или наложить поверх

Способ 1 · Модель

Взять модель, которую учили писать

Часть генераторов специально дорабатывали под надписи, и разница видна: короткая строка выходит читаемой с первой-второй попытки. Это работает как повышение шансов, но не как гарантия, и чем длиннее текст, тем меньше разница между «умеющей» моделью и обычной.

Практический критерий выбора: сделайте три теста одним и тем же запросом с одной короткой русской надписью. Если из трёх картинок две читаемые, моделью можно пользоваться для черновиков. Если одна, берите сразу третий способ. Общее сравнение генераторов по качеству картинки лежит в гайде нейросеть для генерации картинок.


Способ 2 · Запрос

Построить запрос так, чтобы надпись вышла

Большинство провалов происходит не из-за модели, а из-за формулировки: текст надписи растворён в описании сцены, и модель не понимает, что это именно буквы. Вот рабочая схема.

запрос с надписью
Сцена: <что в кадре, фон, свет, стиль>.
Надпись: "СКИДКА"
Где: крупно по центру, на однотонной плашке.
Шрифт: плотный гротеск, высокий контраст с фоном.
Больше никакого текста в кадре быть не должно.
  • Текст в кавычках отдельной строкой. Так модель отличает надпись от описания сцены.
  • Одно-два слова. Каждое следующее слово увеличивает шанс химеры примерно вдвое.
  • Место и размер обязательны. Без них надпись окажется мелкой и в углу.
  • Запрет на лишний текст. Иначе модель добавит вывески, подписи и водяные знаки от себя.

Способ 3 · Надёжный

Наложить текст поверх: способ, который не подводит

Главное

Генерируем картинку без текста, а надпись ставим сверху в редакторе или кодом. Ошибок ноль, шрифт ваш, правки за секунды.

Так делают все, кто выпускает визуал сериями: обложки роликов, баннеры, карточки товара, посты. Причина не в том, что генератор плохой, а в том, что правки неизбежны. Поменялась цена, поменялся заголовок, и в сгенерированной картинке это означает новую генерацию с новой лотереей, а в наложенном тексте одну строчку.

  1. Сгенерируйте фон с явным указанием «без текста» и с местом под надпись: пустая стена, небо, однотонная область.
  2. Поставьте текст в редакторе. Подойдёт любой, где есть шрифты с кириллицей.
  3. Или соберите кодом, если картинок много: тогда надпись подставляется из таблицы, а макет один на всю серию.
  4. Проверьте контраст. Белый текст на светлом фоне читается только у вас на большом мониторе.

Для обложек видео и превью у нас есть отдельный разбор скилов в гайде скилы для обложек и превью, а для инфографики маркетплейсов в гайде про карточки товаров.


Способ 4 · Замена

Заменить надпись на готовой картинке

Отдельный сценарий: картинка уже есть, надпись на ней не та. Здесь помогает редактирование по маске: вы указываете область с текстом и просите заменить содержимое. Модель видит фон, перспективу и стиль букв, поэтому результат обычно аккуратнее, чем генерация с нуля.

Где это ломается

На мелком кегле, на сложной текстуре и на отражениях. Проверяйте результат в стопроцентном масштабе, а не в превью: артефакты обычно видно именно при увеличении, и именно их замечают в комментариях.

И не путайте эту задачу с переводом текста, который уже есть на фото. Там сначала распознавание, потом перевод: маршрут разобран в гайдах распознать текст с картинки и перевод текста с фото.


Часть 3 · Деньги

Во что обходится перебор генераций

Одна картинка стоит центы, и это усыпляет. Но работа с надписью почти всегда означает перебор: десять вариантов, из которых читаемых два. Умножьте цену одной генерации на десять и добавьте время.

Цены моделей генерации изображений OpenAI на 13.09.2026, за 1 млн токенов
МодельВход картинкойВыход
gpt-image-2.5-sunburst8 долларов, кеш 230 долларов
gpt-image-2.5-flare8 долларов, кеш 230 долларов
gpt-image-28 долларов, кеш 230 долларов
gpt-image-1.58 долларов, кеш 232 доллара
gpt-image-1-mini2,5 доллара, кеш 0,258 долларов

Отсюда простой вывод: если надпись обязательна и её придётся править, третий способ дешевле любого перебора. Генерация нужна для фона, а не для букв.


Часть 4 · Права

Кому принадлежит картинка

Вопрос всплывает поздно: баннер уже в рекламе, а потом выясняется, что использовать его было нельзя. Условия у сервисов разные, и бесплатные планы обычно самые строгие.

Пример формулировки (Recraft, 13.09.2026)

В разделе вопросов на странице тарифов прямо написано: изображения, созданные на бесплатном плане, принадлежат Recraft, публично видны в галерее сообщества и не лицензированы для коммерческого использования. Там же описан порядок отмены подписки: профиль, пункт управления подпиской, кнопка отмены плана.

Правило простое: перед тем как ставить сгенерированную картинку в рекламу, упаковку или на сайт, найдите на странице сервиса раздел про права и прочитайте два абзаца. Это дешевле, чем менять макеты задним числом.

Коротко

  • Модель рисует буквы как узор, а не набирает шрифтом.
  • С кириллицей ошибок больше, чем с латиницей.
  • Одно-два слова выходят, слоган почти никогда.
  • Текст надписи пишите в кавычках отдельной строкой.
  • Указывайте место, размер и запрет на лишний текст.
  • Надёжный способ: фон генерацией, надпись поверх.
  • Замена по маске работает лучше генерации с нуля.
  • Права на картинки с бесплатных планов часто ограничены.

Источники

Откуда взяты цифры и формулировки

  • Страница цен OpenAI, открыта 13.09.2026: у моделей генерации изображений gpt-image-2.5-sunburst, gpt-image-2.5-flare и gpt-image-2 вход картинкой 8 долларов за миллион токенов, кеш 2, выход 30; у gpt-image-1.5 выход 32; у gpt-image-1-mini вход 2,5, кеш 0,25 и выход 8.
  • Страница тарифов Recraft, открыта 13.09.2026: изображения бесплатного плана принадлежат сервису, публично видны в галерее сообщества и не лицензированы для коммерческого использования; кредиты подписки сгорают в конце периода, докупленные не сгорают; описан порядок отмены подписки.
  • Wordstat, Россия, 13.09.2026: частотность кластера про текст на картинке, включая формулировки про замену и добавление надписи.
  • Выдача Яндекса, 13.09.2026: по запросу «текст на картинках нейросетей» в голове стоят мелкие сервисы и обзоры.

FAQ

Частые вопросы

Почему нейросеть коверкает текст на картинке

Потому что она рисует буквы как часть изображения, а не набирает их шрифтом. Для модели надпись это узор, который надо воспроизвести похоже, а похоже и правильно это разные вещи. С русским хуже, чем с английским: кириллицы в обучающих данных меньше, поэтому чаще появляются несуществующие буквы.

Какая нейросеть лучше всего пишет текст на картинке

Те модели, которые специально учили рендерить надписи. С ними короткая строка латиницей выходит почти всегда, короткая строка по-русски часто, а абзац текста не выходит ни у кого. Практика простая: если надпись обязана быть точной, её не генерируют, а накладывают поверх готовой картинки.

Как получить надпись на русском без ошибок

Самый надёжный способ ровно один: сгенерировать картинку без текста, а надпись добавить в редакторе или кодом. Тогда шрифт ваш, орфография ваша, и ничего не плывёт. Остальные способы это лотерея, и на партии из десяти картинок проигрыш случается обязательно.

Можно ли заменить текст на уже готовой картинке

Да, через редактирование по маске: выделяете область с надписью и просите модель заменить её новым текстом. Выходит заметно лучше, чем генерация с нуля, потому что модель видит исходный шрифт и фон. Но на сложном фоне и мелком кегле остаются артефакты, заметные при увеличении.

Сколько стоит генерация картинки с текстом

По ценам OpenAI на 13 сентября 2026 года выход у моделей изображений стоит 30 долларов за миллион токенов у gpt-image-2.5-sunburst, flare и gpt-image-2, у gpt-image-1.5 это 32 доллара, у младшей gpt-image-1-mini 8 долларов при входе 2,5. В пересчёте на картинку это центы, но двадцать перегенераций стоят в двадцать раз дороже.

Почему на картинке появляются несуществующие буквы

Это тот же механизм, что и в выдуманных фактах: модель не проверяет результат, а продолжает узор, который выглядит правдоподобно. Чем длиннее надпись, тем выше шанс, что в середине появится буква-химера. Короткое слово работает, слоган из семи слов почти никогда.

Как правильно писать запрос, чтобы надпись получилась

Три правила. Текст в кавычках и отдельной строкой, чтобы модель поняла, что это надпись, а не описание. Одна короткая строка, в идеале одно-два слова. И сразу опишите, где надпись и какого она размера: крупно по центру на однотонном фоне. Мелкий текст на пёстром фоне не выходит почти никогда.

Можно ли использовать такие картинки в коммерции

Проверяйте условия сервиса, они различаются сильнее, чем кажется. У Recraft на 13 сентября 2026 года прямо написано, что изображения, созданные на бесплатном плане, принадлежат сервису, публично видны в галерее сообщества и не лицензированы для коммерческого использования. Это типичная схема бесплатных планов.

Что делать, если нужен текст на картинке для маркетплейса

Для карточек товара надписи генерировать не стоит: там нужны точные характеристики, читаемые шрифты и соблюдение требований площадки. Правильный маршрут: фон и композиция от нейросети, текст и цифры поверх в редакторе по шаблону, который вы переиспользуете.

А если нужно перевести текст, который уже есть на фото

Это другая задача: сначала текст распознаётся, потом переводится, и только потом при желании накладывается обратно. Нужны инструменты распознавания и перевода, а не генератор картинок. У нас про это есть отдельные разборы.


Читать дальше

ИИ-офис
Собери свой ИИ-офис и перестань делать руками то, что делает нейросеть

Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.

Посмотреть, что внутри

telegram

Канал с полезными материалами про нейросети

Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.

Перейти в канал
Кирилл Сандаков

Об авторе

Кирилл Сандаков

Вайбкодер, предприниматель, продюсер

Завайбкодил контент-ферму на США в Instagram (более 300 тыс. подписчиков, среди читателей Дональд Трамп Младший), создатель платформы и сообщества ИИ-офис, автор блога о нейросетях «Выжимаем из ИИ Максимум».

Все статьи автора