Русский текст на картинке нейросеть сделать может, но не любая и не при любом промпте. По нашим пробам GPT Image дал 4 чистые русские надписи из 5, а Nano Banana — 0 из 5; на вертикальных обложках у gpt-image-2 кириллица была целой во всех пяти вариантах, и набирать текст отдельно поверх картинки стало не нужно. В видео в замере от 5 сентября русский заголовок держался в кадре все 4 секунды без искажений. Почти все гайды про текст в картинках написаны на английском, и кириллицу в них никто не проверяет, поэтому ниже — только то, что мы проверили сами, плюс официальные советы производителей моделей и честные пометки, где мы ещё не мерили.
Коротко: что работает
| Что | Работает ли | Откуда знаем |
|---|---|---|
| Короткий русский заголовок в GPT Image | да, 4 чистых из 5 | наш замер |
| Русский заголовок на обложке 9:16 в gpt-image-2 | да, целый во всех 5 вариантах | наш замер |
| Русский текст в Nano Banana напрямую | на нашей пробе нет, 0 из 5 | наш замер |
| Русский текст в кадре видео, 4 секунды | держался, дважды | наш замер от 5 сентября |
| Перевод готового английского макета на русский | должно работать, не мерили | чужие разборы на других языках |
| Наложить текст в редакторе поверх картинки | работает всегда | обычный монтаж |
Правило: если русский текст — главное на картинке, отдавайте его модели, которая по замеру держит кириллицу, пишите текст отдельной строкой и читайте результат глазами, букву за буквой.
Почему нейросети ломают русские буквы
Генератор картинок не «набирает» текст, как редактор, а рисует его — как рисует ткань или листья. Буквы для него — форма, которую он видел в обучающих примерах. Латинских надписей в этих примерах несравнимо больше, чем русских, поэтому латиницу модели рисуют увереннее, а в кириллице путают похожие формы: «Ш» и «Щ», «И» и «Й», теряют хвосты у «Д» и «Ц», вставляют латинскую «N» вместо «И».
Сами производители признают, что текст остаётся слабым местом: в документации OpenAI прямо сказано, что модель всё ещё может ошибаться с точным размещением и чёткостью текста, а Google в руководстве по Nano Banana предупреждает, что длинный текст искажается чаще короткого. На кириллице эти слабости проявляются сильнее.
Есть и вторая причина, наша: русские слова длиннее английских. По нашим прикидкам — примерно на восьмую часть, поэтому английская формула «пять слов на обложке» у нас превращается в три-четыре слова. Длинное слово модель в узком кадре сжимает, и буквы корёжатся.
Что понадобится
- Генератор картинок, который держит кириллицу. По нашему замеру — GPT Image (в ChatGPT или через программный интерфейс OpenAI). Официально он недоступен из России: нужен доступ из-за рубежа или сервис-посредник. Российские аналоги — Шедеврум от Яндекса и Kandinsky в ГигаЧате от Сбера — работают из России; их кириллицу мы не мерили, проверьте по протоколу ниже.
- Графический или видеоредактор — запасной путь, если модель не справилась: набрать текст поверх картинки руками.
- Время: 15–30 минут на проверку новой модели по протоколу из этого гайда.
- Шрифт с кириллицей, если хотите назвать гарнитуру в промпте.
Условия сервисов меняются: бесплатные лимиты, доступ из России и цены проверяйте на их сайтах.
Пошагово: как получить чистый русский текст на картинке
- Сократите текст. Заголовок — до 3–4 слов для обложки ролика и до 8–14 слов для первого слайда карусели. Что должно получиться: текст, который читается за секунду. Если длиннее — разбейте на заголовок и подзаголовок.
- Вынесите текст отдельной строкой. Не вплетайте его в описание сцены: «девушка держит табличку с надписью привет» модель может понять как угодно. Пишите: «Надпись на табличке:» и с новой строки сам текст.
- Решите вопрос с кавычками. Google в официальном руководстве советует брать точный текст в кавычки — это сигнал, что текст буквальный. У нас в пробах кавычки из промпта иногда переезжали в кадр символами. Рабочий компромисс: текст с новой строки после двоеточия и приписка «без кавычек и знаков препинания», если кавычки на картинке не нужны.
- Расставьте переносы сами. Если заголовок в две строки, разбейте его в промпте на две строки. Модель уложит так, как вы разбили, и не будет сжимать длинное слово.
- Опишите начертание. «Жирный узкий гротеск, белый» работает лучше, чем название шрифта. Называйте конкретный шрифт, только если в нём точно есть кириллица: просить латинский шрифт с русским текстом — просить то, чего в шрифте нет.
- Задайте пропорцию параметром. Длинный заголовок легче ложится в горизонтальный кадр. Если нужна вертикаль, помогает ручной перенос из шага 4.
- Сделайте пять вариантов и выберите чистый. Чистый — это ни одной сломанной буквы.
- Прочитайте каждое слово глазами. Не «вроде нормально», а по буквам: «Й», «Щ», «Ы», «Ё», «Д», «Ц», мягкий и твёрдый знаки.
- Если сломана одна буква — не перегенерируйте всю картинку: попросите заменить только надпись (промпт 3) или поправьте букву в редакторе.
Как писать текст в промпте: пять правил
- Текст — отдельной строкой, не внутри описания сцены.
- Коды цветов помечайте: «это значения цвета, никогда не рисовать их текстом». Без этой пометки одна из моделей в наших пробах напечатала код цвета прямо на картинке.
- Меняя цвет, меняйте его во всех местах промпта. Одно забытое слово тянет старый цвет, и вы получите не тот оттенок без всякого предупреждения.
- Английские нормы длины делите: где англоязычный гайд говорит «пять слов», у нас три-четыре.
- Описывайте желаемое, а не запреты. Google в руководстве советует формулировать позитивно: «пустой однотонный фон» вместо «без предметов». Исключение — «без кавычек»: здесь запрет короче любой другой формулировки.
Готовые промпты
В квадратных скобках — то, что меняете.
1. Обложка с русским заголовком
Вертикальная обложка для ролика.Что менять: сцену и заголовок. Строки заголовка разбивайте сами. Пропорцию 9:16 выберите параметром сервиса.
2. Слайд с заголовком и подзаголовком
Слайд для карусели, формат 4:5.Что менять: оба текста, цвета и фон. Если подзаголовок выходит с ошибками, сократите его до 4–5 слов.
3. Заменить сломанную надпись, не трогая картинку
Возьми это изображение.Приём двухчастный: сначала что остаётся, потом одна замена. Чем подробнее первая половина, тем меньше модель трогает остальное.
4. Перевод готового макета
Переведи весь текст на этом макете на русский язык.Когда полезен: вы нашли англоязычный макет-образец или модель лучше рисует латиницу, чем кириллицу. Google в руководстве по Nano Banana отдельно упоминает перевод и локализацию текста как поддерживаемый сценарий. Оговорка: в чужих разборах так переводили на корейский и японский, на русском этот приём нами не замерен — проверьте на пяти вариантах.
5. Проверочный набор для новой модели
Вертикальная карточка 4:5, белый фон, чёрный жирный гротеск по центру.
Надпись:
[ЩЁТКА ДЛЯ ЙОГИ]
Без кавычек. Каждая буква целая.
В надпись специально собраны трудные буквы: «Щ», «Ё», «Й», «Д». Отправьте пять раз и посчитайте, сколько вариантов без единой ошибки. Это быстрый способ узнать, стоит ли модели доверять русский текст.
Протокол замера: проверьте модель сами за полчаса
Прежде чем строить на модели поток обложек, прогоните её по такому протоколу — мы используем его у себя.
- Возьмите пять случаев: одно короткое слово · длинный заголовок · заголовок плюс подпись · текст на предмете в сцене (вывеска, табличка) · абзац мелким кеглем.
- На каждый случай — один промпт, одинаковый для всех сравниваемых моделей.
- По два-пять запусков на случай.
- Считайте не «красиво», а число надписей без единой сломанной буквы.
- Запишите итог числом: «модель А — 8 из 10, модель Б — 3 из 10».
Такое число можно перепроверить через месяц, когда модель обновится.
Русский текст в видео
В видеонейросетях текст ещё капризнее: он должен не просто нарисоваться, а удержаться во всех кадрах, пока камера и предметы двигаются.
Что мы видели сами. В замере от 5 сентября русский текст в кадре держался все 4 секунды без искажений, и так дважды: заголовок в две строки с цветным словом, мелкие подписи и число «+8%». А в конце августа мы же записывали обратное — текст плыл. Модели обновляются, поэтому проверяйте на той версии, которой пользуетесь сейчас.
Как повысить шансы:
- Делайте кадр-основу картинкой с уже готовым текстом (в модели, которая держит кириллицу), а видео — из этой картинки. Про такой режим — в гайде видео из фото.
- Держите камеру спокойной в кадрах с текстом: сильный наезд и поворот чаще ломают буквы.
- Короткий фрагмент надёжнее длинного.
- Если текст всё же поплыл, наложите его в видеоредакторе поверх готового ролика — это надёжнее, чем пятая перегенерация.
Сравнение способов получить русский текст
| Способ | Надёжность | Скорость | Когда брать |
|---|---|---|---|
| Сразу в генерации (GPT Image) | высокая по нашему замеру | быстро | обложки, постеры, короткие заголовки |
| Сразу в генерации (Nano Banana) | низкая на нашей пробе | быстро | когда текст не главное, а герой |
| Сцена в одной модели, замена текста в другой | высокая | средне | нужен сильный герой и чистый заголовок |
| Перевод английского макета | не замерено | быстро | есть готовый англоязычный образец |
| Наложение в редакторе | полная | медленнее | длинный текст, много цифр, видео |
Типичные ошибки и как чинить
- Длинный заголовок в узком кадре. Буквы сжимаются и ломаются. Чините: сократите или разбейте строки вручную.
- Кавычки на картинке. Чините: текст после двоеточия с новой строки и «без кавычек».
- Код цвета напечатан. Чините: пометка «значения цвета, никогда не рисовать текстом».
- Цвет не тот. В промпте осталось слово со старым цветом. Чините: вычитайте промпт целиком.
- Латинские буквы вместо русских. Например, «N» вместо «И». Чините: припишите «весь текст на русском языке» и замените только надпись промптом 3.
- Назвали шрифт без кириллицы. Модель рисует что-то своё. Чините: опишите начертание словами.
- Цифры и даты с ошибками. Числа ломаются чаще слов. Чините: проверяйте каждую цифру, при нужде — редактор.
- Проверили один вариант и поверили. Чините: пять вариантов и счёт чистых.
- Поверили старому выводу про видео. Чините: перепроверяйте на текущей версии модели.
Чек-лист перед публикацией
- Каждое слово прочитано по буквам, особенно «Й», «Щ», «Ё», «Ы», «Д», «Ц».
- Нет латинских букв внутри русских слов.
- Нет кавычек, кодов цвета и случайных символов.
- Цифры, даты и проценты совпадают с вашими данными.
- Заголовок не длиннее нормы: 3–4 слова на обложке ролика, 8–14 на первом слайде карусели.
- Текст не лежит на лице и не уходит в нижнюю четверть кадра, где его закроет интерфейс площадки.
- В видео текст проверен в первом, среднем и последнем кадре.
Что дальше
- Какую модель брать под текстовые слайды и какую под героя — GPT Image или Nano Banana.
- Сколько текста ставить на обложку ролика и где оставлять пустые зоны — обложка для Reels и Shorts.
- Как собрать карусель, где шрифт не меняется от слайда к слайду, — карусель нейросетью.
Оговорка: перевод макета — приём из чужих разборов на других языках, на русском нами не замерен; выборки наших проб — по пять вариантов.
Как зашло?
Ответ засчитывает гайд и помогает нам его улучшить


