Спорить, какая из двух моделей «лучше», бессмысленно: в прямых сравнениях на одинаковых промптах выходит разделение труда. GPT Image (генератор картинок от OpenAI, встроен в ChatGPT) сильнее там, где главное — текст, точное исполнение инструкции и живая кожа. Nano Banana (генератор картинок Google, встроен в Gemini) сильнее в правке готовых сцен, листах персонажей, мелкой фактуре, групповых кадрах и скорости. В нашем собственном замере русских надписей на вертикальных обложках GPT Image дал 4 чистых варианта из 5, а Nano Banana — ни одного. Ниже — таблица «кому что отдавать», пошаговый способ проверить модели на своей задаче, готовые промпты и ошибки, на которых теряют время.
Короткий ответ: кто что делает лучше
Таблица собрана по двум чужим прямым сравнениям на одинаковых промптах (на латинице) и нашему замеру кириллицы. Сравнения мы пересказываем своими словами.
| Задача | Кто сильнее | В чём разница |
|---|---|---|
| Сложная типографика, текст на постере | GPT Image | буквы не разъезжаются, иерархия заголовков держится |
| Точность инструкций: сколько предметов и где | GPT Image | Nano Banana ловит настроение, но путает количество |
| Кожа, морщины, живое лицо | GPT Image | мягче и достовернее; у конкурента резче, но резче не значит реальнее |
| Правка готовой картинки с цельной сценой | Nano Banana | у GPT фон выглядит подложенным под героя |
| Лист персонажа с одного фото | Nano Banana | лицо держится во всех ракурсах |
| Мелкая фактура: швы, молнии, ткань | Nano Banana | у GPT зубцы молнии мылятся |
| Групповые кадры | Nano Banana | у GPT на групповом снимке вылезали лишние пальцы |
| Скорость | Nano Banana | около 20 секунд против около 55 |
| Русский текст на обложке 9:16 (наш замер) | GPT Image | 4 чистых из 5 против 0 из 5 |
Правило в одну строку: где главный герой картинки — текст (обложка, постер, инфографика), берите GPT Image. Где главный герой — человек, персонаж или сцена, берите Nano Banana. В одной карусели модели можно и нужно смешивать.
Что понадобится
- Доступ к GPT Image. Проще всего — через ChatGPT: картинку просят прямо в чате. Есть бесплатный лимит, его размер меняется — смотрите на странице тарифов. Для работы через программный интерфейс (API) — ключ разработчика OpenAI.
- Доступ к Nano Banana. Через приложение или сайт Gemini, раздел создания изображений. Есть бесплатный лимит, самые сильные режимы — в платных подписках Google.
- Доступ из России. Официально ChatGPT и Gemini в России недоступны: нужен доступ из-за рубежа или сервис-посредник, который подключает эти модели у себя. Если такого доступа нет, есть российские аналоги — Шедеврум от Яндекса и Kandinsky в ГигаЧате от Сбера; в конце гайда сказано, как проверить их тем же способом.
- Время. На честную пробу двух моделей под одну задачу уходит 20–40 минут: по пять вариантов в каждой и разбор результатов.
- Таблица или заметка для подсчёта чистых вариантов. Без счёта сравнение превращается во «вроде эта красивее».
Условия сервисов меняются: бесплатные лимиты, доступ из России и цены проверяйте на их сайтах.
Какие версии сейчас в ходу
Названия меняются быстро, поэтому коротко — что актуально по состоянию на сентябрь 2026:
- GPT Image. В программном интерфейсе OpenAI сейчас две ветки новой версии: gpt-image-2.5-sunburst (упор на точность правок) и gpt-image-2.5-flare (быстрая повседневная генерация); предыдущая gpt-image-2 тоже доступна. В ChatGPT новая версия вышла 8 сентября 2026 под названием ChatGPT Images 2.5. Сама OpenAI в документации честно пишет, что модель всё ещё может ошибаться с точным размещением текста, удерживать персонажа хуже, чем хотелось бы, а сложный запрос может обрабатываться до двух минут.
- Nano Banana. В приложении Gemini генератор выбирается в меню инструментов, на странице Google сейчас значится Nano Banana 2 с режимами Fast и Thinking, а режим Pro — для платных подписчиков Google AI. По официальному руководству Google модель принимает до 14 опорных картинок в одном запросе и поддерживает пропорции от 1:1 до 9:16 и 21:9.
Наш замер кириллицы делался на gpt-image-2 и на nano-banana в режиме правки. На новых версиях результат может отличаться — поэтому ниже есть протокол, как перепроверить самому за полчаса.
Пошагово: как выбрать модель под свою задачу
- Назовите главного героя картинки. Посмотрите на задумку и ответьте одним словом: текст, человек, предмет или сцена. Если на слайде заголовок крупнее всего остального — герой текст. Если заголовок мелкий, а кадр держит лицо — герой человек. Должно получиться одно слово.
- Сверьтесь с таблицей выше. Текст и точное количество предметов — GPT Image. Персонаж по фото, правка сцены, групповой кадр, мелкая фактура — Nano Banana. Если задача смешанная (персонаж плюс крупный заголовок), переходите к шагу 3 — решит проба.
- Напишите один промпт на обе модели. Слово в слово одинаковый, с одинаковыми приложенными картинками. Меняете хоть одну строку — сравниваете уже не модели, а промпты.
- Задайте пропорцию параметром, а не словами. В интерфейсе, где есть выбор формата, выберите 9:16, 4:5 или 3:4 кнопкой. В нашем замере модели, которым пропорцию говорили только словами, часто отдавали квадрат, а одна вернула горизонталь.
- Сделайте по пять вариантов в каждой. Один вариант ничего не доказывает: удачный и провальный кадр бывают у обеих моделей.
- Посчитайте чистые варианты. Чистый — это такой, который можно публиковать без правки: ни одной сломанной буквы, правильное число пальцев и предметов, нужная пропорция, лицо похоже на исходное. Запишите: «GPT — 3 из 5, Nano Banana — 1 из 5».
- Отдельно отметьте время и число попыток. Если одна модель даёт 3 чистых за минуту, а другая 4 за пять минут, для массовой отрисовки выгоднее первая.
- Закрепите решение в шаблоне. Запишите себе: «обложки — модель А, внутренние слайды с героем — модель Б». Через месяц перепроверьте: модели обновляются, и вывод может поменяться.
Наш замер: кириллица и вертикаль
Мы гоняли одну и ту же задачу — вертикальная обложка 9:16 с русским заголовком, правка по приложенной картинке — в трёх моделях, по пять вариантов в каждой.
| Модель | Чистых вариантов из 5 | Кириллица | Вертикаль 9:16 |
|---|---|---|---|
| gpt-image-2 (правка по картинке) | 4 | без ошибок | держит |
| seedream v4 edit | 2 | ломает | держит |
| nano-banana edit | 0 | — | вернул горизонталь |
Что из этого следует на практике:
- Русский заголовок на картинке — задача для GPT Image. Отдельно набирать текст поверх картинки в редакторе после этого замера нам стало не нужно.
- Пропорцию задавайте параметром сервиса. Словами «вертикальный кадр» модель часто отдаёт квадрат.
- Не привязывайтесь к одной модели навсегда. Один персонаж лучше выходит в одной, другой — в другой. Кириллица у Nano Banana на нашей пробе не удалась, но персонажей и сцены она делает сильнее.
Оговорки честно: сравнения задач выше — чужие и на латинице; наш замер кириллицы — на выборке из пяти вариантов на модель. Это направление, а не статистика.
Готовые промпты
Во всех промптах в квадратных скобках — то, что вы меняете под себя. Остальное оставляйте как есть: каждая строка закрывает конкретную ошибку.
1. Текстовый слайд или постер — для GPT Image
Вертикальный постер для соцсетей.Что менять: заголовок, подзаголовок, фон и акцентное слово. Если заголовок длиннее шести-семи слов, поставьте перенос строки вручную — модель уложит строки так, как вы их разбили. Пропорцию 9:16 выберите параметром.
2. Лист персонажа с одного фото — для Nano Banana
Используй приложенное фото как единственный образец внешности героя.Что менять: список ракурсов и одежду. Этот лист дальше прикладывается к каждой генерации с героем. Подробно о листах — в гайде лист персонажа.
3. Правка сцены так, чтобы она осталась цельной — для Nano Banana
Возьми это изображение.Что менять: одну строку «измени только». Приём двухчастный: сначала перечисляете, что остаётся, потом одну замену. Чем длиннее первая половина, тем безопаснее правка.
4. Групповой кадр — для Nano Banana
Фотореалистичный кадр: [четыре коллеги] стоят у стола в светлом офисе и смеются.Что менять: число людей и сцену. Строку про пальцы не убирайте — на групповых кадрах это самое частое место брака.
5. Одинаковая проба для двух моделей
Вертикальная обложка 9:16 для ролика.Этот промпт отправьте без изменений в обе модели по пять раз и посчитайте чистые варианты по шагу 6. Меняйте только содержимое скобок, и только одинаково в обеих моделях.
Как смешивать модели в одной карусели
Смешивание — не компромисс, а нормальная схема работы.
- Обложку и слайды, где главный — текст, делайте в GPT Image. Это первый слайд, слайды со списками, итоговый слайд с призывом.
- Слайды с героем и сценами делайте в Nano Banana, прикладывая лист персонажа.
- Чтобы стиль не разъехался, прикладывайте к каждому слайду готовую обложку как эталон стиля — тот же шрифт, палитра, сетка. Как это делается пошагово — в гайде карусель нейросетью.
- Если текст на слайде из Nano Banana сломался, не перегенерируйте весь слайд: отдайте его в GPT Image с просьбой заменить только заголовок, сохранив всё остальное.
Сравнение по параметрам
| Параметр | GPT Image | Nano Banana |
|---|---|---|
| Где взять | ChatGPT, API OpenAI, сервисы-посредники | приложение и сайт Gemini, API Google, сервисы-посредники |
| Доступ из России | официально нет, нужен доступ из-за рубежа | официально нет, нужен доступ из-за рубежа |
| Русский текст (наш замер) | 4 чистых из 5 | 0 из 5 |
| Длинный заголовок, иерархия текста | сильная сторона | раскидывает текст по кадру |
| Персонаж по фото | теряет сходство чаще | держит лицо |
| Правка готовой сцены | фон выглядит подложенным | сцена остаётся цельной |
| Скорость в сравнении | около 55 секунд | около 20 секунд |
| Опорных картинок в запросе | одна или несколько | по руководству Google — до 14 |
| Бесплатный вариант | есть лимит, размер меняется | есть лимит, размер меняется |
Цифры скорости — из чужого сравнения на конкретный момент: на высоком качестве GPT Image может думать заметно дольше, а обе модели с тех пор обновлялись.
Типичные ошибки и как чинить
- Сравнивают модели по одной картинке. Удача и брак случаются у обеих. Чините: пять вариантов на модель и счёт чистых.
- Разные промпты в двух моделях. Тогда сравнивается не модель, а текст. Чините: копируйте промпт слово в слово.
- Пропорция словами. Модель отдаёт квадрат или горизонталь. Чините: выбирайте формат кнопкой или параметром.
- Русский заголовок отдают Nano Banana и мучаются. Чините: заголовок — в GPT Image, либо сначала сцена в Nano Banana, потом замена текста в GPT Image.
- Персонажа по фото делают в GPT Image, и лицо плывёт. Чините: лист персонажа в Nano Banana, дальше прикладывайте его ко всем кадрам.
- Цвет «не слушается». Обычно в промпте осталось слово, которое тянет старый цвет: просили оранжевый, а дальше стоит «ультрафиолетовая подсветка». Чините: меняя цвет, вычитайте промпт целиком.
- Код цвета напечатан на картинке. Чините: помечайте «это значение цвета, никогда не рисуй его текстом».
- Модель выдумала цифры. Если для инфографики дали половину данных, вторую половину модель досочинит, и по виду не отличишь. Чините: давайте все числа целиком.
- Выбрали модель раз и навсегда. Модели обновляются каждые несколько месяцев. Чините: раз в месяц повторяйте пробу из промпта 5.
Если доступа к этим моделям нет
Российские сервисы работают без доступа из-за рубежа. Шедеврум от Яндекса — отдельное приложение и сайт, базовый тариф бесплатный. Kandinsky от Сбера по состоянию на сентябрь 2026 работает внутри ГигаЧата: при запуске версии 6.0 в апреле 2026 Сбер заявил её бесплатной и без ограничения числа генераций. Проверьте их тем же протоколом: одинаковый промпт, пять вариантов, счёт чистых. Кириллицу в них мы своим замером не мерили — считайте сами, прежде чем строить на них поток.
Чек-лист перед публикацией
- Главный герой картинки назван, и модель выбрана под него.
- Пропорция задана параметром и совпадает с площадкой: 9:16 для обложки ролика, 4:5 или 3:4 для карусели.
- Каждое слово на картинке прочитано глазами, буква за буквой.
- Пальцы, количество предметов и лица на групповых кадрах пересчитаны.
- Цифры на картинке совпадают с вашими данными, ни одной выдуманной.
- В кадре нет кода цвета, кавычек и случайных символов.
- Лицо героя похоже на лист персонажа, если серия.
- Картинка просмотрена в уменьшенном виде — так, как её увидят в ленте.
Что дальше
- Почему модели ломают русские буквы и как писать текст в промпте — русский текст в картинках и видео нейросетей.
- Как собрать карусель, где стиль не разъезжается от слайда к слайду, — карусель нейросетью: метод якорного слайда.
- Как добиться живой кожи вместо пластика — фотореалистичный портрет нейросетью.
Как зашло?
Ответ засчитывает гайд и помогает нам его улучшить


