Меню
Войти
Фото и картинки12 мин чтенияобновлено 26 сентября 2026

GPT Image или Nano Banana? Какую модель брать под вашу задачу

Сравнение двух генераторов картинок по задачам: текст на картинке, правка фото, персонажи, кожа, скорость. Плюс наш замер русских надписей на обложках 9:16.

GPT Image или Nano Banana? Какую модель брать под вашу задачу

Спорить, какая из двух моделей «лучше», бессмысленно: в прямых сравнениях на одинаковых промптах выходит разделение труда. GPT Image (генератор картинок от OpenAI, встроен в ChatGPT) сильнее там, где главное — текст, точное исполнение инструкции и живая кожа. Nano Banana (генератор картинок Google, встроен в Gemini) сильнее в правке готовых сцен, листах персонажей, мелкой фактуре, групповых кадрах и скорости. В нашем собственном замере русских надписей на вертикальных обложках GPT Image дал 4 чистых варианта из 5, а Nano Banana — ни одного. Ниже — таблица «кому что отдавать», пошаговый способ проверить модели на своей задаче, готовые промпты и ошибки, на которых теряют время.

Короткий ответ: кто что делает лучше

Таблица собрана по двум чужим прямым сравнениям на одинаковых промптах (на латинице) и нашему замеру кириллицы. Сравнения мы пересказываем своими словами.

ЗадачаКто сильнееВ чём разница
Сложная типографика, текст на постереGPT Imageбуквы не разъезжаются, иерархия заголовков держится
Точность инструкций: сколько предметов и гдеGPT ImageNano Banana ловит настроение, но путает количество
Кожа, морщины, живое лицоGPT Imageмягче и достовернее; у конкурента резче, но резче не значит реальнее
Правка готовой картинки с цельной сценойNano Bananaу GPT фон выглядит подложенным под героя
Лист персонажа с одного фотоNano Bananaлицо держится во всех ракурсах
Мелкая фактура: швы, молнии, тканьNano Bananaу GPT зубцы молнии мылятся
Групповые кадрыNano Bananaу GPT на групповом снимке вылезали лишние пальцы
СкоростьNano Bananaоколо 20 секунд против около 55
Русский текст на обложке 9:16 (наш замер)GPT Image4 чистых из 5 против 0 из 5

Правило в одну строку: где главный герой картинки — текст (обложка, постер, инфографика), берите GPT Image. Где главный герой — человек, персонаж или сцена, берите Nano Banana. В одной карусели модели можно и нужно смешивать.

Что понадобится

  • Доступ к GPT Image. Проще всего — через ChatGPT: картинку просят прямо в чате. Есть бесплатный лимит, его размер меняется — смотрите на странице тарифов. Для работы через программный интерфейс (API) — ключ разработчика OpenAI.
  • Доступ к Nano Banana. Через приложение или сайт Gemini, раздел создания изображений. Есть бесплатный лимит, самые сильные режимы — в платных подписках Google.
  • Доступ из России. Официально ChatGPT и Gemini в России недоступны: нужен доступ из-за рубежа или сервис-посредник, который подключает эти модели у себя. Если такого доступа нет, есть российские аналоги — Шедеврум от Яндекса и Kandinsky в ГигаЧате от Сбера; в конце гайда сказано, как проверить их тем же способом.
  • Время. На честную пробу двух моделей под одну задачу уходит 20–40 минут: по пять вариантов в каждой и разбор результатов.
  • Таблица или заметка для подсчёта чистых вариантов. Без счёта сравнение превращается во «вроде эта красивее».

Условия сервисов меняются: бесплатные лимиты, доступ из России и цены проверяйте на их сайтах.

Какие версии сейчас в ходу

Названия меняются быстро, поэтому коротко — что актуально по состоянию на сентябрь 2026:

  • GPT Image. В программном интерфейсе OpenAI сейчас две ветки новой версии: gpt-image-2.5-sunburst (упор на точность правок) и gpt-image-2.5-flare (быстрая повседневная генерация); предыдущая gpt-image-2 тоже доступна. В ChatGPT новая версия вышла 8 сентября 2026 под названием ChatGPT Images 2.5. Сама OpenAI в документации честно пишет, что модель всё ещё может ошибаться с точным размещением текста, удерживать персонажа хуже, чем хотелось бы, а сложный запрос может обрабатываться до двух минут.
  • Nano Banana. В приложении Gemini генератор выбирается в меню инструментов, на странице Google сейчас значится Nano Banana 2 с режимами Fast и Thinking, а режим Pro — для платных подписчиков Google AI. По официальному руководству Google модель принимает до 14 опорных картинок в одном запросе и поддерживает пропорции от 1:1 до 9:16 и 21:9.

Наш замер кириллицы делался на gpt-image-2 и на nano-banana в режиме правки. На новых версиях результат может отличаться — поэтому ниже есть протокол, как перепроверить самому за полчаса.

Пошагово: как выбрать модель под свою задачу

  1. Назовите главного героя картинки. Посмотрите на задумку и ответьте одним словом: текст, человек, предмет или сцена. Если на слайде заголовок крупнее всего остального — герой текст. Если заголовок мелкий, а кадр держит лицо — герой человек. Должно получиться одно слово.
  2. Сверьтесь с таблицей выше. Текст и точное количество предметов — GPT Image. Персонаж по фото, правка сцены, групповой кадр, мелкая фактура — Nano Banana. Если задача смешанная (персонаж плюс крупный заголовок), переходите к шагу 3 — решит проба.
  3. Напишите один промпт на обе модели. Слово в слово одинаковый, с одинаковыми приложенными картинками. Меняете хоть одну строку — сравниваете уже не модели, а промпты.
  4. Задайте пропорцию параметром, а не словами. В интерфейсе, где есть выбор формата, выберите 9:16, 4:5 или 3:4 кнопкой. В нашем замере модели, которым пропорцию говорили только словами, часто отдавали квадрат, а одна вернула горизонталь.
  5. Сделайте по пять вариантов в каждой. Один вариант ничего не доказывает: удачный и провальный кадр бывают у обеих моделей.
  6. Посчитайте чистые варианты. Чистый — это такой, который можно публиковать без правки: ни одной сломанной буквы, правильное число пальцев и предметов, нужная пропорция, лицо похоже на исходное. Запишите: «GPT — 3 из 5, Nano Banana — 1 из 5».
  7. Отдельно отметьте время и число попыток. Если одна модель даёт 3 чистых за минуту, а другая 4 за пять минут, для массовой отрисовки выгоднее первая.
  8. Закрепите решение в шаблоне. Запишите себе: «обложки — модель А, внутренние слайды с героем — модель Б». Через месяц перепроверьте: модели обновляются, и вывод может поменяться.

Наш замер: кириллица и вертикаль

Мы гоняли одну и ту же задачу — вертикальная обложка 9:16 с русским заголовком, правка по приложенной картинке — в трёх моделях, по пять вариантов в каждой.

МодельЧистых вариантов из 5КириллицаВертикаль 9:16
gpt-image-2 (правка по картинке)4без ошибокдержит
seedream v4 edit2ломаетдержит
nano-banana edit0—вернул горизонталь

Что из этого следует на практике:

  • Русский заголовок на картинке — задача для GPT Image. Отдельно набирать текст поверх картинки в редакторе после этого замера нам стало не нужно.
  • Пропорцию задавайте параметром сервиса. Словами «вертикальный кадр» модель часто отдаёт квадрат.
  • Не привязывайтесь к одной модели навсегда. Один персонаж лучше выходит в одной, другой — в другой. Кириллица у Nano Banana на нашей пробе не удалась, но персонажей и сцены она делает сильнее.

Оговорки честно: сравнения задач выше — чужие и на латинице; наш замер кириллицы — на выборке из пяти вариантов на модель. Это направление, а не статистика.

Готовые промпты

Во всех промптах в квадратных скобках — то, что вы меняете под себя. Остальное оставляйте как есть: каждая строка закрывает конкретную ошибку.

1. Текстовый слайд или постер — для GPT Image

Вертикальный постер для соцсетей.
Бесплатно, за минуту. Уже есть аккаунт?

Что менять: заголовок, подзаголовок, фон и акцентное слово. Если заголовок длиннее шести-семи слов, поставьте перенос строки вручную — модель уложит строки так, как вы их разбили. Пропорцию 9:16 выберите параметром.

2. Лист персонажа с одного фото — для Nano Banana

Используй приложенное фото как единственный образец внешности героя.
Бесплатно, за минуту. Уже есть аккаунт?

Что менять: список ракурсов и одежду. Этот лист дальше прикладывается к каждой генерации с героем. Подробно о листах — в гайде лист персонажа.

3. Правка сцены так, чтобы она осталась цельной — для Nano Banana

Возьми это изображение.
Бесплатно, за минуту. Уже есть аккаунт?

Что менять: одну строку «измени только». Приём двухчастный: сначала перечисляете, что остаётся, потом одну замену. Чем длиннее первая половина, тем безопаснее правка.

4. Групповой кадр — для Nano Banana

Фотореалистичный кадр: [четыре коллеги] стоят у стола в светлом офисе и смеются.
Бесплатно, за минуту. Уже есть аккаунт?

Что менять: число людей и сцену. Строку про пальцы не убирайте — на групповых кадрах это самое частое место брака.

5. Одинаковая проба для двух моделей

Вертикальная обложка 9:16 для ролика.
Бесплатно, за минуту. Уже есть аккаунт?

Этот промпт отправьте без изменений в обе модели по пять раз и посчитайте чистые варианты по шагу 6. Меняйте только содержимое скобок, и только одинаково в обеих моделях.

Как смешивать модели в одной карусели

Смешивание — не компромисс, а нормальная схема работы.

  1. Обложку и слайды, где главный — текст, делайте в GPT Image. Это первый слайд, слайды со списками, итоговый слайд с призывом.
  2. Слайды с героем и сценами делайте в Nano Banana, прикладывая лист персонажа.
  3. Чтобы стиль не разъехался, прикладывайте к каждому слайду готовую обложку как эталон стиля — тот же шрифт, палитра, сетка. Как это делается пошагово — в гайде карусель нейросетью.
  4. Если текст на слайде из Nano Banana сломался, не перегенерируйте весь слайд: отдайте его в GPT Image с просьбой заменить только заголовок, сохранив всё остальное.

Сравнение по параметрам

ПараметрGPT ImageNano Banana
Где взятьChatGPT, API OpenAI, сервисы-посредникиприложение и сайт Gemini, API Google, сервисы-посредники
Доступ из Россииофициально нет, нужен доступ из-за рубежаофициально нет, нужен доступ из-за рубежа
Русский текст (наш замер)4 чистых из 50 из 5
Длинный заголовок, иерархия текстасильная сторонараскидывает текст по кадру
Персонаж по фототеряет сходство чащедержит лицо
Правка готовой сценыфон выглядит подложеннымсцена остаётся цельной
Скорость в сравненииоколо 55 секундоколо 20 секунд
Опорных картинок в запросеодна или несколькопо руководству Google — до 14
Бесплатный вариантесть лимит, размер меняетсяесть лимит, размер меняется

Цифры скорости — из чужого сравнения на конкретный момент: на высоком качестве GPT Image может думать заметно дольше, а обе модели с тех пор обновлялись.

Типичные ошибки и как чинить

  • Сравнивают модели по одной картинке. Удача и брак случаются у обеих. Чините: пять вариантов на модель и счёт чистых.
  • Разные промпты в двух моделях. Тогда сравнивается не модель, а текст. Чините: копируйте промпт слово в слово.
  • Пропорция словами. Модель отдаёт квадрат или горизонталь. Чините: выбирайте формат кнопкой или параметром.
  • Русский заголовок отдают Nano Banana и мучаются. Чините: заголовок — в GPT Image, либо сначала сцена в Nano Banana, потом замена текста в GPT Image.
  • Персонажа по фото делают в GPT Image, и лицо плывёт. Чините: лист персонажа в Nano Banana, дальше прикладывайте его ко всем кадрам.
  • Цвет «не слушается». Обычно в промпте осталось слово, которое тянет старый цвет: просили оранжевый, а дальше стоит «ультрафиолетовая подсветка». Чините: меняя цвет, вычитайте промпт целиком.
  • Код цвета напечатан на картинке. Чините: помечайте «это значение цвета, никогда не рисуй его текстом».
  • Модель выдумала цифры. Если для инфографики дали половину данных, вторую половину модель досочинит, и по виду не отличишь. Чините: давайте все числа целиком.
  • Выбрали модель раз и навсегда. Модели обновляются каждые несколько месяцев. Чините: раз в месяц повторяйте пробу из промпта 5.

Если доступа к этим моделям нет

Российские сервисы работают без доступа из-за рубежа. Шедеврум от Яндекса — отдельное приложение и сайт, базовый тариф бесплатный. Kandinsky от Сбера по состоянию на сентябрь 2026 работает внутри ГигаЧата: при запуске версии 6.0 в апреле 2026 Сбер заявил её бесплатной и без ограничения числа генераций. Проверьте их тем же протоколом: одинаковый промпт, пять вариантов, счёт чистых. Кириллицу в них мы своим замером не мерили — считайте сами, прежде чем строить на них поток.

Чек-лист перед публикацией

  • Главный герой картинки назван, и модель выбрана под него.
  • Пропорция задана параметром и совпадает с площадкой: 9:16 для обложки ролика, 4:5 или 3:4 для карусели.
  • Каждое слово на картинке прочитано глазами, буква за буквой.
  • Пальцы, количество предметов и лица на групповых кадрах пересчитаны.
  • Цифры на картинке совпадают с вашими данными, ни одной выдуманной.
  • В кадре нет кода цвета, кавычек и случайных символов.
  • Лицо героя похоже на лист персонажа, если серия.
  • Картинка просмотрена в уменьшенном виде — так, как её увидят в ленте.

Что дальше

Как зашло?

Ответ засчитывает гайд и помогает нам его улучшить

Читать дальше

Видео · 11 минПочему видео-нейросеть отказывает и как написать промпт, который пройдёт фильтрПросмотры · 11 минХук за 5 секунд и четыре провала начала ролика, которые его убиваютВидео · 23 минКак сделать ИИ-бабушку с рецептами, которая набирает миллионы просмотров

Вход в ИИ-цех

Аккаунт бесплатный: открывает гайды целиком, считает пройденные и помнит ваш маршрут.