«Какая нейросеть лучше» — вопрос без ответа, пока не названа задача. Лучшая для рекламного ролика и лучшая для открытки — разные модели, а лучшая для русского текста на картинке и лучшая для живого лица — тоже разные. Ниже — справочник по задачам на сентябрь 2026: что брать для фото, оживления фото, видео, голоса и текста, как за полчаса сравнить сервисы самому и какие варианты работают из России напрямую.
| Задача | Что смотреть в первую очередь | Подробный разбор |
|---|---|---|
| Создать или изменить фото | GPT Image (в ChatGPT), Nano Banana Pro (в Gemini), Midjourney, Flux; из российских — Шедеврум, Кандинский | Нейросеть для фото |
| Оживить фото | режим «фото в видео» у видео-моделей | Как оживить фото |
| Сделать видео | Veo 3.1 и Gemini Omni в Google Flow, Kling 3.0, Runway Gen-4.5, Seedance 2.0, Hailuo; из российских — Кандинский в ГигаЧате, Шедеврум | Нейросеть для видео |
| Озвучка и голос | ElevenLabs, российские синтезаторы речи | Нейросеть для озвучки |
| Текст, сценарии, промпты | ChatGPT, Claude, Gemini, ГигаЧат, Алиса | Промпты для нейросетей |
Главное правило выбора: сначала задача и доступ, потом рейтинг. Модель, которая лидирует в таблицах, но не открывается у вас или не держит русский текст, для вашей работы не лучшая.
Что понадобится
- Список ваших задач на месяц: сколько картинок, роликов, минут озвучки, текстов. От этого зависит, нужен ли платный тариф.
- Почта или телефон для регистрации. Сервисы «без регистрации» часто работают через чужие ключи — не загружайте туда свои фото и фото клиентов.
- Способ оплаты. Российские сервисы принимают российские карты. Многие зарубежные требуют зарубежную карту и доступ из-за рубежа — это нужно выяснить до того, как строить на сервисе работу.
- Полчаса на сравнение: один и тот же тестовый промпт в 2–3 сервисах (готовые промпты ниже).
- Деньги: попробовать почти везде можно бесплатно, для регулярной работы нужен тариф или оплата за генерацию. Цены и лимиты меняются часто — смотрите на страницах тарифов.
Как выбрать нейросеть под свою задачу: пошагово
- Назовите задачу одной фразой. Не «нужна нейросеть для видео», а «ролик 9:16 на 8 секунд с одним и тем же героем для серии». Чем точнее задача, тем короче список кандидатов.
- Отсейте по доступу. Проверьте, открывается ли сервис у вас и чем за него платить. Если нужна зарубежная карта, а её нет, — сразу смотрите российские аналоги или посредников с понятной репутацией.
- Отсейте по языку. Если в кадре нужен русский текст, это отдельное требование: не все модели пишут кириллицу чисто. Подробно — в разборе кириллица в нейросетях.
- Прогоните один тестовый промпт в 2–3 сервисах. Одинаковый текст, одинаковый формат, по 3–4 варианта в каждом. Сравнивайте не «красиво», а то, что можно проверить: совпало ли число предметов, прочитался ли текст, узнаётся ли лицо.
- Посчитайте цену одного годного результата. Не цену генерации, а цену того, что пойдёт в работу: если из четырёх вариантов годен один, реальная цена — вчетверо выше указанной.
- Проверьте права. Можно ли использовать результат в рекламе и коммерции на вашем тарифе — это написано в условиях использования. На бесплатных тарифах права иногда урезаны.
- Закрепите связку. Для постоянной работы обычно нужен не один сервис, а цепочка: картинка → видео → голос → монтаж. Лучшая связка — та, где выход одного шага без переделок идёт на вход следующего.
По задачам подробно
Фото и картинки
Сейчас сильнейшие генераторы картинок — GPT Image (модель gpt-image-2 вышла в апреле 2026, работает внутри ChatGPT) и Nano Banana Pro (генерация картинок в Gemini). Они по-разному сильны, и в одной работе их можно и нужно смешивать. По разборам, которые мы собрали:
- GPT Image сильнее там, где главный герой — текст: обложки, постеры, слайды каруселей, инфографика. В нашем небольшом замере кириллицы GPT Image дал 4 чистые надписи из 5, Nano Banana — 0 из 5.
- Nano Banana Pro сильнее в персонажах, листах героя, правке готовой картинки так, чтобы сцена осталась цельной, и в групповых кадрах. Принимает до 14 изображений-образцов, из них до 5 людей (по данным Google на сентябрь 2026).
- Midjourney — художественные стили и эстетика; с точным текстом в кадре и точными инструкциями справляется хуже.
- Flux — открытая модель, её встраивают в разные сервисы; удобна, если нужны свои доработки.
- Шедеврум (Яндекс) и Кандинский (Сбер, внутри ГигаЧата) работают из России напрямую, промпт можно писать по-русски. Для простых картинок и открыток их хватает; для серии с постоянным героем инструментов меньше.
Подробное сравнение двух главных моделей — GPT Image или Nano Banana.
Оживить фото
Отдельная нейросеть для этого не нужна: это режим «фото в видео» у видео-моделей. Вы даёте картинку как первый кадр и описываете одно-два движения. Есть он у Veo, Kling, Runway, Hailuo, в Шедевруме («Оживление фото») и у Кандинского в ГигаЧате. Разница — в том, насколько лицо остаётся похожим к концу фрагмента. Пошагово — в разборе как оживить фото.
Видео
По состоянию на сентябрь 2026:
- Veo 3.1 (Google) — основная видео-модель Google, генерирует видео со звуком, есть режим Ingredients to Video, куда можно приложить до 3 изображений-образцов. Работает в Google Flow, в приложении Gemini и через API.
- Gemini Omni Flash (Google) — видео-модель, представленная на Google I/O в мае 2026; работает в Flow и приложении Gemini, умеет править ролик диалогом. На ней сделан наш замер из 14 генераций (о нём — в разборе промпты для видео).
- Kling 3.0 (Kuaishou) — вышел в феврале 2026: несколько планов в одной генерации, звук, режим Elements для постоянного героя.
- Runway Gen-4.5 — модель с упором на качество движения и точность исполнения промпта.
- Seedance 2.0 (ByteDance) — вышел в феврале 2026, принимает на вход текст, картинки, звук и видео.
- Hailuo (MiniMax) — популярен для коротких клипов «фото в видео».
- Кандинский в ГигаЧате и Шедеврум — российские варианты, работают напрямую. По описанию Сбера, Kandinsky 5.0 Video Pro генерирует пятисекундные ролики по тексту или стартовому кадру.
Важно: приложение Sora от OpenAI закрыто — по данным открытых источников, приложение перестало работать 26 апреля 2026, API — 24 сентября 2026. Старые гайды, где Sora стоит первым пунктом, устарели.
Выбор между ними — в разборе нейросеть для видео.
Озвучка и голос
ElevenLabs — самый известный сервис синтеза речи и клонирования голоса, хорошо говорит по-русски, но требует доступа из-за рубежа и зарубежной оплаты. Из российских — синтезаторы речи больших компаний (например, SpeechKit у Яндекса и SaluteSpeech у Сбера), они работают напрямую и подходят для закадрового голоса. Многие видео-модели (Veo, Kling) генерируют звук и речь прямо в ролике — тогда голос «сидит» внутри комнаты, но его сложнее держать одинаковым между роликами. Подробно — нейросеть для озвучки.
Текст, сценарии и промпты
ChatGPT, Claude, Gemini — сильные зарубежные модели, требуют доступа из-за рубежа. ГигаЧат (Сбер) и Алиса (Яндекс) работают из России напрямую и хорошо знают русские реалии. Для сценариев коротких роликов разница между топовыми моделями меньше, чем разница между хорошим и плохим заданием: дайте модели образец своего лучшего текста и ограничение по длине — это важнее выбора модели.
Монтаж
Монтаж ИИ-роликов — отдельная связка: генерации собираются в редакторе, добавляются субтитры, текст и звук. Если роликов много, монтаж можно делать кодом по шаблону — так устроен наш контент-завод, об этом — контент-завод для видео.
Сравнительная таблица по критериям выбора
| Критерий | На что смотреть | Где это обычно сильнее |
|---|---|---|
| Русский текст в кадре | чистые ли буквы, нет ли лишних символов | GPT Image; у видео-моделей проверять отдельно |
| Постоянный герой | можно ли приложить несколько образцов | Nano Banana Pro, Veo 3.1 (ингредиенты), Kling (Elements) |
| Звук в ролике | генерирует ли модель звук и речь сама | Veo 3.1, Kling 3.0, Seedance 2.0 |
| Доступ из России | открывается ли напрямую, чем платить | Шедеврум, Кандинский, ГигаЧат, Алиса |
| Промпт на русском | понимает ли без перевода | российские сервисы; зарубежные чаще точнее по-английски |
| Права на результат | коммерческое использование на вашем тарифе | читать условия каждого сервиса |
Готовые тестовые промпты: сравните сервисы сами
Один и тот же промпт в 2–3 сервисах — самый быстрый способ понять, что подходит вам. Каждый тест проверяет конкретную вещь, которую можно посчитать.
Тест картинки: точность и текст
Вертикальный кадр 9:16. Женщина лет 35 в бежевом свитере сидит за деревянным столом у окна,Что считать: три ли чашки, читается ли надпись без искажённых букв, осталась ли верхняя треть пустой под текст. Что менять: надпись и число предметов — это и есть проверка.
Тест видео: камера и герой
9:16, 6 seconds. A man in his 40s in a denim jacket repairs a bicycle in a sunny garage.Что считать: поехала ли камера, случилась ли улыбка в конце, а не в начале, узнаётся ли один и тот же человек от первой до последней секунды. Сделайте по 3 варианта в каждом сервисе.
Тест текстовой модели: сценарий по рамке
Напиши сценарий вертикального ролика на 30 секунд для [ниша].Что считать: уложилась ли модель в длину, есть ли выдуманные цифры, звучит ли первая фраза про зрителя. Что менять: нишу, тему и зрителя.
Тест голоса
Привет! Сегодня покажу, как за десять минут сделать обложку для ролика.Что слушать: правильные ли ударения, не проглатываются ли окончания, звучат ли паузы на точках естественно. Этот текст специально с числом и перечислением — на них синтезаторы чаще ошибаются.
Типичные ошибки при выборе
| Ошибка | Чем плохо | Как лучше |
|---|---|---|
| Выбирать по рейтингу, а не по задаче | лидер рейтинга может не держать русский текст или не открываться у вас | сначала задача и доступ, потом рейтинг |
| Сравнивать по одной генерации | результат каждый раз разный, случайная удача вводит в заблуждение | 3–4 варианта на сервис, одинаковый промпт |
| Считать цену генерации, а не годного результата | реальная цена выше в разы | цена = расход на генерации ÷ число годных |
| Строить работу на сервисе без способа оплаты | работа встанет в середине проекта | до старта проверить оплату и доступ |
| Загружать фото клиентов в сервисы «без регистрации» | неясно, куда уходят данные | только сервисы с понятными условиями |
| Держаться за закрытый сервис | Sora, например, закрыта в 2026 | раз в квартал сверять список |
| Не читать права на результат | проблемы при использовании в рекламе | проверить условия тарифа |
Что мы используем сами
Для роликов — видео-модели Google в режиме «кадры в видео» и «ингредиенты», для картинок — GPT Image и Nano Banana (текстовые слайды и обложки — GPT Image, персонажи и сцены — Nano Banana), для голоса — ElevenLabs, для монтажа — код по шаблону. Это не реклама, а то, на чём собраны наши ролики.
Чек-лист перед тем, как выбрать сервис для работы
- Задача описана одной фразой, с форматом и длиной.
- Сервис открывается у вас, и понятно, чем за него платить.
- Проверено, пишет ли модель русский текст, если он нужен в кадре.
- Прогнан один и тот же тестовый промпт в 2–3 сервисах, по 3–4 варианта.
- Посчитана цена одного годного результата, а не одной генерации.
- Прочитаны условия: можно ли использовать результат в рекламе.
- Понятно, как результат передаётся в следующий шаг (видео, голос, монтаж).
Условия сервисов меняются: бесплатные лимиты, доступ из России, версии моделей и цены проверяйте на их сайтах. Данные в этом справочнике — по состоянию на сентябрь 2026.
Что дальше
- Как писать запросы, чтобы любая из этих нейросетей понимала с первого раза, — промпты для нейросетей.
- Какую видео-модель выбрать и как ей пользоваться — нейросеть для видео.
- Как держать одного героя во всех роликах серии — мастер-листы персонажа.
Как зашло?
Ответ засчитывает гайд и помогает нам его улучшить


