Перейти к содержанию

Как сравнить Nano Banana 2, Nano Banana Pro и GPT Image 2 в сценарии: методика теста

Как сравнить Nano Banana 2, Nano Banana Pro и GPT Image 2 в сценарии: методика теста — превью статьи LEADTEX

Как сравнить Nano Banana 2, Nano Banana Pro и GPT Image 2 в сценарии: методика теста

Методика сравнения уровней качества блока AI-изображение в сценарии чат-бота LEADTEX: одинаковый вход, три модели, протокол теста, журнал попыток и критерии выбора уровня для рабочей ветки.

Здесь мы сравниваем не три нейросети в вакууме. Речь о конкретной настройке блока AI-изображение внутри сценария чат-бота LEADTEX.

Пользователь доходит до блока, передаёт описание или фотографию, бот запускает генерацию и получает изображение. После этого сценарий должен продолжиться: показать результат, предложить уточнение, перейти к заказу или сработать по запасной ветке. При настройке блока вы выбираете уровень качества. На текущий момент уровням соответствуют три модели:

Уровень в блоке AI-изображение Модель
Стандартное Nano Banana 2
Оптимальное Nano Banana Pro
Высокое GPT Image 2

Задача статьи — понять, какой уровень оставить в рабочей ветке бота. Для этого недостаточно выбрать самую известную модель или посмотреть одну красивую картинку. Нужно прогнать через все три уровня один и тот же участок сценария и проверить, где бот стабильно выдаёт пригодный результат за приемлемое количество токенов.

Где происходит выбор модели

Модель не подключается как отдельный внешний сервис. В сценарий добавляется блок AI-изображение, а внутри его настроек выбирается один из трёх уровней качества. Текущую модель для уровня назначает LEADTEX.

Вся ветка выглядит так:

Ввод пользователя → проверка данных → блок AI-изображение → изображение в чате → следующее действие или запасная ветка.

Например, в боте интернет-магазина пользователь выбирает товар и загружает свою фотографию. Блок AI-изображение показывает, как товар может выглядеть на человеке. После виртуальной примерки пользователь может выбрать другой вариант, повторить генерацию или перейти к покупке.

При сравнении нельзя смотреть только на картинку. Нужно пройти всю ветку: убедиться, что запрос дошёл до блока с заполненными переменными, изображение появилось в нужном мессенджере, пользователь понял следующий шаг, а при сбое сработал запасной маршрут. Отдельно фиксируется расход токенов на вариант, который действительно прошёл приёмку. Именно поэтому это сравнение моделей внутри сценария бота, а не общий рейтинг генераторов изображений.

Как подготовить честное сравнение в сценарии

Сделайте три копии одной тестовой ветки. Оставьте одинаковыми текст инструкции, значения переменных, исходную фотографию, формат изображения, сообщение ожидания и оба выхода из блока. Меняется только уровень качества: в первой копии — Стандартное, во второй — Оптимальное, в третьей — Высокое.

Если вместе с моделью поменять промпт, исходник или формат, сравнение потеряет смысл. Вы уже не поймёте, почему изменился результат.

Запускайте тест из того же канала, в котором будет работать реальный бот. Проверка только внутри кабинета не показывает, как изображение выглядит у клиента и насколько понятен следующий шаг сценария.

Какие задачи прогнать через три ветки

Не нужно собирать искусственный тест на десятки промптов. Возьмите две-три задачи, которые действительно встретятся пользователю вашего бота. Например, интернет-магазин может проверить карточку товара, персональную открытку и обработку присланной фотографии. Для каждой задачи заранее определите вход, ожидаемый результат и ошибку, после которой картинку нельзя показывать клиенту.

Задача в сценарии Что подаёт пользователь Что должен вернуть бот Критическая ошибка
Виртуальная примерка товара Выбранный товар, фотография пользователя, поза или пожелание к образу Пользователь видит выбранный товар на своей фотографии и может перейти к покупке или новой примерке Искажены черты человека, форма, цвет или заметные детали товара
Пользовательский вариант в коммерческом генераторе Задача, пожелание к стилю и параметры выбранного пакета Изображение, соответствующее оплаченным условиям и пригодное для сохранения или следующей покупки Результат не проходит заявленные критерии и требует исправления вместо нового варианта
Изменение фотографии Исходное фото и список правок Отредактированный вариант с сохранением важных деталей Изменились лицо, логотип, форма товара или другой защищённый элемент
Обложка или пост Тема, формат, место под текст Изображение, которое помещается в целевой шаблон Важная область обрезается после публикации

Перед запуском зафиксируйте критерии словами. Формулировка «выглядит хорошо» не подходит: два человека оценят её по-разному. Рабочий критерий звучит конкретно: «название не искажено», «товар узнаваем», «фон заменён, но форма объекта сохранена», «лицо не обрезано», «после изображения видна кнопка продолжения».

Сколько генераций сделать

Одна удачная картинка ничего не доказывает. Модель может хорошо выполнить первую попытку и ошибиться на следующих.

Для первого сравнения сделайте хотя бы по три генерации на каждом уровне с одинаковыми входными данными. В журнале теста достаточно одной строки на попытку: уровень и модель, результат проверки, причина отклонения, потраченные токены и действие пользователя после изображения. Такой журнал не даст выбрать победителя по одной удачной картинке и покажет, где повторяется одна и та же ошибка.

Модель Уровень Дата теста Попытки (приняты/всего) Доля приёмки Медианное время генерации Токены на принятый результат Типовые ошибки
Nano Banana 2 Стандартное / 3
Nano Banana Pro Оптимальное / 3
GPT Image 2 Высокое / 3

«Токены на принятый результат» — это токены всех попыток на уровне, делённые на число попыток, прошедших критерии приёмки, а не токены одной генерации.

Как выбрать уровень для рабочей ветки

После теста не ищите модель с самой красивой отдельной картинкой. Критерий выбора зависит от того, какую роль генерация играет в проекте.

Если изображение помогает решить основную бизнес-задачу — показать товар, подготовить макет или обработать фото клиента, — выбирайте минимальный уровень, который стабильно проходит обязательные критерии сценария. Когда Стандартное качество даёт пригодный результат, а пользователь без проблем продолжает ветку, переход на следующий уровень нужно обосновать. Если важная деталь регулярно искажается, повторите тот же тест на Оптимальном, затем на Высоком.

У коммерческого генератора логика другая. Если сама генерация является платным продуктом, качество влияет на готовность пользователя купить ещё один вариант и вернуться в бот. Более дорогой уровень может оказаться выгоднее, когда он снижает долю исправлений и увеличивает число повторных покупок. Поэтому сравнивайте не только токены на одну попытку, но и маржу с оплаченного результата, долю повторных покупок и количество генераций, которые пришлось компенсировать из-за брака.

Для внутреннего сценария считайте не стоимость одной генерации, а стоимость принятого результата:

Токены всех успешных попыток / количество изображений, прошедших критерии.

Если из трёх генераций подходит одна, одна «дешёвая» попытка не делает ветку выгодной. Пользователь тратит время на исправления, а основной сценарий чаще остаётся незавершённым.

В коммерческом проекте дополнительно смотрите на маржу с оплаченного результата и долю пользователей, которые покупают следующую генерацию. Более дорогая модель может оказаться выгоднее, если после неё реже требуют переделку и чаще заказывают новый вариант. Но большое число повторов само по себе ещё не доказывает успех: нужно отделять добровольную покупку следующего изображения от попытки исправить некачественный результат.

Что делать после генерации: зависит от модели проекта

Выбранная модель не исправит слабый сценарий вокруг блока. После изображения у пользователя должно быть понятное действие, но одинакового финала для всех проектов нет.

Во внутреннем бизнес-сценарии изображение помогает перейти к основному действию: согласовать карточку, выбрать оформление, отправить заявку или продолжить заказ. Здесь уместны варианты «Подходит», «Изменить описание» и «Передать менеджеру». Повторы стоит ограничивать не ради запрета как такового, а чтобы ветка не подменяла собой цель бизнеса и не тратила токены на бесконечное исправление одного результата.

В коммерческом генераторе кнопка «Создать ещё» может быть главным продолжением сценария. Пользователь покупает не переход к менеджеру, а новые варианты, поэтому высокий объём генераций здесь выгоден. Вместо произвольного ограничения нужны понятные коммерческие правила: сколько генераций входит в оплату или пакет, когда предлагается следующая покупка и что происходит с неиспользованным остатком. После результата сценарий может вести к новой генерации, покупке пакета, повышению качества или сохранению готового изображения.

При этом важно различать новый творческий вариант и исправление брака. Если пользователь получил подходящее изображение и хочет ещё одно — это нормальное повторное потребление продукта. Если он повторяет запрос из-за искажённого текста, лица или товара, считать каждую попытку полноценной продажей опасно: выручка растёт на бумаге, а доверие и вероятность следующей покупки падают. Такие причины нужно отдельно отмечать в аналитике и учитывать в правилах компенсации или бесплатного повтора.

Запасную ветку тоже нужно проверить на всех трёх копиях сценария. Если исходная фотография недоступна, инструкция пуста или генерация не завершилась, бот должен объяснить следующий шаг обычным языком: прислать фото заново, дополнить описание, повторить позже или обратиться к сотруднику.

Формат изображения проверяйте в конечном канале

Квадратная, вертикальная или горизонтальная ориентация выбирается в блоке отдельно от уровня качества. Но для сценария важна не настройка сама по себе, а то, что увидит клиент.

Отправьте результат в тот мессенджер, где работает бот. На телефоне проверьте, не обрезаны ли товар или лицо, читается ли важная часть изображения и видна ли следующая кнопка. Затем откройте файл там, куда он попадёт после диалога: в рекламном шаблоне, карточке товара или публикации.

Если изображение затем попадает в рекламный шаблон, карточку товара или пост, проверьте и это размещение. Результат может хорошо выглядеть в чате и не помещаться в конечный макет.

Когда повторять тест

Тест нужно повторить, когда бот начинает решать другую визуальную задачу, меняются инструкция или переменные, появляется новый тип исходных фотографий либо меняется формат конечной публикации. Ещё один сигнал — рост повторных генераций. Также вернитесь к контрольной серии, если LEADTEX изменит модель, закреплённую за уровнем качества.

Сохранённая контрольная серия позволяет повторить тест без спора «раньше было лучше». Вы используете тот же вход, те же критерии и сравниваете результат внутри того же пользовательского маршрута.

Точные настройки блока и актуальное соответствие уровней моделям проверяйте в справке LEADTEX по AI-изображению.

Проверить нейросети для генерации изображений на LEADTEX

Частые вопросы

Где в сценарии выбирается Nano Banana 2, Nano Banana Pro или GPT Image 2?

В настройках блока AI-изображение выбирается уровень качества: «Стандартное», «Оптимальное» или «Высокое». На текущий момент этим уровням соответствуют Nano Banana 2, Nano Banana Pro и GPT Image 2.

Нужно ли создавать три разных бота для сравнения?

Нет. Достаточно сделать три копии одной тестовой ветки внутри проекта. В них должны совпадать инструкция, переменные, исходное изображение, формат и следующий шаг. Меняется только уровень качества блока.

Как понять, что модель подходит для рабочего сценария?

Для внутреннего бизнес-сценария модель должна стабильно проходить обязательные критерии, отправлять результат в целевой канал и не мешать пользователю продолжить ветку. Для коммерческого генератора дополнительно сравнивайте маржу, повторные покупки и долю генераций, которыми пользователь остался доволен.

Нужно ли ограничивать количество генераций в платном боте?

Не обязательно. Если генерация — самостоятельный продукт, повторные покупки выгодны проекту. Ограничивать следует не спрос, а неоплаченный расход и бесконечные попытки исправить брак. Заранее определите объём пакета, условия следующей покупки и правило компенсации при технической ошибке или явно непригодном результате.

Почему нельзя выбрать модель по одному удачному изображению?

Генеративный результат меняется между попытками. Серия одинаковых запусков показывает стабильность и помогает заметить повторяющиеся ошибки, которые одна картинка скрывает.

Данные актуальны на Q3 2026

7 дней использования всего функционала LEADTEX за 0 рублей Попробовать бесплатно