Что произошло
Google DeepMind анонсировала модель генерации изображений Nano Banana 2 Lite — упрощённую версию флагманской модели, которая создаёт картинки за четыре секунды. Одновременно компания открыла доступ к Gemini Omni Flash для разработчиков. Оба инструмента уже встроены в экосистему Google: Gemini-приложение, Google Search и рекламную платформу. Модель построена на архитектуре Gemini 3.1 Flash Image — это мультимодальная языковая модель Gemini, которая работает и с текстом, и с картинками одновременно.
Как работает Nano Banana 2 Lite
Lite-версия сочетает возможности старшей модели с рекордной скоростью: вместо десятков секунд картинка готова за четыре. Это принципиально меняет рабочий процесс — дизайнер делает запрос, и пока проговаривает правку вслух, результат уже на экране. Для рекламных кампаний это означает возможность перебрать десятки вариантов за минуты, а не за часы. Для интерфейсных прототипов — мгновенно визуализировать идею и показать заказчику.
Текст в изображениях (text rendering) в новой модели отрисовывается посимвольно: надписи в рекламных баннерах и интерфейсах больше не «ломаются», как было с предыдущими версиями. Это важно для e-commerce, где в картинках нужны цены, названия товаров и призывы к действию. Предыдущие модели генерации изображений часто добавляли лишние символы или искажали буквы — Nano Banana 2 Lite решает эту проблему.
Что умеет модель
Nano Banana 2 Lite поддерживает натуральное редактирование: пользователь описывает правки текстом, и модель вносит изменения в существующее изображение без полной перегенерации. Представьте, что вы сгенерировали баннер с девушкой в красном платье, а потом захотели поменять цвет платья на синий — не нужно заново описывать всю сцену, достаточно сказать «сделай платье синим». Модель также поддерживает вывод в разрешениях до 4K и работу с несколькими референсными изображениями одновременно.
Консистентность персонажей (character consistency) — ещё одна ключевая функция: до пяти человек в кадре сохраняют одинаковую внешность при генерации серии картинок. Это критически важно для рекламных кампаний, где один герой должен появляться в разных сценах. Раньше каждая генерация создавала нового человека — теперь герой узнаваем.
Почему это важно для рынка
Четыре секунды — это уровень, при котором генерация перестаёт ощущаться как ожидание. Конкуренты на рынке генеративных моделей для изображений — Midjourney, DALL-E, Stable Diffusion — работают значительно дольше. Если Google удастся встроить Nano Banana 2 Lite в массовые продукты, это может изменить ожидания пользователей по скорости повсеместно. Подробнее о видеогенерации от Google и темпах развёртывания AI-моделей в массы.
Что дальше
Nano Banana 2 Lite и Gemini Omni Flash разворачиваются поэтапно. Разработчики уже получили API-доступ через платформу Google AI. Для обычных пользователей модель работает в веб-интерфейсе Gemini и через Google Search. Полный коммерческий эффект станет понятен после завершения развёртывания — примерно к концу июля 2026 года. Конкуренты, вероятно, начнут сокращать время генерации в ответ.
Чем Nano Banana 2 Lite отличается от конкурентов
Основное преимущество — скорость в сочетании с качеством. Midjourney и DALL-E требуют от 10 до 60 секунд на генерацию. Stable Diffusion при локальной работе на хорошей видеокарте даёт результат за 3-8 секунд, но качество ниже и требуется мощное оборудование. Nano Banana 2 Lite работает из облака за четыре секунды и при этом даёт качество флагманской модели. Для пользователя это означает: не нужно покупать дорогую видеокарту, не нужно ждать, не нужно мириться с низким качеством. Подробнее о мультимодальных возможностях Gemini.