Генерация изображений в Gemini (Nano Banana / Pro) — это процесс создания визуального контента с помощью нейросетей Google, который позволяет получать фотореалистичные снимки, логотипы и инфографику по текстовому описанию, используя ресурсы от 2 до 1000 генераций в сутки в зависимости от тарифа.
Знаете, еще пару лет назад мы смеялись над тем, как нейросети рисуют руки. Семь пальцев, две ладони на одной кисти — классика жанра. Сейчас, когда Google выкатил обновление до моделей Nano Banana и Banana Pro, смеяться перестали даже скептики. Теперь проблема не в качестве картинки, а в том, что мы банально не умеем объяснять машине, чего хотим. Вы пишете «красивая девушка», а получаете пластиковую куклу из 2005-го. Пишете «схема работы двигателя», а получаете абстрактный импрессионизм.
Я потестировал Gemini в хвост и в гриву, сжег пару тысяч лимитов и готов рассказать, как на самом деле работает эта штука в 2025–2026 годах. Без маркетинговой шелухи, только цифры, промты и суровая правда о блокировках.
Разбираемся в сортах бананов: какую модель выбрать
Прежде чем писать промт, надо понять, кто будет его исполнять. Google сейчас предлагает два основных движка для генерации. Это не просто «быстро» и «медленно», это разные инструменты для разных задач.
| Характеристика | Nano Banana (Gemini 2.5 Flash Image) | Nano Banana Pro (Gemini 3 Pro Image) |
|---|---|---|
| Главная фишка | Скорость. Выдает результат почти мгновенно. | Интеллект. Сначала «думает» (thinking process), потом рисует. |
| Идеально для | Черновиков, быстрых скетчей, поиска композиции, мемов. | Финальных рендеров, сложного текста, инфографики, фотореализма. |
| Детализация | Средняя. Может «мылить» задний план. | Высокая (8k). Прорисовывает поры на коже и пыль в воздухе. |
| Работа с текстом | Часто ошибается в надписях. | Рендерит текст почти без ошибок (если указать шрифт). |
Сейчас большинство селлеров и дизайнеров перешли на гибридную схему. Сначала мучаем «обычный банан» (Nano Banana), генерируя 10–20 вариантов композиции. Выбираем лучший, забираем оттуда сид (seed) или описание, и скармливаем его версии Pro для финальной полировки.
Сколько стоит и где лимиты (Gemini сколько запросов)
Самый больной вопрос: когда закончится халява? Google хитро манипулирует цифрами, называя лимиты «плавающими». Это значит, что во вторник утром вы можете сделать 50 картинок, а в пятницу вечером — только 5. Все зависит от нагрузки на их дата-центры.
Официальные цифры на 2025 год:
- Бесплатный тариф: От 2 до 100 изображений в сутки. Если серверы перегружены, краник перекрывают очень быстро.
- Тариф AI Pro / Advanced (~$20): До 1 000 изображений в сутки. Тут уже можно разгуляться и сделать полноценную нейрофотосессию товара.
- Время сброса (Reset Time): Лимиты обнуляются в полночь по Тихоокеанскому времени (Midnight PT). Для Москвы это примерно 11:00 или 12:00 дня (смотрите на зимнее/летнее время). То есть, если вы исчерпали лимит в 9 утра, ждать придется всего пару часов.
Важный нюанс по географии. Если вы сидите через европейский IP (Германия, Нидерланды и т.д.), функции генерации людей могут быть отключены. Виной тому — драконовский EU AI Act. Gemini просто скажет: «Я не могу нарисовать человека». Лечится это сменой локации на USA (США). Там свободы для творчества пока больше.
Анатомия идеального промта для Gemini
Gemini понимает естественный язык лучше, чем старые версии Midjourney. Ему не обязательно писать `::5` или сложные математические формулы. Но структура важна. Я использую формулу «Объект + Контекст + Стиль + Технические детали».
Если вам нужно генерировать много и качественно, но нет времени каждый раз изобретать велосипед, рекомендую заглянуть в мою библиотеку. Там я собираю рабочие шаблоны. Telegram-канал с промтами — это база, откуда можно просто копировать куски кода для генерации.
1. Фотореализм и люди (Промты для gemini женские / мужские)
Pro-модель отлично справляется с кожей, если попросить её не делать «пластику». Добавляйте слова про несовершенства.
Portrait of a 30-year-old astronaut woman, helmet off, intricate spacesuit details, standing on Mars surface during sunset, cinematic lighting, 8k resolution, shot on 35mm lens, depth of field, dust particles in the air, skin texture, slight imperfections.
2. Предметка и карточки товаров (Gemini сделать фото)
Для маркетплейсов сейчас работает тренд на «аккуратный хаос» или строгую геометрию.
Professional product photography of a glass perfume bottle with gold cap, surrounded by jasmine flowers and water splashes, podium, pastel blue background, soft studio lighting, high contrast, 4k, sharp focus.
3. Логотипы и векторы
Gemini Nano Banana часто используют для иконок, потому что она не перегружает картинку лишними деталями.
Minimalist vector logo of a fox, orange and white, flat design, white background, rounded corners, professional app icon style, simple shapes.
Секретные фишки Nano Banana: Стилевые коды
В документации для разработчиков (DeepMind Imagen 3 technical report) проскакивают интересные вещи. Оказывается, модель реагирует на специфические термины — триггеры стилей. Вместо того чтобы писать «сделай красиво», используйте профессиональный сленг.
- Paper Quilling Style — имитация скрученной бумаги. Выглядит объемно и дорого. Хорошо заходит для упаковки и рекламы эко-товаров.
- Knolling Photography — раскладка предметов под углом 90 градусов (флэтлей). Идеально для наборов: «что в моей сумке», комплектация гаджета, набор косметики.
- Isometric Vector Art — изометрия. Стандарт де-факто для IT-статей и презентаций.
Редактирование областей (Inpainting)
Многие не знают, но Gemini умеет править часть фото. Не нужно перегенерировать всё изображение, если у модели кривой галстук. Выделяете область и пишете промт только для нее: «Change the tie to a red bow tie».
Лайфхак: Если нейросеть тупит и рисует поверх старого галстука какую-то кашу, попробуйте сначала выделить объект и отправить пустой промт (или слово «remove»). Она сотрет объект, заполнив фон. А потом на чистом месте генерируйте новое.
Текст на изображении: наконец-то работает
Раньше генерация текста была болью. Сейчас Nano Banana Pro научилась писать. Главное правило: то, что должно быть написано, берем в кавычки. И обязательно указываем стиль шрифта, иначе получите Comic Sans.
A neon sign on a brick wall that says «OPEN 24/7» in bold pink letters, cyberpunk atmosphere, rain reflections, night city background.
По статистике, ошибок в тексте стало на 40% меньше благодаря этапу «рассуждения». Нейросеть сначала планирует: «Ага, слово OPEN состоит из 4 букв, мне нужно место вот здесь», и только потом рисует.
Что Gemini категорически не сделает (Safety Filters)
Google очень боится скандалов. Поэтому настройки безопасности (Safety Filters) здесь выкручены на максимум. Это может бесить, но правила есть правила.
- Реальные люди (Zero-Tolerance): Вы не сможете сгенерировать Илона Маска, Тейлор Свифт или Владимира Путина. Даже если напишете «мужчина, похожий на…». Система распознает паттерны лица известных личностей и заблокирует генерацию.
- Дипфейки: Загрузить фото соседа и попросить нейросеть поместить его в компрометирующую ситуацию не выйдет.
- Copyright: Персонажи Disney или Marvel часто проходят, но иногда фильтр ругается на нарушение авторских прав, если стиль слишком узнаваем.
Как сохранить персонажа (Character Consistency)
Боль менеджеров маркетплейсов: сделали классную модель, а на следующем кадре у неё другое лицо. В Gemini пока нет жесткой фиксации лица (как в Stable Diffusion через ControlNet), но можно выкрутиться.
Используйте метод «Якорей». Дайте персонажу уникальные, яркие приметы, за которые нейросети легко зацепиться.
Пример: «Женщина с короткими синими волосами и шрамом над левой бровью в зеленом шарфе».
Повторяйте это описание слово в слово в начале каждого промта. Зеленый шарф и синие волосы станут маркерами, которые помогут сохранить общие черты лица.
Заключение: Куда движется тренд
В 2025–2026 годах мы видим четкий тренд на «Ретро-эстетику». Глянцевые, идеальные картинки всем надоели. Сейчас в топе запросы вроде `flash photography, aesthetic of year 1999`. Зернистость, пересветы от вспышки в лоб — это то, что делает картинку «живой» и неотличимой от реального фото.
Если вы хотите быть в потоке и получать свежие идеи для генераций каждый день, не забывайте про мой Telegram-канал с промтами. Там я публикую готовые решения для Gemini, которые можно просто скопировать и вставить, экономя часы на экспериментах.
Частые вопросы
Почему Gemini говорит, что не может генерировать изображения людей?
Скорее всего, вы находитесь в регионе (ЕС или Великобритания), где действуют ограничения законодательства. Или же ваш промт нарушает правила безопасности (насилие, нагота, реальные знаменитости). Попробуйте сменить IP на США или упростить запрос.
Сколько бесплатных запросов в день доступно реально?
Гарантированного минимума нет. Обычно это около 15–20 изображений для свежего аккаунта. Если серверы Google перегружены, лимит может упасть до 1–2 картинок. Счетчик сбрасывается в 11–12 утра по Москве.
Можно ли использовать фото из Gemini в коммерческих целях?
Да, Google предоставляет коммерческие права на изображения, созданные в платных тарифах (Gemini Advanced). С бесплатными версиями ситуация сложнее и зависит от регионального законодательства, но, как правило, платформы не претендуют на копирайт сгенерированного вами контента.
Как сделать так, чтобы текст на картинке был правильным?
Используйте модель Nano Banana Pro (она же Gemini 3 Pro). Пишите нужный текст в кавычках (например, «SALE»). Чем короче слово, тем выше шанс успеха. Длинные фразы лучше разбивать или добавлять в фотошопе.
Где хранятся сгенерированные картинки?
В чате с ботом. Отдельной «галереи» внутри интерфейса Gemini часто нет (зависит от версии интерфейса). Поэтому рекомендую сразу скачивать удачные варианты, история чата может быть удалена или зачищена.

