Промпт для генерации изображений в Gemini — это связное описание кадра: что изображено, где, при каком свете, с какого ракурса и для чего картинка нужна. Генерацию и редактирование изображений в Gemini выполняет семейство моделей Nano Banana, и Google в документации по генерации изображений делит рабочие промпты на 14 сценариев: семь для создания картинки с нуля и семь для правки загруженного изображения. Ниже — по одному шаблону на каждый сценарий. Шаблоны написаны по-русски по структуре английских шаблонов Google: замените текст в квадратных скобках своим и отправляйте.
Писать по-русски можно: по состоянию на 1 октября 2026 года русский (ru-RU) входит в список языков, для которых Google обещает лучшее качество работы моделей, наравне с английским. Переводить промпт на английский ради результата не обязательно.
Три вещи текстом не решаются: размер картинки в пикселях, соотношение сторон по умолчанию и точное число изображений в ответе. Их задают параметры запроса и выбор модели — об этом отдельный раздел с таблицей.
Шаблоны для генерации изображения с нуля
Общий принцип у всех семи шаблонов один: модель лучше понимает описание сцены обычными предложениями, чем список ключевых слов через запятую. Google Cloud в своей документации советует начинать запрос со слов «Создай изображение…» или «Сгенерируй изображение…» — иначе мультимодальная модель может ответить текстом, а не картинкой.
1. Фотореалистичная сцена
hljs textСоздай фотореалистичный [тип кадра: крупный план / общий план / портрет]: [объект с деталями] в [место и обстановка]. [Свет: источник, характер, время суток]. Снято [ракурс] на [объектив]. [Формат кадра].
Пример:
hljs textСоздай фотореалистичный крупный план: пожилой гончар с глиной на руках рассматривает только что обожжённую чашку в своей мастерской, за его спиной полки с посудой. Мягкий тёплый свет из окна слева, ранний вечер. Снято на уровне глаз на портретный объектив 85 мм, фон размыт. Вертикальный кадр 3:4.
Чем конкретнее заполнены поля света и объектива, тем меньше модель додумывает сама.
2. Иллюстрация и стикер
hljs textСоздай стикер в стиле [стиль]: [персонаж с деталями: одежда, аксессуары] [что делает]. [Линии и заливка: толстый контур, плоские цвета, сел-шейдинг]. Палитра: [цвета]. Фон: [белый / однотонный].
Пример:
hljs textСоздай стикер в стиле кавайи: рыжий корги в вязаном шарфе держит лапами кружку какао. Толстый ровный контур, простая заливка с лёгкой тенью. Палитра: тёплая, оранжевый и кремовый. Фон: белый.
Фон пишите прямо: если он нужен белым, так и скажите — по умолчанию модель может дорисовать окружение.
3. Изображение с точным текстом
hljs textСоздай [тип: логотип / афишу / открытку / этикетку] для [бренд или повод] с текстом «[точный текст]». Шрифт: [описание словами: жирный рубленый / с засечками / рукописный]. Стиль: [описание]. Цвета: [палитра]. Расположение текста: [где].
Пример:
hljs textСоздай современный минималистичный логотип для кофейни с текстом «Зерно и пар». Шрифт: чистый жирный рубленый. Стиль: логотип вписан в круг, в букве «о» обыграно кофейное зерно. Цвета: чёрный и белый. Расположение текста: по центру круга.
Текст берите в кавычки и давайте в окончательном виде. В перечне известных особенностей Google отмечает: Gemini лучше справляется, если сначала попросить его написать сам текст, а следующим сообщением — картинку с этим текстом. Для макетов, которые пойдут в печать или рекламу, Google рекомендует Nano Banana Pro.
4. Предметная съёмка товара
hljs textСоздай студийную предметную фотографию высокого разрешения: [товар: материал, цвет, форма] на [поверхность или фон]. Свет: [схема, например три софтбокса], чтобы [задача света]. Ракурс: [угол], чтобы показать [особенность товара]. Ультрареалистично, резкость на [ключевая деталь]. [Формат кадра].
Пример:
hljs textСоздай студийную предметную фотографию высокого разрешения: наручные часы со стальным корпусом и тёмно-синим циферблатом на плите тёмного сланца. Свет: три софтбокса, чтобы дать мягкие блики на стали и убрать резкие тени. Ракурс: чуть сверху, под углом 45 градусов, чтобы показать профиль корпуса и заводную головку. Ультрареалистично, резкость на циферблате. Квадратный кадр.
5. Минимализм и место под текст
hljs textСоздай минималистичную композицию: один [объект] в [правом нижнем / левом верхнем] углу кадра. Фон — большое пустое поле цвета [цвет], много свободного места под текст. Мягкий рассеянный свет [откуда]. [Формат кадра].
Этот шаблон — для фона слайда, баннера или обложки, поверх которых позже ляжет текст. Пример заполнения: «одна веточка лаванды в правом нижнем углу», «поле цвета топлёного молока», «свет сверху слева», «горизонтальный кадр 16:9».
6. Комикс и раскадровка
hljs textСделай комикс из [число] кадров в стиле [стиль: линии, тушь, цвет]. Герой: [описание или «персонаж с загруженного изображения»]. Кадр 1: [что происходит]. Кадр 2: [что происходит]. Кадр 3: [что происходит]. Реплики: «[текст]».
По документации Google, с текстом в кадрах и связным сюжетом лучше справляются Nano Banana Pro и Nano Banana 2. Чтобы герой был одним и тем же во всех кадрах, приложите его изображение.
7. Картинка по актуальным данным из Google Поиска
hljs textНайди [актуальные данные: прогноз погоды на пять дней в городе N / итог вчерашнего матча] и сделай [тип графики: инфографика, карточка, схема] в стиле [стиль]. Покажи [какие показатели]. [Формат кадра].
Шаблон работает только при включённом инструменте «Google Поиск» (Grounding with Google Search): в API это tools=[{"type": "google_search"}]. Nano Banana 2 Lite этот инструмент не поддерживает.
Шаблоны для редактирования загруженного изображения
При правке главное — назвать, что именно меняется, и отдельно сказать, что остаётся как есть. Загружайте только те изображения, на которые у вас есть права: создание контента, который нарушает чужие права, вводит в заблуждение или причиняет вред, запрещено правилами Google.
8. Добавить или убрать элемент
hljs textНа загруженном изображении [что на нём] [добавь / убери / измени] [элемент]. Изменение должно [как вписаться: совпадать по свету, тени и перспективе].
Пример:
hljs textНа загруженном фото гостиной добавь на подоконник глиняный горшок с монстерой. Растение должно отбрасывать тень в ту же сторону, что и остальные предметы, и быть освещено дневным светом из окна.
9. Точечная замена одной детали
hljs textНа загруженном изображении измени только [конкретный элемент] на [новый элемент или описание]. Всё остальное оставь в точности как есть: стиль, свет и композицию.
Google называет этот приём смысловой маской (inpainting, semantic masking): область правки задаётся словами, без выделения кистью. Пример: «измени только цвет стены за диваном с белого на серо-зелёный; диван, подушки, торшер и свет в комнате оставь без изменений».
10. Перенос стиля
hljs textПреобразуй загруженную фотографию [что на ней] в стиль [художественное направление]. Сохрани исходную композицию, но передай всё через [приёмы стиля: мазки, линии, палитра].
Пример: «Преобразуй загруженную фотографию ночной городской улицы в стиль акварельного скетча. Сохрани расположение домов и машин, но передай всё через прозрачные размывки, тонкий тушевой контур и палитру из синего и охры».
11. Сборка из нескольких изображений
hljs textСоздай новое изображение из загруженных. Возьми [элемент с первого изображения] и помести [на / рядом с] [элемент со второго изображения]. Итог: [описание финальной сцены, свет, ракурс].
Пример:
hljs textСоздай новое изображение из загруженных. Возьми настольную лампу с первого изображения и поставь её на прикроватную тумбу со второго. Итог: реалистичная интерьерная фотография спальни вечером, лампа включена, свет и тени согласованы с остальной комнатой.
Называйте изображения по порядку («с первого», «со второго») — так модели проще понять, что откуда брать.
12. Правка с сохранением важных деталей
hljs textИспользуя загруженные изображения, помести [элемент со второго изображения] на [элемент с первого]. [Что нельзя менять: подробное описание формы, цвета, надписей] должно остаться без изменений. Добавленный элемент должен [как вписаться].
Пример:
hljs textИспользуя загруженные изображения, помести логотип со второго изображения на крышку коробки с первого. Сама коробка — белая картонная, квадратная, с тиснёной каймой по краю — должна остаться без изменений. Логотип должен выглядеть напечатанным на картоне и повторять лёгкий наклон крышки.
Чем подробнее описана деталь, которую нужно сохранить (лицо, логотип, упаковка), тем меньше шансов, что она изменится при правке.
13. Из наброска в готовую картинку
hljs textПреврати этот [карандашный / маркерный] набросок [объект] в [стиль] [фотографию / иллюстрацию]. Сохрани [черты из наброска: силуэт, пропорции], добавь [материалы, цвет, детали].
Пример: «Преврати этот карандашный набросок кресла в студийную фотографию готовой мебели. Сохрани низкую посадку и изогнутые подлокотники, добавь обивку из горчичного букле и ножки из светлого дуба».
14. Один персонаж с разных ракурсов
hljs textСтудийный портрет [персонаж с загруженного изображения] на [фон], [анфас / в профиль, взгляд вправо / три четверти слева].
Пример: «Студийный портрет этого лисёнка-маскота на белом фоне, в профиль, взгляд вправо». Ракурсы запрашивают по одному, и к каждому следующему запросу прикладывают уже полученные изображения — так, по документации Google, персонаж остаётся узнаваемым. Для сложной позы добавьте изображение-референс с этой позой.
Если хочется сначала увидеть результат, а потом копировать текст, в библиотеке промптов YingTu у каждого готового промпта есть реальный пример изображения и цена за картинку.
Чего промпт не задаёт и что задаёт это вместо него
Слова «4K», «ультравысокое разрешение» или «сделай четыре варианта» влияют на содержание и детализацию описания, но не на технические свойства файла. По документации Gemini API по состоянию на 1 октября 2026 года:
| Что хочется задать | Что происходит, если написать это в промпте | Что задаёт на самом деле |
|---|---|---|
| Размер в пикселях (2K, 4K) | Размер не меняется: по умолчанию модель отдаёт 1K | Поле image_size в response_format: "1K", "2K", "4K" с заглавной K; значение 1k API отклонит |
| Доступные размеры | — | Модель: Nano Banana 2 Lite — только 1K; Nano Banana 2 — 512 px, 1K, 2K, 4K; Nano Banana Pro — 1K, 2K, 4K |
| Соотношение сторон | Без параметра кадр повторяет размер загруженного изображения, а при генерации с нуля выходит квадратным 1:1 | Поле aspect_ratio, например "16:9" |
| Точное число изображений | Модель не всегда выдаёт ровно столько, сколько указано в тексте | Отдельный запрос на каждое изображение |
| Сколько референсов учесть | Число изображений, которые модель воспроизводит с высокой точностью, ограничено | Лимит модели — см. следующую таблицу |
| Только картинка, без текста в ответе | По умолчанию модель возвращает и текст, и изображение | response_format с "type": "image" |
Для ориентира: кадр 16:9 у Nano Banana 2 — это 1376×768 в 1K, 2752×1536 в 2K и 5504×3072 в 4K. В примерах самого Google формат иногда дописан словами в конце промпта («Aspect ratio 16:9», «Square image»), так что в чате формат кадра стоит указывать текстом; в API надёжнее поле aspect_ratio.
Лимиты на изображения-референсы (всего до 14 в одном запросе, по состоянию на 1 октября 2026 года):
| Модель | Объекты с высокой точностью | Персонажи, которых нужно сохранить | Референсы стиля |
|---|---|---|---|
| Nano Banana 2 Lite | до 14 | не предусмотрено | не предусмотрено |
| Nano Banana 2 | до 10 | до 4 | не предусмотрено |
| Nano Banana Pro | до 6 | до 5 | до 3 |
Nano Banana 2 Lite, по описанию Google, не оптимизирована для нескольких референсов и последовательной правки в диалоге — для шаблонов 11, 12 и 14 берите Nano Banana 2 или Pro. Звук на вход модели не принимают, видео — только Nano Banana 2 и 2 Lite. Все сгенерированные изображения содержат водяной знак SynthID.
Шесть приёмов, которые Google советует для любого промпта
- Будьте предельно конкретны. Не «фэнтезийные доспехи», а «эльфийские латы с гравировкой в виде серебряных листьев, высоким воротом и наплечниками в форме соколиных крыльев».
- Объясняйте назначение. «Создай логотип для дорогого минималистичного бренда уходовой косметики» даёт больше, чем «создай логотип»: контекст влияет на результат.
- Правьте в диалоге мелкими шагами. Вместо нового промпта с нуля — «оставь всё как есть, но сделай свет теплее». Google называет многоходовый диалог рекомендуемым способом доводить картинку.
- Сложную сцену давайте по шагам. «Сначала создай фон: туманный лес на рассвете. Затем на переднем плане — замшелый каменный алтарь. В конце положи на алтарь светящийся меч».
- Описывайте сцену утвердительно, а не через «без». Вместо «без машин» — «пустая безлюдная улица без признаков движения». Список запретов работает хуже описания того, что должно быть в кадре.
- Управляйте камерой. Термины съёмки — широкоугольный кадр, макро, съёмка с нижней точки — задают композицию точнее, чем «красиво» и «эффектно».
Картинка получилась не такой: что менять первым
| Что не так | Что поменять в первую очередь |
|---|---|
| Модель ответила текстом, а не изображением | Начните с «Создай изображение…»; в API укажите response_format с "type": "image" |
| В кадре появилось то, что вы просили убрать | Перепишите запрет в описание: что на этом месте должно быть |
| В надписи ошибки или лишние буквы | Сначала получите текст отдельным сообщением, затем попросите картинку с ним; текст в кавычках; для чистовых макетов — Nano Banana Pro |
| При правке изменилась вся картинка | Формула из шаблона 9: «измени только…, всё остальное оставь в точности как есть» |
| Изменилось лицо, логотип или упаковка | Подробно опишите эту деталь словами (шаблон 12) и проверьте лимит референсов для модели |
| Персонаж от кадра к кадру разный | Прикладывайте предыдущие результаты к следующему запросу; работайте в одном диалоге; не используйте для этого Nano Banana 2 Lite |
| Композиция не та | Добавьте тип кадра, ракурс и объектив |
| Не тот размер или формат | Это не промпт: image_size и aspect_ratio |
| Изображений больше или меньше, чем просили | Запрашивайте по одному изображению за раз |
Менять стоит одну вещь за раз: если переписать промпт целиком, не будет понятно, что именно сработало.
Какую модель выбрать и сколько стоит одно изображение
Google советует по умолчанию использовать Nano Banana 2 — универсальную модель с выводом до 4K, надёжной отрисовкой текста и хорошей работой с несколькими референсами. Nano Banana 2 Lite — самая быстрая и дешёвая, для простых картинок в 1K. Nano Banana Pro — для профессиональных макетов и сложных инструкций, где важны точность текста и единообразие бренда.
Цены Gemini API за одно изображение по странице цен Google, по состоянию на 1 октября 2026 года:
| Модель и размер | Обычный запрос (Standard) | Пакетный режим (Batch) |
|---|---|---|
| Nano Banana 2 Lite, 1K | $0,0336 | $0,0168 |
| Nano Banana 2, 512 px | $0,045 | $0,022 |
| Nano Banana 2, 1K | $0,067 | $0,034 |
| Nano Banana 2, 2K | $0,101 | $0,050 |
| Nano Banana 2, 4K | $0,151 | $0,076 |
| Nano Banana Pro, 1K или 2K | $0,134 | $0,067 |
| Nano Banana Pro, 4K | $0,24 | $0,12 |
Бесплатного уровня у этих моделей в API нет — подробнее в материале «Бесплатные лимиты Gemini API: модели, квоты и ошибка 429». Пакетный режим примерно вдвое дешевле, но результат приходит в срок до 24 часов. Модели Gemini 3 «думают» перед генерацией, отключить это нельзя, и токены размышления тоже оплачиваются.
Веб-приложение Gemini в России официально недоступно; версии модели и места, где они работают, разобраны в материале «Nano Banana: что это за нейросеть Google и как ей пользоваться». Тем, кто не хочет заводить проект в Google Cloud, подойдёт запуск в YingTu со своим ключом LaoZhang API: по состоянию на 26 сентября 2026 года это $0,055 за изображение для Nano Banana 2 и $0,09 для Nano Banana Pro. Запросы при этом идут через API LaoZhang, а не через приложение Gemini от Google. Размеры и пример запроса — на странице Nano Banana 2 в YingTu и на странице Nano Banana Pro.
Как передать промпт через Gemini API
Ниже — форма запроса из документации Google для Interactions API на Python. Промпт идёт в input, а размер и формат — отдельно, в response_format:
hljs pythonfrom google import genai
import base64
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.1-flash-image",
input=(
"Создай студийную предметную фотографию высокого разрешения: "
"наручные часы со стальным корпусом и тёмно-синим циферблатом "
"на плите тёмного сланца. Свет: три софтбокса. Резкость на циферблате."
),
response_format={
"type": "image",
"aspect_ratio": "16:9",
"image_size": "2K",
},
)
with open("watch.png", "wb") as f:
f.write(base64.b64decode(interaction.output_image.data))
Для правки загруженного изображения input становится списком: текст и картинка в base64.
hljs pythonwith open("room.png", "rb") as f:
image_bytes = f.read()
interaction = client.interactions.create(
model="gemini-3.1-flash-image",
input=[
{"type": "text", "text": "На загруженном изображении измени только цвет стены за диваном на серо-зелёный. Всё остальное оставь в точности как есть."},
{"type": "image", "data": base64.b64encode(image_bytes).decode("utf-8"), "mime_type": "image/png"},
],
)
Следующую правку той же картинки отправляют с previous_interaction_id=interaction.id — так модель продолжает диалог, а не начинает заново.
Идентификаторы моделей: gemini-3.1-flash-lite-image (Nano Banana 2 Lite), gemini-3.1-flash-image (Nano Banana 2), gemini-3-pro-image (Nano Banana Pro). У исходной gemini-2.5-flash-image на странице цен Google стоит пометка Deprecated и дата отключения — 2 октября 2026 года. Код, в котором остался этот идентификатор, нужно перевести на один из трёх актуальных; Google рекомендует для такой замены Nano Banana 2 Lite. Уровень размышления у Nano Banana 2 и 2 Lite настраивается параметром thinking_level: minimal (по умолчанию) или high.
Лимиты запросов в API считаются на проект. Если при массовой генерации приходит 429, порядок действий описан в материале «Ошибка 429 RESOURCE_EXHAUSTED в Gemini API: RPM, TPM и RPD».
Частые вопросы
Промпты для Gemini лучше писать на русском или на английском?
Можно на русском. В документации Gemini API русский (ru-RU) стоит в списке языков, для которых Google заявляет лучшее качество работы моделей изображений, вместе с английским, немецким, испанским, японским и ещё десятью языками (по состоянию на 1 октября 2026 года). Сравнения качества между языками из этого списка в документации нет.
Почему картинка не в 4K, хотя в промпте написано «4K»?
Потому что размер задаёт не текст, а параметр image_size: без него модели Gemini 3 отдают 1K. В API укажите "image_size": "4K" с заглавной K и выберите Nano Banana 2 или Pro — Nano Banana 2 Lite выводит только 1K.
Как получить одного и того же персонажа на нескольких картинках?
Приложите изображение персонажа и запрашивайте новые кадры по одному, каждый раз добавляя к запросу уже полученные результаты. Nano Banana 2 удерживает до 4 персонажей, Nano Banana Pro — до 5 (по состоянию на 1 октября 2026 года); Nano Banana 2 Lite для этой задачи не предназначена.
Как добиться, чтобы надпись на картинке была без ошибок?
Сначала попросите Gemini написать сам текст и утвердите его, затем отдельным сообщением попросите изображение с этим текстом — так советует Google. В промпте дайте надпись в кавычках, опишите шрифт словами и укажите, где текст расположен; для чистовых макетов выбирайте Nano Banana Pro.



