Перейти к основному содержанию

Промпты для Gemini: 14 шаблонов для генерации изображений

Готовые промпты для Gemini на русском: 14 шаблонов для генерации и правки картинок в Nano Banana. Размер, формат и число кадров задаёт не текст, а параметры.

Yingtu AI Editorial
Yingtu AI Editorial
9 min
Промпты для Gemini: шаблон предметной съёмки с полями в квадратных скобках, 7 шаблонов для генерации с нуля и 7 для правки картинки
yingtu.ai

Содержание

Промпт для генерации изображений в Gemini — это связное описание кадра: что изображено, где, при каком свете, с какого ракурса и для чего картинка нужна. Генерацию и редактирование изображений в Gemini выполняет семейство моделей Nano Banana, и Google в документации по генерации изображений делит рабочие промпты на 14 сценариев: семь для создания картинки с нуля и семь для правки загруженного изображения. Ниже — по одному шаблону на каждый сценарий. Шаблоны написаны по-русски по структуре английских шаблонов Google: замените текст в квадратных скобках своим и отправляйте.

Писать по-русски можно: по состоянию на 1 октября 2026 года русский (ru-RU) входит в список языков, для которых Google обещает лучшее качество работы моделей, наравне с английским. Переводить промпт на английский ради результата не обязательно.

Три вещи текстом не решаются: размер картинки в пикселях, соотношение сторон по умолчанию и точное число изображений в ответе. Их задают параметры запроса и выбор модели — об этом отдельный раздел с таблицей.

Шаблоны для генерации изображения с нуля

Общий принцип у всех семи шаблонов один: модель лучше понимает описание сцены обычными предложениями, чем список ключевых слов через запятую. Google Cloud в своей документации советует начинать запрос со слов «Создай изображение…» или «Сгенерируй изображение…» — иначе мультимодальная модель может ответить текстом, а не картинкой.

1. Фотореалистичная сцена

hljs text
Создай фотореалистичный [тип кадра: крупный план / общий план / портрет]:
[объект с деталями] в [место и обстановка]. [Свет: источник, характер,
время суток]. Снято [ракурс] на [объектив]. [Формат кадра].

Пример:

hljs text
Создай фотореалистичный крупный план: пожилой гончар с глиной на руках
рассматривает только что обожжённую чашку в своей мастерской, за его спиной
полки с посудой. Мягкий тёплый свет из окна слева, ранний вечер. Снято
на уровне глаз на портретный объектив 85 мм, фон размыт. Вертикальный кадр 3:4.

Чем конкретнее заполнены поля света и объектива, тем меньше модель додумывает сама.

2. Иллюстрация и стикер

hljs text
Создай стикер в стиле [стиль]: [персонаж с деталями: одежда, аксессуары]
[что делает]. [Линии и заливка: толстый контур, плоские цвета, сел-шейдинг].
Палитра: [цвета]. Фон: [белый / однотонный].

Пример:

hljs text
Создай стикер в стиле кавайи: рыжий корги в вязаном шарфе держит лапами
кружку какао. Толстый ровный контур, простая заливка с лёгкой тенью.
Палитра: тёплая, оранжевый и кремовый. Фон: белый.

Фон пишите прямо: если он нужен белым, так и скажите — по умолчанию модель может дорисовать окружение.

3. Изображение с точным текстом

hljs text
Создай [тип: логотип / афишу / открытку / этикетку] для [бренд или повод]
с текстом «[точный текст]». Шрифт: [описание словами: жирный рубленый /
с засечками / рукописный]. Стиль: [описание]. Цвета: [палитра].
Расположение текста: [где].

Пример:

hljs text
Создай современный минималистичный логотип для кофейни с текстом
«Зерно и пар». Шрифт: чистый жирный рубленый. Стиль: логотип вписан в круг,
в букве «о» обыграно кофейное зерно. Цвета: чёрный и белый.
Расположение текста: по центру круга.

Текст берите в кавычки и давайте в окончательном виде. В перечне известных особенностей Google отмечает: Gemini лучше справляется, если сначала попросить его написать сам текст, а следующим сообщением — картинку с этим текстом. Для макетов, которые пойдут в печать или рекламу, Google рекомендует Nano Banana Pro.

4. Предметная съёмка товара

hljs text
Создай студийную предметную фотографию высокого разрешения: [товар:
материал, цвет, форма] на [поверхность или фон]. Свет: [схема, например
три софтбокса], чтобы [задача света]. Ракурс: [угол], чтобы показать
[особенность товара]. Ультрареалистично, резкость на [ключевая деталь].
[Формат кадра].

Пример:

hljs text
Создай студийную предметную фотографию высокого разрешения: наручные часы
со стальным корпусом и тёмно-синим циферблатом на плите тёмного сланца.
Свет: три софтбокса, чтобы дать мягкие блики на стали и убрать резкие тени.
Ракурс: чуть сверху, под углом 45 градусов, чтобы показать профиль корпуса
и заводную головку. Ультрареалистично, резкость на циферблате.
Квадратный кадр.

5. Минимализм и место под текст

hljs text
Создай минималистичную композицию: один [объект] в [правом нижнем /
левом верхнем] углу кадра. Фон — большое пустое поле цвета [цвет],
много свободного места под текст. Мягкий рассеянный свет [откуда].
[Формат кадра].

Этот шаблон — для фона слайда, баннера или обложки, поверх которых позже ляжет текст. Пример заполнения: «одна веточка лаванды в правом нижнем углу», «поле цвета топлёного молока», «свет сверху слева», «горизонтальный кадр 16:9».

6. Комикс и раскадровка

hljs text
Сделай комикс из [число] кадров в стиле [стиль: линии, тушь, цвет].
Герой: [описание или «персонаж с загруженного изображения»].
Кадр 1: [что происходит]. Кадр 2: [что происходит]. Кадр 3: [что происходит].
Реплики: «[текст]».

По документации Google, с текстом в кадрах и связным сюжетом лучше справляются Nano Banana Pro и Nano Banana 2. Чтобы герой был одним и тем же во всех кадрах, приложите его изображение.

7. Картинка по актуальным данным из Google Поиска

hljs text
Найди [актуальные данные: прогноз погоды на пять дней в городе N /
итог вчерашнего матча] и сделай [тип графики: инфографика, карточка, схема]
в стиле [стиль]. Покажи [какие показатели]. [Формат кадра].

Шаблон работает только при включённом инструменте «Google Поиск» (Grounding with Google Search): в API это tools=[{"type": "google_search"}]. Nano Banana 2 Lite этот инструмент не поддерживает.

Шаблоны для редактирования загруженного изображения

При правке главное — назвать, что именно меняется, и отдельно сказать, что остаётся как есть. Загружайте только те изображения, на которые у вас есть права: создание контента, который нарушает чужие права, вводит в заблуждение или причиняет вред, запрещено правилами Google.

8. Добавить или убрать элемент

hljs text
На загруженном изображении [что на нём] [добавь / убери / измени] [элемент].
Изменение должно [как вписаться: совпадать по свету, тени и перспективе].

Пример:

hljs text
На загруженном фото гостиной добавь на подоконник глиняный горшок
с монстерой. Растение должно отбрасывать тень в ту же сторону, что и
остальные предметы, и быть освещено дневным светом из окна.

9. Точечная замена одной детали

hljs text
На загруженном изображении измени только [конкретный элемент] на [новый
элемент или описание]. Всё остальное оставь в точности как есть: стиль,
свет и композицию.

Google называет этот приём смысловой маской (inpainting, semantic masking): область правки задаётся словами, без выделения кистью. Пример: «измени только цвет стены за диваном с белого на серо-зелёный; диван, подушки, торшер и свет в комнате оставь без изменений».

10. Перенос стиля

hljs text
Преобразуй загруженную фотографию [что на ней] в стиль [художественное
направление]. Сохрани исходную композицию, но передай всё через
[приёмы стиля: мазки, линии, палитра].

Пример: «Преобразуй загруженную фотографию ночной городской улицы в стиль акварельного скетча. Сохрани расположение домов и машин, но передай всё через прозрачные размывки, тонкий тушевой контур и палитру из синего и охры».

11. Сборка из нескольких изображений

hljs text
Создай новое изображение из загруженных. Возьми [элемент с первого
изображения] и помести [на / рядом с] [элемент со второго изображения].
Итог: [описание финальной сцены, свет, ракурс].

Пример:

hljs text
Создай новое изображение из загруженных. Возьми настольную лампу с первого
изображения и поставь её на прикроватную тумбу со второго. Итог:
реалистичная интерьерная фотография спальни вечером, лампа включена,
свет и тени согласованы с остальной комнатой.

Называйте изображения по порядку («с первого», «со второго») — так модели проще понять, что откуда брать.

12. Правка с сохранением важных деталей

hljs text
Используя загруженные изображения, помести [элемент со второго
изображения] на [элемент с первого]. [Что нельзя менять: подробное
описание формы, цвета, надписей] должно остаться без изменений.
Добавленный элемент должен [как вписаться].

Пример:

hljs text
Используя загруженные изображения, помести логотип со второго изображения
на крышку коробки с первого. Сама коробка — белая картонная, квадратная,
с тиснёной каймой по краю — должна остаться без изменений. Логотип должен
выглядеть напечатанным на картоне и повторять лёгкий наклон крышки.

Чем подробнее описана деталь, которую нужно сохранить (лицо, логотип, упаковка), тем меньше шансов, что она изменится при правке.

13. Из наброска в готовую картинку

hljs text
Преврати этот [карандашный / маркерный] набросок [объект] в [стиль]
[фотографию / иллюстрацию]. Сохрани [черты из наброска: силуэт, пропорции],
добавь [материалы, цвет, детали].

Пример: «Преврати этот карандашный набросок кресла в студийную фотографию готовой мебели. Сохрани низкую посадку и изогнутые подлокотники, добавь обивку из горчичного букле и ножки из светлого дуба».

14. Один персонаж с разных ракурсов

hljs text
Студийный портрет [персонаж с загруженного изображения] на [фон],
[анфас / в профиль, взгляд вправо / три четверти слева].

Пример: «Студийный портрет этого лисёнка-маскота на белом фоне, в профиль, взгляд вправо». Ракурсы запрашивают по одному, и к каждому следующему запросу прикладывают уже полученные изображения — так, по документации Google, персонаж остаётся узнаваемым. Для сложной позы добавьте изображение-референс с этой позой.

Если хочется сначала увидеть результат, а потом копировать текст, в библиотеке промптов YingTu у каждого готового промпта есть реальный пример изображения и цена за картинку.

Чего промпт не задаёт и что задаёт это вместо него

Слова «4K», «ультравысокое разрешение» или «сделай четыре варианта» влияют на содержание и детализацию описания, но не на технические свойства файла. По документации Gemini API по состоянию на 1 октября 2026 года:

Что хочется задатьЧто происходит, если написать это в промптеЧто задаёт на самом деле
Размер в пикселях (2K, 4K)Размер не меняется: по умолчанию модель отдаёт 1KПоле image_size в response_format: "1K", "2K", "4K" с заглавной K; значение 1k API отклонит
Доступные размеры—Модель: Nano Banana 2 Lite — только 1K; Nano Banana 2 — 512 px, 1K, 2K, 4K; Nano Banana Pro — 1K, 2K, 4K
Соотношение сторонБез параметра кадр повторяет размер загруженного изображения, а при генерации с нуля выходит квадратным 1:1Поле aspect_ratio, например "16:9"
Точное число изображенийМодель не всегда выдаёт ровно столько, сколько указано в текстеОтдельный запрос на каждое изображение
Сколько референсов учестьЧисло изображений, которые модель воспроизводит с высокой точностью, ограниченоЛимит модели — см. следующую таблицу
Только картинка, без текста в ответеПо умолчанию модель возвращает и текст, и изображениеresponse_format с "type": "image"

Для ориентира: кадр 16:9 у Nano Banana 2 — это 1376×768 в 1K, 2752×1536 в 2K и 5504×3072 в 4K. В примерах самого Google формат иногда дописан словами в конце промпта («Aspect ratio 16:9», «Square image»), так что в чате формат кадра стоит указывать текстом; в API надёжнее поле aspect_ratio.

Лимиты на изображения-референсы (всего до 14 в одном запросе, по состоянию на 1 октября 2026 года):

МодельОбъекты с высокой точностьюПерсонажи, которых нужно сохранитьРеференсы стиля
Nano Banana 2 Liteдо 14не предусмотреноне предусмотрено
Nano Banana 2до 10до 4не предусмотрено
Nano Banana Proдо 6до 5до 3

Nano Banana 2 Lite, по описанию Google, не оптимизирована для нескольких референсов и последовательной правки в диалоге — для шаблонов 11, 12 и 14 берите Nano Banana 2 или Pro. Звук на вход модели не принимают, видео — только Nano Banana 2 и 2 Lite. Все сгенерированные изображения содержат водяной знак SynthID.

Шесть приёмов, которые Google советует для любого промпта

  1. Будьте предельно конкретны. Не «фэнтезийные доспехи», а «эльфийские латы с гравировкой в виде серебряных листьев, высоким воротом и наплечниками в форме соколиных крыльев».
  2. Объясняйте назначение. «Создай логотип для дорогого минималистичного бренда уходовой косметики» даёт больше, чем «создай логотип»: контекст влияет на результат.
  3. Правьте в диалоге мелкими шагами. Вместо нового промпта с нуля — «оставь всё как есть, но сделай свет теплее». Google называет многоходовый диалог рекомендуемым способом доводить картинку.
  4. Сложную сцену давайте по шагам. «Сначала создай фон: туманный лес на рассвете. Затем на переднем плане — замшелый каменный алтарь. В конце положи на алтарь светящийся меч».
  5. Описывайте сцену утвердительно, а не через «без». Вместо «без машин» — «пустая безлюдная улица без признаков движения». Список запретов работает хуже описания того, что должно быть в кадре.
  6. Управляйте камерой. Термины съёмки — широкоугольный кадр, макро, съёмка с нижней точки — задают композицию точнее, чем «красиво» и «эффектно».

Картинка получилась не такой: что менять первым

Что не такЧто поменять в первую очередь
Модель ответила текстом, а не изображениемНачните с «Создай изображение…»; в API укажите response_format с "type": "image"
В кадре появилось то, что вы просили убратьПерепишите запрет в описание: что на этом месте должно быть
В надписи ошибки или лишние буквыСначала получите текст отдельным сообщением, затем попросите картинку с ним; текст в кавычках; для чистовых макетов — Nano Banana Pro
При правке изменилась вся картинкаФормула из шаблона 9: «измени только…, всё остальное оставь в точности как есть»
Изменилось лицо, логотип или упаковкаПодробно опишите эту деталь словами (шаблон 12) и проверьте лимит референсов для модели
Персонаж от кадра к кадру разныйПрикладывайте предыдущие результаты к следующему запросу; работайте в одном диалоге; не используйте для этого Nano Banana 2 Lite
Композиция не таДобавьте тип кадра, ракурс и объектив
Не тот размер или форматЭто не промпт: image_size и aspect_ratio
Изображений больше или меньше, чем просилиЗапрашивайте по одному изображению за раз

Менять стоит одну вещь за раз: если переписать промпт целиком, не будет понятно, что именно сработало.

Какую модель выбрать и сколько стоит одно изображение

Google советует по умолчанию использовать Nano Banana 2 — универсальную модель с выводом до 4K, надёжной отрисовкой текста и хорошей работой с несколькими референсами. Nano Banana 2 Lite — самая быстрая и дешёвая, для простых картинок в 1K. Nano Banana Pro — для профессиональных макетов и сложных инструкций, где важны точность текста и единообразие бренда.

Цены Gemini API за одно изображение по странице цен Google, по состоянию на 1 октября 2026 года:

Модель и размерОбычный запрос (Standard)Пакетный режим (Batch)
Nano Banana 2 Lite, 1K$0,0336$0,0168
Nano Banana 2, 512 px$0,045$0,022
Nano Banana 2, 1K$0,067$0,034
Nano Banana 2, 2K$0,101$0,050
Nano Banana 2, 4K$0,151$0,076
Nano Banana Pro, 1K или 2K$0,134$0,067
Nano Banana Pro, 4K$0,24$0,12

Бесплатного уровня у этих моделей в API нет — подробнее в материале «Бесплатные лимиты Gemini API: модели, квоты и ошибка 429». Пакетный режим примерно вдвое дешевле, но результат приходит в срок до 24 часов. Модели Gemini 3 «думают» перед генерацией, отключить это нельзя, и токены размышления тоже оплачиваются.

Веб-приложение Gemini в России официально недоступно; версии модели и места, где они работают, разобраны в материале «Nano Banana: что это за нейросеть Google и как ей пользоваться». Тем, кто не хочет заводить проект в Google Cloud, подойдёт запуск в YingTu со своим ключом LaoZhang API: по состоянию на 26 сентября 2026 года это $0,055 за изображение для Nano Banana 2 и $0,09 для Nano Banana Pro. Запросы при этом идут через API LaoZhang, а не через приложение Gemini от Google. Размеры и пример запроса — на странице Nano Banana 2 в YingTu и на странице Nano Banana Pro.

Как передать промпт через Gemini API

Ниже — форма запроса из документации Google для Interactions API на Python. Промпт идёт в input, а размер и формат — отдельно, в response_format:

hljs python
from google import genai
import base64

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.1-flash-image",
    input=(
        "Создай студийную предметную фотографию высокого разрешения: "
        "наручные часы со стальным корпусом и тёмно-синим циферблатом "
        "на плите тёмного сланца. Свет: три софтбокса. Резкость на циферблате."
    ),
    response_format={
        "type": "image",
        "aspect_ratio": "16:9",
        "image_size": "2K",
    },
)

with open("watch.png", "wb") as f:
    f.write(base64.b64decode(interaction.output_image.data))

Для правки загруженного изображения input становится списком: текст и картинка в base64.

hljs python
with open("room.png", "rb") as f:
    image_bytes = f.read()

interaction = client.interactions.create(
    model="gemini-3.1-flash-image",
    input=[
        {"type": "text", "text": "На загруженном изображении измени только цвет стены за диваном на серо-зелёный. Всё остальное оставь в точности как есть."},
        {"type": "image", "data": base64.b64encode(image_bytes).decode("utf-8"), "mime_type": "image/png"},
    ],
)

Следующую правку той же картинки отправляют с previous_interaction_id=interaction.id — так модель продолжает диалог, а не начинает заново.

Идентификаторы моделей: gemini-3.1-flash-lite-image (Nano Banana 2 Lite), gemini-3.1-flash-image (Nano Banana 2), gemini-3-pro-image (Nano Banana Pro). У исходной gemini-2.5-flash-image на странице цен Google стоит пометка Deprecated и дата отключения — 2 октября 2026 года. Код, в котором остался этот идентификатор, нужно перевести на один из трёх актуальных; Google рекомендует для такой замены Nano Banana 2 Lite. Уровень размышления у Nano Banana 2 и 2 Lite настраивается параметром thinking_level: minimal (по умолчанию) или high.

Лимиты запросов в API считаются на проект. Если при массовой генерации приходит 429, порядок действий описан в материале «Ошибка 429 RESOURCE_EXHAUSTED в Gemini API: RPM, TPM и RPD».

Частые вопросы

Промпты для Gemini лучше писать на русском или на английском?

Можно на русском. В документации Gemini API русский (ru-RU) стоит в списке языков, для которых Google заявляет лучшее качество работы моделей изображений, вместе с английским, немецким, испанским, японским и ещё десятью языками (по состоянию на 1 октября 2026 года). Сравнения качества между языками из этого списка в документации нет.

Почему картинка не в 4K, хотя в промпте написано «4K»?

Потому что размер задаёт не текст, а параметр image_size: без него модели Gemini 3 отдают 1K. В API укажите "image_size": "4K" с заглавной K и выберите Nano Banana 2 или Pro — Nano Banana 2 Lite выводит только 1K.

Как получить одного и того же персонажа на нескольких картинках?

Приложите изображение персонажа и запрашивайте новые кадры по одному, каждый раз добавляя к запросу уже полученные результаты. Nano Banana 2 удерживает до 4 персонажей, Nano Banana Pro — до 5 (по состоянию на 1 октября 2026 года); Nano Banana 2 Lite для этой задачи не предназначена.

Как добиться, чтобы надпись на картинке была без ошибок?

Сначала попросите Gemini написать сам текст и утвердите его, затем отдельным сообщением попросите изображение с этим текстом — так советует Google. В промпте дайте надпись в кавычках, опишите шрифт словами и укажите, где текст расположен; для чистовых макетов выбирайте Nano Banana Pro.

Теги

#Gemini#Nano Banana#промпты#генерация изображений#Gemini API

Поделиться статьей

XTelegram