AI-модельDIFFUSION65,536 токенов
Разработчик: Google
Технические параметры и возможности
Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) — модель генерации и редактирования изображений, которую Google в документации обозначает кодом gemini-3.1-flash-image. Google описывает её как более быструю и рассчитанную на большой объём использования альтернативу Gemini 3 Pro Image: назначение — получать изображения по тексту и выполнять conversational editing, когда изображение уточняется несколькими последовательными сообщениями. OpenRouter связывает ту же модель с идентификатором google/gemini-3.1-flash-image-preview.
Подтверждённые входы и выходы шире обычного text-to-image. В документации Google для модели указаны текст и изображения, а также PDF во входных данных; результатом могут быть изображение и текст. Это позволяет строить сценарии, в которых запрос содержит описание, исходную картинку или документ, а ответом становится новое изображение, текстовое пояснение либо оба типа данных. Источники не говорят, что модель возвращает видео, аудио или доступные для скачивания веса, поэтому такие возможности в описание не включены.
Документация перечисляет несколько конкретных обновлений. Доступны варианты разрешения 0.5K, 2K и 4K, при этом размер по умолчанию — 1K. Поддерживаются соотношения сторон 1:4, 4:1, 1:8 и 8:1; это полезно для вертикальных, широких и панорамных композиций, если выбранный интерфейс действительно передаёт нужное значение. Google также указывает Image Search Grounding: генерация может использовать результаты текстового и графического поиска с актуальными данными из веба. Там же заявлены улучшенная точность соотношения сторон, качество и согласованность изображений, а также более качественный рендеринг текста в разных языках.
OpenRouter описывает модель как text+image → text+image и указывает контекстное окно 65 536 токенов. В его карточке для preview-варианта приведены цены за единицу OpenRouter: 0.0000005 доллара за входной токен, 0.000003 доллара за выходной токен и 0.00006 доллара за изображение на выходе; цена является данными маршрута на момент проверки и может измениться. Для интеграции нужно учитывать не только модельный контекст, но и ограничения конкретного провайдера, формат ответа и правила доступа к Image Search Grounding.
Подтверждённые сценарии — создание иллюстраций по текстовому брифу, итеративное редактирование исходного изображения, подготовка материалов с разными соотношениями сторон, генерация текста внутри изображения и задачи, где результат нужно уточнять диалогом. Image Search Grounding уместен там, где для результата нужны актуальные веб-данные, но это не означает автоматическую проверку каждого утверждения: источник и режим grounding должны быть явно доступны в используемом API.
Ограничение карточки — это preview-статус и зависимость от провайдера: документация подтверждает функции и код модели, а OpenRouter подтверждает конкретный маршрут, модальности и лимит контекста, но не гарантирует одинаковую доступность всех режимов у каждого endpoint. Параметры модели, локальный запуск, точные требования к лицензированию сгенерированных материалов и гарантии постоянства результата этими двумя источниками не подтверждены; их не следует обещать пользователю без отдельной проверки.
Официальные страницы, публикации СМИ и обсуждения сообщества