Пять инструментов для генерации изображений.
Пять инструментов для генерации изображений. Часть 2 **Nano Banana Pro: **текст в кадре, 4K и 14 референсов от Google Nano Banana Pro — народное имя модели Gemini 3 Pro Image от Google DeepMind, выпущенной 20 ноября 2025 года. Архитектурно это мультимодальный трансформер, который перед генерацией «рассуждает» над композицией, освещением и пространственными отношениями объектов — и только потом переходит к рендерингу. Это даёт три ключевых преимущества: корректный рендеринг текста, консистентность персонажей и нативную работу с разрешением до 4K. Что умеет: Текст в кадре. Лучшая в классе типографика: пишет читаемый текст прямо на изображении, включая русский. Меню, схемы, инфографика, этикетки, плакаты — буквы не смазываются. До 14 референсов за один запрос. До 6 изображений объектов, до 5 персонажей и до 3 картинок стиля. Модель удерживает внешность до 5 человек одновременно. Разрешение 1K, 2K и 4K. Для черновика хватает 1K, для печати и крупных баннеров берут 4K. 14 соотношений сторон. Пошаговые правки. Можно менять отдельную часть картинки, ракурс, фокус, цвет и свет — несколькими правками подряд, не пересобирая кадр. Веб-поиск. Модель умеет опираться на поиск Google: актуальную погоду, графики, недавние события — и встраивать эти данные в инфографику и визуалы. Где сильна. По совокупности «понимание промпта плюс качество результата» — одна из самых сильных моделей на рынке. Текст на картинке — эталонный, консистентность лиц и объектов между кадрами — стабильная. Модель сама делает промежуточные черновые варианты и выбирает лучшую композицию перед финальным рендером. Где слаба. В России официально недоступна — страны нет ни в списке регионов Gemini, ни в Gemini API. Моделью пользуются через сервисы-агрегаторы. Строгая модерация запросов, связанных с реальными людьми и брендами. Для каких задач подходит: плакаты и упаковка с читаемым текстом, инфографика, рекламные макеты с точными надписями, серии кадров с одинаковыми персонажами, коммерческая фотография продуктов, образовательные материалы со схемами. Seedream 5.0 Lite: быстрые маркетинговые визуалы от ByteDance Seedream 5.0 Lite — экономичная версия модели Seedream 5 от ByteDance, ориентированная на быстрые маркетинговые черновики и ежедневный контент. В отличие от полной версии Pro, Lite сделана для скорости и количества: несколько вариантов за минуту, гибкая работа с референсами и вывод 2K или 3K. Что умеет: Генерация по тексту и редактирование по референсам. Создаёт изображения с нуля по описанию или редактирует загруженные картинки. Принимает до 14 референсных изображений, которые направляют композицию, палитру, детали продукта или визуальный стиль. Визуальное рассуждение. Модель анализирует пространственные отношения, логические структуры, взаимодействие объектов — а не просто сопоставляет ключевые слова. Опциональный веб-поиск. Когда промпт зависит от актуальных фактов, трендов или событий, модель может предварительно «поискать» в интернете и учесть свежий контекст. Вывод 2K и 3K. 2K — для быстрых черновиков, 3K — когда нужно больше деталей. 8 соотношений сторон — от 1:1 до 21:9, экспорт в PNG и JPEG. Кинематографичное освещение. Точно передаёт фактуры кожи, ткани, металла, стекла и еды. Хорошо справляется с портретным светом, мягким светом из окна, контровым светом золотого часа, неоновыми сценами. Где сильна. Lite — идеальный инструмент для брейншторма: создаёт несколько визуальных направлений за минуту, чтобы сравнить идеи до финальной доработки. Понятная структура промпта — объект, аудитория, сцена, формат, стиль, сообщение — даёт предсказуемые первые варианты. Где слаба. Разрешение ограничено 3K — для печати на крупных форматах может не хватить. Художественная выразительность уступает более «креативным» моделям вроде Midjourney. Для сложн ...читать полностью