Разбор того, что модель делает лучше аналогов и где у неё границы.
Модель ставит текст внутрь изображения так, что его можно прочитать: заголовок на постере, ценник на упаковке, подпись на схеме. Работает и с кириллицей, хотя ошибки в длинных строках на ней появляются чаще, чем на латинице.
На вход можно подать до 14 изображений: товар, фон, образец стиля, лицо героя. Модель соберёт из них один кадр и удержит до пяти персонажей узнаваемыми между генерациями.
Изображение можно доработать словами: заменить предмет, поменять освещение, развернуть камеру, перекрасить деталь. Остальная часть кадра при этом остаётся прежней — не приходится генерировать заново.

Модель ставит текст внутрь изображения так, что его можно прочитать: заголовок на постере, ценник на упаковке, подпись на схеме. Работает и с кириллицей, хотя ошибки в длинных строках на ней появляются чаще, чем на латинице.

На вход можно подать до 14 изображений: товар, фон, образец стиля, лицо героя. Модель соберёт из них один кадр и удержит до пяти персонажей узнаваемыми между генерациями.
Изображение можно доработать словами: заменить предмет, поменять освещение, развернуть камеру, перекрасить деталь. Остальная часть кадра при этом остаётся прежней — не приходится генерировать заново.
Разрешение доходит до 4K, но не у всех моделей: Pro отдаёт от 1K, младшие — начиная с 0.5K. Соотношений сторон четырнадцать у 2 и 2 Lite и десять у Pro, так что для нестандартного формата логичнее брать не старшую модель, а версию 2.
Версия 2 умеет сверяться с поиском Google во время генерации, в том числе искать по изображениям. Это заметно на редких объектах: незнакомая модели достопримечательность или специфический предмет получаются точнее, чем у моделей, которые опираются только на память.
Каждое изображение помечается невидимым водяным знаком SynthID. Метка не видна и не мешает работе, но позволяет позже подтвердить, что кадр сгенерирован. Отдельно существует видимый значок Gemini в углу — он есть на бесплатном доступе и снимается на старшей подписке.