Google выпустила новую модель генерации изображений Nano Banana 2.1

Она лучше пишет текст на картинках и держит облик персонажей, а одно изображение стоит вдвое дешевле, чем у прошлой версии.

Google выпустила Nano Banana 2.1 — новую версию своей модели для создания и редактирования изображений. Ее построили на базе Gemini 3.6 Flash. Характеристики и результаты тестов компания опубликовала в карточке модели на сайте Google DeepMind. Для разработчиков модель стала общедоступной 6 октября.

Модель принимает на вход текст и изображения, ее контекстное окно вмещает до 1 млн токенов. В ответ она выдает картинки в разрешении 1K, 2K или 4K, а также текст. Поддерживаются и необычно широкие или вытянутые по вертикали форматы. Google делает упор на точное редактирование, четкие надписи на постерах и сложные схемы. Для инфографики модель может подтягивать сведения из поиска Google. В одном запросе можно передать до 14 референсных изображений. Модель сохраняет облик до четырех персонажей и десяти объектов, а глубину «размышлений» перед генерацией можно выбрать: минимальную, среднюю или высокую.

Разница с прошлой версией заметна в тестах из карточки. В режиме с рассуждением Nano Banana 2.1 получила 1050 баллов в рейтинге пользовательских предпочтений при генерации по тексту, у предшественницы было 990. В дизайне инфографики модель набрала 1048 баллов против 961, а в сохранении облика нескольких персонажей — 1106 против 978. Сильнее всего выросла фактическая точность инфографики: 0,521 против 0,179, то есть почти втрое.

При этом генерация изображений подешевела. Google снизила цену вывода изображений в Gemini API до $30 за 1 млн токенов (2571,35 ₽). В итоге генерация изображения в разрешении 1K теперь стоит $0,0336 (2,88 ₽) вместо $0,067 (5,74 ₽), а в 4K — $0,0756 (6,48 ₽) вместо $0,151 (12,94 ₽). Предыдущую модель Nano Banana 2 отключат 29 октября, а ее прямой заменой станет Nano Banana 2.1.

Источник: hi-tech.mail.ru

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев