Мы используем cookie и сервис «Яндекс.Метрика» (счётчик 106640303, включая Вебвизор) для работы авторизации, аналитики и улучшения сайта. Подробнее — Политика обработки ПДн и Политика cookie.

    Grok Imagine 2.0: что умеет новая модель xAI — и честный тест против GPT Image 2 и Nano Banana Pro
    Статья
    26 августа 20269 мин

    Grok Imagine 2.0: что умеет новая модель xAI — и честный тест против GPT Image 2 и Nano Banana Pro

    На Genova AI появилась Grok Imagine Image 2.0 — новое поколение генератора картинок xAI с точечным редактированием по областям и поддержкой нескольких референсов. Вместо пересказа пресс-релиза мы дали один и тот же русский промпт трём моделям — Grok 2.0, GPT Image 2 и Nano Banana Pro — и показываем кадры как есть, без пересъёмок и черри-пикинга.

    Разработчик: xAI (архитектура Aurora) · Режимы: Текст → Фото, Фото → Фото, По областям · Цена на Genova AI: 55 Gens за изображение

    Grok Imagine 2.0 — обзор и тест модели генерации изображений xAI
    Grok Imagine Image 2.0 — генерация и точечное редактирование изображений

    Что такое Grok Imagine Image 2.0

    Grok Imagine — генератор изображений xAI на собственной архитектуре Aurora: авторегрессивная mixture-of-experts модель, которая строит кадр последовательно и за счёт этого хорошо держит композицию, перспективу и свет. Первая версия запомнилась «живым» кинематографичным фотореализмом и точной передачей реальных объектов.

    Image 2.0 — не косметическое обновление, а смена подхода: из «генератора картинок» модель превратилась в генератор с редактором. По данным арен, версия 2.0 входит в группу лидеров Text-to-Image Arena (Elo 1316±12) и занимает второе место в Image Edit Arena (Elo 1439±8) — то есть сильнее всего модель прибавила именно в редактировании.

    Что нового — 4 главных изменения

    • Редактирование по областям. Кадр разбирается на сегменты — одежда, фон, объекты, детали. Меняется только выбранная область, остальное остаётся нетронутым.
    • До 6 референсов. В режиме Фото → Фото можно загрузить несколько исходников: персонажа — с одного фото, стиль — с другого, локацию — с третьего.
    • Типографика и кириллица. Вывески, постеры, надписи — чище и структурнее. В нашем тесте модель без ошибок написала «СВЕЖИЙ ХЛЕБ» и неоновое «ГАРАЖ 24».
    • Следование инструкциям. Многослойные промпты — «это слева, то справа, такая надпись, такой свет» — выполняются целиком.

    Режимы и параметры

    • Текст → Фото: генерация по описанию. Соотношения сторон: 1:1, 2:3, 3:2, 16:9, 9:16.
    • Фото → Фото: редактирование по референсам — JPEG, PNG или WEBP до 30 МБ, до 6 изображений, есть авто-подбор соотношения сторон.
    • По областям: «Разобрать на области» → выбрать сегмент → описать изменение.
    • Скорость: обычно 10–40 секунд на изображение.
    • Цена на Genova AI: 55 Gens за изображение — и для генерации, и для правки по областям.

    Тест: один русский промпт — три модели

    Методика простая и жёсткая: три промпта на русском языке, по одному прогону в каждой модели, без повторов и выбора лучшего. Соперники — GPT Image 2 (эталон по следованию инструкциям) и Nano Banana Pro (эталон по фотореализму). Обе тоже доступны на Genova AI.

    Тест 1. Кириллица на вывеске

    Витрина маленькой уютной пекарни вечером: тёплый свет из окна, деревянная вывеска с надписью «СВЕЖИЙ ХЛЕБ», на стеклянной двери табличка «Открыто с 7:00», на витрине багеты и круассаны, у входа велосипед с плетёной корзиной. Фотореалистичная уличная фотография, мягкий вечерний свет.
    Сравнение нейросетей: вывеска на русском — Grok Imagine 2.0, GPT Image 2, Nano Banana Pro
    Один промпт, три модели. Слева направо: Grok Imagine 2.0, GPT Image 2, Nano Banana Pro

    Grok Imagine 2.0 — «СВЕЖИЙ ХЛЕБ» и «Открыто с 7:00» без единой ошибки, самый атмосферный вечерний свет. GPT Image 2 — тоже идеальная кириллица, кадр светлее и «открыточнее». Nano Banana Pro — красивая уличная сцена, но обе надписи перевёл на английский: «FRESH BREAD» и «Open at 7:00». Для задач с русским текстом это дисквалификация.

    Тест 2. Фотореалистичный портрет

    Крупный портрет пожилого рыбака с седой бородой в жёлтом дождевике на рассвете у моря: капли воды на лице, глубокие морщины, внимательные серые глаза, мягкий золотой свет, лёгкий туман, размытая лодка на фоне. Фотореализм, детальная кожа, естественные цвета.
    Сравнение нейросетей: фотореалистичный портрет — Grok Imagine 2.0, GPT Image 2, Nano Banana Pro
    Портретный тест. Все три модели — на высоком уровне, различия в стиле

    Здесь проигравших нет — уровень у всех троих студийный. Но детали любопытны: только Grok оставил рыбака в капюшоне дождевика, как было в промпте, — GPT и Nano Banana надели вязаную шапку от себя. По фактуре: Nano Banana Pro дал самую «сырую» документальную кожу, GPT Image 2 — более глянцевый портрет, Grok — кинематографичный кадр с туманом и контровым светом.

    Тест 3. Многослойная инструкция

    Гараж вечером: слева красный винтажный мотоцикл с хромированным баком, справа жёлтая металлическая канистра, между ними на бетонном полу мелом нарисована белая стрелка, указывающая на мотоцикл, на стене синяя неоновая надпись «ГАРАЖ 24», через открытые ворота виден оранжевый закат. Кинематографичный свет, фотореализм.
    Сравнение нейросетей: сложная инструкция из пяти условий — Grok Imagine 2.0, GPT Image 2, Nano Banana Pro
    Пять условий в одном промпте: расположение объектов, стрелка, неон, закат

    В промпте пять условий. Grok Imagine 2.0 — 5 из 5, композиция самая точная по ТЗ. GPT Image 2 — 5 из 5, кадр чуть плотнее. Nano Banana Pro — 4 из 5: расположение и стрелка на месте, но неон снова латиницей — «GARAGE 24».

    Итог теста

    КритерийGrok Imagine 2.0GPT Image 2Nano Banana Pro
    Русский текст в кадребез ошибок (2/2)без ошибок (2/2)перевёл на английский (0/2)
    Следование инструкции (тест 3)5/5 условий5/5 условий4/5 условий
    Точность деталей промпта (тест 2)капюшон — как в ТЗзаменил на шапкузаменил на шапку
    Фотореализм фактуркино-стильглянецмаксимальная детализация
    Характер кадратёмный, кинематографичныйсветлый, «открыточный»документальный

    Оговорка: это один прогон на промпт, а не бенчмарк — результаты варьируются от попытки к попытке. Но переводы надписей у Nano Banana Pro воспроизвелись в обоих текстовых тестах — это устойчивая особенность.

    Ещё два примера: текст в кадре — главный козырь 2.0

    Раз уж типографика — заявленная сильная сторона версии 2.0, мы дали ей два задания посложнее одной вывески: многострочную афишу и меню с ценами. Оба кадра — первая генерация, без правок.

    Grok Imagine 2.0: афиша с русским текстом — ЛЕТНИЙ ДЖАЗ, 30 августа, Городской парк
    Афиша: заголовок «ЛЕТНИЙ ДЖАЗ», строка «30 августа · Городской парк» и мелкое «вход свободный» — все три уровня без ошибок
    Grok Imagine 2.0: меню кофейни мелом с ценами в рублях
    Меню: «Эспрессо — 150 ₽», «Капучино — 220 ₽», «Раф — 250 ₽» — структура списка, мел-леттеринг и даже символ рубля

    Практический вывод: афиши мероприятий, доски меню, ценники и обложки с русским текстом теперь можно делать одним промптом — без графического редактора. Если строк много, перечисляйте их явно, каждую в своих кавычках.

    Кому какая модель — шпаргалка

    ЗадачаБеритеПочему
    Вывески, постеры, баннеры с русским текстомGrok Imagine 2.0 или GPT Image 2Оба пишут кириллицу без ошибок; Grok — для атмосферы, GPT — для «чистого» рекламного кадра
    Кинематографичные сцены, lifestyle, реклама с характеромGrok Imagine 2.0Фирменный тёмный свет Aurora и точная композиция по ТЗ
    Точечная правка готового кадраGrok Imagine 2.0Режим «По областям»: меняется только выбранный сегмент
    Максимальный фотореализм фактурNano Banana ProСамая детальная «документальная» картинка; текст — лучше на английском
    Сложные схемы, product-shot, строгие ТЗGPT Image 2Стабильно выполняет многослойные инструкции

    Как пользоваться «По областям» — за 4 шага

    1. Сгенерируйте кадр или загрузите своё фото на странице Grok Imagine и переключитесь на вкладку «По областям».
    2. Нажмите «Разобрать на области» — модель разделит изображение на сегменты.
    3. Выберите сегмент и опишите изменение одной фразой: «перекрась куртку в красный», «замени фон на закат».
    4. Запустите генерацию — изменится только выбранная область. Правка стоит те же 55 Gens.

    Промпт-советы для Grok Imagine 2.0

    • Текст в кадре — в кавычках: вывеска с надписью «СВЕЖИЙ ХЛЕБ».
    • Говорите «съёмочным» языком: тип кадра, оптика (35mm, 85mm), свет (золотой час, неон, контровый).
    • Раскладывайте сцену по местам: «слева…, справа…, на фоне…».
    • Не переписывайте промпт целиком после неудачи — добавьте 1–2 уточнения или поправьте область.
    • Несколько референсов — по ролям: первый — персонаж, второй — стиль, третий — локация.

    Как попробовать из России

    Grok Imagine 2.0 уже работает на Genova AI: без VPN, интерфейс на русском, оплата российскими картами и СБП. Обе модели из сравнения — GPT Image 2 и Nano Banana Pro — тоже на платформе, так что можно повторить наш тест на своих промптах.

    Открыть Grok Imagine 2.0 на Genova AI — без VPN, 55 Gens за изображение, стартовый баланс новым пользователям.

    Часто задаваемые вопросы

    6

    Комментарии

    Пока нет комментариев. Будьте первым!

    ?

    📖 Похожие статьи

    Генерация изображений по описанию бесплатно — пошаговый гайд
    Статья

    Генерация изображений по описанию бесплатно — пошаговый гайд

    🎨 Как создать картинку по описанию с помощью нейросети — бесплатно и на русском языке? Написали пошаговый гайд: как правильно составить описание, какие настройки выбрать и как получить качественный результат с первого раза. Внутри — примеры промптов и готовые результаты.

    Читать
    Seedream 5.0 Lite: новый уровень AI генерации изображений — что нужно знать в 2026 году
    Статья

    Seedream 5.0 Lite: новый уровень AI генерации изображений — что нужно знать в 2026 году

    Seedream 5.0 Lite от ByteDance — новый AI-генератор изображений с 4K-качеством, точной генерацией текста и web-поиском. В статье: сравнение с версией 4.5, реальные примеры и инструкция. Попробуйте бесплатно с стартовыми Дженами на Genova AI.

    Читать
    Генерация картинок нейросетью: Топ-5 сервисов, где ИИ рисует по описанию (2026 год)
    Статья

    Генерация картинок нейросетью: Топ-5 сервисов, где ИИ рисует по описанию (2026 год)

    Обзор 5 лучших нейросетей для генерации изображений в 2026 году. Сравниваем Шедеврум, Kandinsky, Leonardo и другие сервисы. Узнайте, где можно бесплатно сгенерировать картинки по тексту на русском языке и как использовать передовые ИИ-модели без включения VPN.

    Читать