Создаёт изображения по текстовому описанию - от реалистичных сцен до иллюстраций и рекламных макетов. Цена - 3 ₽ за 1 изображение, 6 ₽ за 2, 9 ₽ за 3, до 36 ₽ за 12.
Grok Image 2.0 - нейросеть компании xAI для создания изображений по текстовому заданию. Ей можно описать сцену обычными словами: кто или что должно быть в кадре, какой нужен стиль, свет, ракурс и настроение, а на выходе получить готовую картинку.
По заявлениям xAI, модель рассчитана на разные задачи - от предметных рендеров и иллюстраций до картинок для соцсетей, концепт-арта и маркетинговых макетов. Создатели отдельно делают упор на управление композицией, цветом и атмосферой через обычный текст, а ещё на доработку результата по ходу работы: можно менять детали в следующем запросе и получать новые варианты.
В материалах xAI про режим повышенного качества говорится о более реалистичной картинке, лучшей прорисовке текста внутри изображения и более точном контроле над итоговым результатом. Это полезно в случаях, когда нужен не просто красивый кадр, а, например, постер, меню, баннер или карточка товара, где важны надписи и аккуратная подача.
Вы пишете задание в свободной форме, а модель превращает его в картинку. Лучше всего работает подробное описание: кто в кадре, какой фон нужен, крупный или общий план, дневной свет или неон, реализм или рисунок, спокойное настроение или драматичная сцена.
Хороший запрос обычно выглядит так: не просто "кот в городе", а "рыжий кот сидит на подоконнике в дождливом ночном городе, в кадре мягкий тёплый свет из комнаты, стиль - кинематографичное фото". Чем меньше расплывчатости, тем ближе результат к вашей задумке.
Качество сильно зависит от формулировки запроса. Короткие и туманные задания могут давать слишком общий или случайный результат.
Даже у сильных генераторов бывают промахи в мелочах: пальцы, сложные позы, мелкий текст, логика предметов на заднем плане. Когда нужна точная картинка для печати, рекламы или фирменного дизайна, результат почти всегда приходится пересматривать и уточнять новыми запросами.
У Image 2.0 пока спорная репутация у части пользователей: в обсуждениях встречаются жалобы на просадку реализма, ошибки в анатомии и менее предсказуемое следование запросу по сравнению с прошлой версией. Так что для ответственных задач лучше сразу делать несколько вариантов и закладывать время на повторы.
Сильная сторона Grok Image 2.0 - работа через обычный разговорный запрос без сложной настройки. xAI делает акцент на том, что модель понимает описание сцены, стиля и композиции в естественном языке, а в более качественном режиме отдельно подтягивает реализм и текст в кадре.
На практике это вариант для тех, кому нужно быстро нагенерировать несколько идей без долгого изучения параметров. Но в задачах, где нужна безошибочная анатомия, стабильное качество от запроса к запросу или идеальная предсказуемость, результат лучше проверять особенно внимательно.