xAI выпустила Imagine Image 2.0 — новую модель генерации и редактирования изображений с точной типографикой и инструментами для дизайна
Компания xAI Илона Маска представила и сразу открыла доступ к новой генеративной модели Imagine Image 2.0. Нейросеть доступна в режиме Quality Mode на веб-платформе Grok, а также в мобильных приложениях для iOS и Android. По заявлению разработчиков, главная цель обновления — создавать изображения, пригодные для реальной работы: модель точно следует инструкциям до мельчайших деталей, планирует типографику и вёрстку как профессиональный дизайнер, а при редактировании сохраняет заданные пользователем элементы.
Доступность и платформы
Imagine Image 2.0 запущена для всех пользователей без ожидания. Работает модель как режим Quality Mode на официальном сайте grok.x.ai и в родных приложениях Grok для iOS и Android. Отдельного API доступа пока нет — компания обещает развернуть его позднее, точных сроков не называет.
Ключевые улучшения генерации
По словам xAI, новая версия стала значительно точнее выполнять промпты и лучше справляется со сложными композициями. Модель умеет работать с типографикой и вёрсткой, благодаря чему может создавать инфографику, плакаты и другие материалы с большим количеством элементов и мелким текстом — он остаётся чётким и читаемым. Также появилась возможность сохранять единый визуальный стиль между несколькими генерациями, что разработчики называют заготовкой под будущую работу с видео.
Инструменты редактирования: Magic Wand, Smart Resize и мультиреференс
Особое внимание в релизе уделено постобработке. В Imagine Image 2.0 появился набор профессиональных инструментов:
- Magic Wand — позволяет редактировать конкретную выделенную область изображения, не затрагивая остальные части кадра.
- Сегментация объектов — обеспечивает более точное выделение элементов для последующего изменения.
- Автоматическое удаление фона — с возможностью экспорта объекта на прозрачном фоне.
- Smart Resize — пользователь выбирает нужное соотношение сторон (поддерживаются 9:16, 1:1, 16:9, 2:1 и другие), а ИИ самостоятельно дорисовывает недостающие части и перестраивает композицию под новый формат.
- Мультиреференс — модель принимает до пяти исходных изображений одновременно, позволяя объединять элементы из разных картинок в одну генерацию без ручного монтажа.
Результаты в бенчмарках Arena
По внутренним данным xAI на 7 августа 2026 года, Imagine Image 2.0 заняла второе место в мире сразу в двух рейтингах Arena — по генерации изображений по текстовому описанию и по редактированию. Обе таблицы возглавляет GPT-Image-2 от OpenAI. В категории редактирования быстрый вариант модели xAI набрал 1439 очков Elo против 1463 у лидера, а в генерации по описанию — 1320 против 1380. Модели Google (линейка Gemini, известная как Nano Banana), а также разработки Reve, Alibaba и ByteDance расположились ниже новинки xAI. При этом смены лидера не произошло: первую строку обоих рейтингов и до релиза Imagine Image 2.0 удерживала OpenAI.
Готовые шаблоны для типовых задач
Вместе с моделью xAI добавила пресеты для популярных сценариев использования. Среди них: обработка фотографий, изменение цвета товаров, создание рекламных изображений, коллажей, профессиональных портретов, иконок, игровых персонажей и ассетов, эмодзи для стримов и мерча. Это позволяет быстро получать результат без детального составления промптов для рутинных задач.
Планы по API
Полноценный доступ к Imagine Image 2.0 через API компания обещает открыть в будущем. Конкретные даты запуска и тарифы пока не анонсированы. Пользователи уже могут протестировать все возможности модели бесплатно в веб-версии и мобильных приложениях Grok.