SpaceXAI представила Grok 4.6 — модель для автономных ИИ-агентов, сравнявшуюся с GPT-5.6 Sol и Claude Fable 5
Компания SpaceXAI 12 августа 2026 года анонсировала выпуск новой версии своей флагманской языковой модели — Grok 4.6. Разработка велась совместно с командой Cursor, а главной целью релиза стала поддержка так называемых «долгоживущих» автономных агентов, способных решать сложные многоступенчатые задачи без постоянного участия человека. Новая модель позиционируется как прямой конкурент таким системам, как GPT-5.6 Sol от OpenAI и Claude Fable 5 от Anthropic, демонстрируя сопоставимые результаты на независимых бенчмарках при существенно более низкой стоимости API.
[изображение | логотип SpaceXAI и модель Grok 4.6]Фокус на автономных агентах и многошаговых задачах
Ключевое отличие Grok 4.6 от предшественников — ориентация на «долгоживущие» ИИ-агенты. По заявлению разработчиков, модель способна удерживать контекст и цель на протяжении длительных процессов, включающих десятки этапов: от глубокого анализа незнакомой кодовой базы и написания приложений до проведения исследовательских задач. Важную роль играет улучшенный механизм самопроверки: нейросеть чаще верифицирует качество собственных генераций в процессе работы и исправляет ошибки до выдачи финального результата. Также отмечается способность модели самостоятельно перезапускаться и корректировать траекторию решения при возникновении препятствий.
Результаты в бенчмарках: на уровне лидеров рынка
В пресс-релизе SpaceXAI приводятся данные по нескольким популярным тестам. В специализированном бенчмарке FrontierCode v1.1, оценивающем навыки программирования, Grok 4.6 набрала 61,3% правильных ответов — это заметный рост по сравнению с 56,6% у предыдущей версии Grok 4.5 (выпущенной в июле 2026 года). В тесте CursorBench v3.2 новая модель обогнала GPT-5.6 Sol, уступив лишь Fable 5.
По индексу Artificial Analysis Intelligence Index (в источнике также упоминается как AA Intelligence Index) Grok 4.6 набрала 61 балл. Этот результат позволяет ей сравняться по максимальному уровню рассуждений с GPT-5.6 Sol и отстать на всего один балл от Fable 5 Max. При этом модель превзошла популярную китайскую систему с открытыми весами Kimi K3 от Moonshot. Дополнительные улучшения зафиксированы в тестах APEX-Agents и Terminal-Bench, что подтверждает прогресс в агентных сценариях и работе с терминалом.
Техническая база улучшений
По словам инженеров SpaceXAI, качественный скачок стал результатом комбинации трёх факторов: более длительного дополнительного цикла обучения, использования более качественных инженерных данных и расширенного применения обучения с подкреплением (RL) специально для задач программирования и интеллектуального труда. Эти меры позволили не только повысить «сырую» интеллектуальную мощность, но и сделать поведение модели более предсказуемым и надёжным в долгосрочных автономных сценариях.
Цены и доступность
Одним из главных конкурентных преимуществ Grok 4.6 называется цена. SpaceXAI устанавливает тарифы на уровне 2 доллара за миллион входных токенов (около 165 рублей по курсу на момент анонса) и 6 долларов за миллион выходных токенов (около 500 рублей). По оценке VentureBeat, это размещает модель в средней ценовой категории по сравнению с ведущими проприетарными и открытыми решениями во всём мире, делая её привлекательной для бизнеса и разработчиков, работающих с большими объёмами данных.
Модель уже доступна для использования в редакторах кода Cursor и Grok Build, а также через API SpaceXAI и партнёрские платформы OpenRouter, Vercel и Cloudflare.