SpaceXAI выпустила Grok 4.6 — модель догнала GPT-5.6 Sol и Claude Fable 5 по интеллекту, сохранив низкую цену
Компания SpaceXAI 12 августа 2026 года представила обновлённую версию своей флагманской языковой модели — Grok 4.6. По данным разработчиков и независимых тестов, новая нейросеть сравнялась по уровню рассуждений с лидерами рынка: GPT-5.6 Sol от OpenAI и Claude Fable 5 от Anthropic, при этом стоимость её использования через API осталась на уровне прошлой версии. Модель сразу стала доступна в популярных средах разработки и через партнёрские платформы. 
Результаты бенчмарков: на уровне флагманов
Главный индикатор прогресса — индекс Artificial Analysis Intelligence Index, объединяющий девять различных тестов. Grok 4.6 набрала 61 балл, что равно результату GPT-5.6 Sol в максимальном режиме рассуждений и всего на один балл уступает Claude Fable 5 Max. Для сравнения: предшественница Grok 4.5, вышедшая в июле, показала 56 баллов. Прогресс в пять пунктов был достигнут чуть больше чем за месяц.
Детальная расшифровка по отдельным испытаниям показывает смешанную, но в целом сильную картину:
- GDPVal-AA v2: 1753 балла у Grok 4.6 против 1741 у Fable 5 и 1728 у Sol;
- AA-Briefcase (агентные задачи): 1577 против 1574 у Fable 5 и 1502 у Sol;
- Harvey LAB (юридические задачи): 15,8% против 11,3% у Fable 5 и 2,5% у Sol;
- Terminal-Bench v2.1 (классическая командная строка): 88,4% — второе место после Claude Opus 5;
- Terminal-Bench v3.0 (усложнённые задачи): 26% против 34,6% у Sol и 34,1% у Fable 5;
- DeepSWE и APEX-SWE (сложное программирование): Grok 4.6 уступает обоим конкурентам;
- FrontierCode v1.1: 61,3% против 56,6% у Grok 4.5, но Fable 5 опережает.
В тесте CursorBench v3.2 модель опередила GPT-5.6 Sol, но немного отстала от Fable 5. По наблюдениям команды Cursor, Grok 4.6 с первой попытки способна выстроить структуру приложения и визуальный стиль по подробному описанию, а на длинных цепочках действий чаще проводит самопроверки и исправляет ошибки перед переходом к следующему этапу. 
Архитектура: качество вместо количества параметров
По словам Илона Маска, Grok 4.6 использует ту же базу примерно в 1,5 триллиона параметров, что и версия 4.5. Компания не пошла по пути простого увеличения размера модели. Вместо этого был проведён более длительный этап дообучения с отобранными синтетическими данными по рассуждениям и инженерным дисциплинам, улучшён оптимизатор и переработана последовательность этапов SFT (Supervised Fine-Tuning) и RL (Reinforcement Learning).
Схема подготовки данных выглядит нестандартно: траектории для SFT генерировались самой Grok 4.5, проблемные варианты отбраковывались модельными проверками, а предыдущая версия выступала своеобразным «наставником» для следующей. Обучающие задачи охватывали оптимизацию вычислительных ядер, веб-разработку и CAD. Контекстное окно модели составляет 500 000 токенов (эквивалентно примерно 375 страницам текста). 
Экономика: агрессивное ценообразование и токен-эффективность
Ключевым конкурентным преимуществом остаётся цена. Тарифы API не изменились с релиза Grok 4.5: $2 за 1 млн входных токенов и $6 за 1 млн выходных. По расчётам Artificial Analysis, это более чем на 60% дешевле Claude Opus 5 ($5/$25) и GPT-5.6 Sol ($5/$30). Одна задача из Intelligence Index для Grok 4.6 оценивается примерно в $0,84 — сопоставимо с бюджетной китайской моделью Kimi K3 при более высоком уровне интеллекта.
Дополнительную экономию даёт токен-эффективность: в тесте AA-Briefcase Grok 4.6 решает длинную агентную задачу за средние 53 хода и ~500 млн входных токенов, тогда как Claude Opus 5 требует ~103 хода и ~2 млрд токенов. Цена кэшированных обращений выросла с $0,3 до $0,5 за 1 млн токенов.
Доступность и темпы обновлений
Модель уже интегрирована в редакторы кода Cursor и Grok Build, доступна через официальный API SpaceXAI, а также через партнёров: OpenRouter, Vercel и Cloudflare. Пользователям Cursor и Grok Build на первую неделю предоставлен удвоенный лимит обращений.
Темп выпуска обновлений у SpaceXAI выглядит агрессивным: Grok 4.5 вышла 8 июля, Grok 4.6 — 12 августа. Илон Маск анонсировал Grok 4.7 с моделью примерно на 2,1 триллиона параметров через три-четыре недели. Для российских разработчиков и корпоративных заказчиков появление ещё одного мощного и относительно доступного инструмента расширяет выбор при решении задач программирования, анализа документов и построения ИИ-агентов. 