Skip to content
SpaceXAI выпустила Grok 4.6 — модель догнала GPT-5.6 Sol и Claude Fable 5 по интеллекту, сохранив низкую цену
14 августа 20:25 1 Просмотров Новости

SpaceXAI выпустила Grok 4.6 — модель догнала GPT-5.6 Sol и Claude Fable 5 по интеллекту, сохранив низкую цену

Компания SpaceXAI 12 августа 2026 года представила обновлённую версию своей флагманской языковой модели — Grok 4.6. По данным разработчиков и независимых тестов, новая нейросеть сравнялась по уровню рассуждений с лидерами рынка: GPT-5.6 Sol от OpenAI и Claude Fable 5 от Anthropic, при этом стоимость её использования через API осталась на уровне прошлой версии. Модель сразу стала доступна в популярных средах разработки и через партнёрские платформы. логотип SpaceXAI и модель Grok 4.6

Результаты бенчмарков: на уровне флагманов

Главный индикатор прогресса — индекс Artificial Analysis Intelligence Index, объединяющий девять различных тестов. Grok 4.6 набрала 61 балл, что равно результату GPT-5.6 Sol в максимальном режиме рассуждений и всего на один балл уступает Claude Fable 5 Max. Для сравнения: предшественница Grok 4.5, вышедшая в июле, показала 56 баллов. Прогресс в пять пунктов был достигнут чуть больше чем за месяц.

Детальная расшифровка по отдельным испытаниям показывает смешанную, но в целом сильную картину:

  • GDPVal-AA v2: 1753 балла у Grok 4.6 против 1741 у Fable 5 и 1728 у Sol;
  • AA-Briefcase (агентные задачи): 1577 против 1574 у Fable 5 и 1502 у Sol;
  • Harvey LAB (юридические задачи): 15,8% против 11,3% у Fable 5 и 2,5% у Sol;
  • Terminal-Bench v2.1 (классическая командная строка): 88,4% — второе место после Claude Opus 5;
  • Terminal-Bench v3.0 (усложнённые задачи): 26% против 34,6% у Sol и 34,1% у Fable 5;
  • DeepSWE и APEX-SWE (сложное программирование): Grok 4.6 уступает обоим конкурентам;
  • FrontierCode v1.1: 61,3% против 56,6% у Grok 4.5, но Fable 5 опережает.

В тесте CursorBench v3.2 модель опередила GPT-5.6 Sol, но немного отстала от Fable 5. По наблюдениям команды Cursor, Grok 4.6 с первой попытки способна выстроить структуру приложения и визуальный стиль по подробному описанию, а на длинных цепочках действий чаще проводит самопроверки и исправляет ошибки перед переходом к следующему этапу. график бенчмарков Grok 4.6 против GPT-5.6 Sol и Claude Fable 5

Архитектура: качество вместо количества параметров

По словам Илона Маска, Grok 4.6 использует ту же базу примерно в 1,5 триллиона параметров, что и версия 4.5. Компания не пошла по пути простого увеличения размера модели. Вместо этого был проведён более длительный этап дообучения с отобранными синтетическими данными по рассуждениям и инженерным дисциплинам, улучшён оптимизатор и переработана последовательность этапов SFT (Supervised Fine-Tuning) и RL (Reinforcement Learning).

Схема подготовки данных выглядит нестандартно: траектории для SFT генерировались самой Grok 4.5, проблемные варианты отбраковывались модельными проверками, а предыдущая версия выступала своеобразным «наставником» для следующей. Обучающие задачи охватывали оптимизацию вычислительных ядер, веб-разработку и CAD. Контекстное окно модели составляет 500 000 токенов (эквивалентно примерно 375 страницам текста). схема обучения Grok 4.6 с использованием Grok 4.5 в качестве наставника

Экономика: агрессивное ценообразование и токен-эффективность

Ключевым конкурентным преимуществом остаётся цена. Тарифы API не изменились с релиза Grok 4.5: $2 за 1 млн входных токенов и $6 за 1 млн выходных. По расчётам Artificial Analysis, это более чем на 60% дешевле Claude Opus 5 ($5/$25) и GPT-5.6 Sol ($5/$30). Одна задача из Intelligence Index для Grok 4.6 оценивается примерно в $0,84 — сопоставимо с бюджетной китайской моделью Kimi K3 при более высоком уровне интеллекта.

Дополнительную экономию даёт токен-эффективность: в тесте AA-Briefcase Grok 4.6 решает длинную агентную задачу за средние 53 хода и ~500 млн входных токенов, тогда как Claude Opus 5 требует ~103 хода и ~2 млрд токенов. Цена кэшированных обращений выросла с $0,3 до $0,5 за 1 млн токенов.

Доступность и темпы обновлений

Модель уже интегрирована в редакторы кода Cursor и Grok Build, доступна через официальный API SpaceXAI, а также через партнёров: OpenRouter, Vercel и Cloudflare. Пользователям Cursor и Grok Build на первую неделю предоставлен удвоенный лимит обращений.

Темп выпуска обновлений у SpaceXAI выглядит агрессивным: Grok 4.5 вышла 8 июля, Grok 4.6 — 12 августа. Илон Маск анонсировал Grok 4.7 с моделью примерно на 2,1 триллиона параметров через три-четыре недели. Для российских разработчиков и корпоративных заказчиков появление ещё одного мощного и относительно доступного инструмента расширяет выбор при решении задач программирования, анализа документов и построения ИИ-агентов. интерфейс Cursor с интегрированной моделью Grok 4.6

Поделиться

Похожие публикации