09.10.2026

SpaceXAI выпустила Grok 4.7: более крупная базовая модель по той же цене $2/$6, что и Grok 4.6

SpaceXAI выпустила Grok 4.7: более крупная базовая модель по той же цене $2/$6, что и Grok 4.6

SpaceXAI выкатила Grok 4.7 — новый флагман компании, нацеленный на программирование, агентные задачи и работу со знаниями. В основе модели лежит увеличенный базовый набор параметров и более продолжительный цикл обучения с подкреплением. При этом стоимость и скорость остались ровно такими же, как у Grok 4.6.

Развёртывание возможно уже сегодня: модель доступна как хостинговое решение. Вызвать grok-4.7 можно через xAI API, Cursor, Grok Build, OpenRouter, Vercel и Cloudflare.

Анонс вписывается в общую гонку последних месяцев: крупные лаборатории одна за другой выпускают модели, ориентированные именно на агентные сценарии и программирование, где важно не только качество отдельного ответа, но и способность выдерживать многочасовые задачи без потери контекста и самоконтроля. SpaceXAI делает ставку на то, что увеличение базовой модели и заметно более длительное обучение с подкреплением дадут отдачу именно в таких рабочих нагрузках, а не в коротких демонстрационных тестах.

Что изменилось внутри

SpaceXAI перечисляет четыре отличия от предыдущей версии:

  • Новая, более крупная базовая модель. Grok 4.7 не переиспользует базу от 4.6, а построена заново на увеличенном фундаменте.
  • Более длинный прогон RL на сложных задачах. Набор тренировочных заданий смещён в сторону проблем, на решение которых уходят многие часы.
  • Улучшенная самопроверка и работа с длинным контекстом. По заявлению компании, модель тщательнее контролирует собственные результаты.
  • Нативная поддержка Grok Bot harness. Модель обучали понимать этот каркас для диалоговых сценариев и работы со знаниями.

В документации для разработчиков приведены спецификации API, а стартовая таблица сравнивает Grok 4.7 в режиме xHigh с Grok 4.6 High, GPT-5.6 Sol Max и Fable 5.1 Max.

Как выглядит расстановка сил на бенчмарках

Замер Grok 4.7 в DeepSWE проводился на высоком уровне усилий, и все результаты заявлены самими вендорами. По сравнению с 4.6 новая модель улучшает показатели в каждой строке таблицы. Самый заметный скачок — на Terminal-Bench 4.0: с 20,3% до 38,0%. Результат в EEBench вырос на 11 пунктов до 64,0%, что является лучшим значением в таблице. В юридическом агентном бенчмарке Harvey модель набрала 19,6% против 6,7% у Fable 5.1 Max.

Однако первенство не абсолютно. Fable 5.1 Max удерживает первые места в четырёх из семи тестов, включая 57,9% на Terminal-Bench. А лучший результат DeepSWE v1.1 — 72,7% — остаётся за GPT-5.6 Sol Max.

Цена как второй фронт борьбы

Здесь преимущество на стороне SpaceXAI. Fable 5.1 Max стоит в пять раз дороже на входе и примерно в 8,3 раза дороже на выходе. GPT-5.6 Sol Max обходится вдвое дороже на входных токенах и примерно в 3,3 раза — на исходящих. В графике стоимости одной задачи CursorBench 4.0 именно Grok 4.7 помещён на передний край соотношения «цена-производительность».

В тесте GDPval, который имитирует профессиональную интеллектуальную работу, Grok 4.7 в режиме xhigh набрала 1 695 баллов Elo — против 1 605 у Grok 4.6 high. Лидирует Fable 5.1 max с 1 735 баллами, а GPT-6 Astra max набрал 1 542. Компания также утверждает, что новая модель лучше справляется с созданием документов и презентаций.

Безопасность под новым соусом

Grok 4.7 поставляется с полностью переработанным стеком защитных механизмов. SpaceXAI называет её самой устойчивой из протестированных моделей с точки зрения отказов и сопротивления джейлбрейкам: она возглавила биобезопасностный бенчмарк LatchBio с результатом 62,4%.

На собственном бенчмарке HackerBench v0.3, оценивающем рискованные и вредоносные киберзадачи, модель пропустила 3,3% небезопасных запросов двойного назначения. Компания подчёркивает, что модель редко блокирует легитимную работу по безопасности. Избранные партнёры в сфере кибербезопасности получили доступ по приглашениям к её возможностям red-team для оборонных исследований.

Цена и доступность

Стоимость Grok 4.7 — $2 за миллион входных токенов и $6 за миллион выходных. Модель доступна в Cursor на всех тарифах и является выбором по умолчанию в Grok Build. Кроме того, она предоставляется через Grok API, OpenRouter, Vercel и Cloudflare.

Версия Grok 4.7 Fast — та же модель на более быстрой инфраструктуре: удвоенная скорость вывода при удвоенной цене. Согласно документации, она работает только в Cursor и Grok Build, но не в публичном API xAI, а также исключена из бесплатного тарифа Grok Build.

Региональный эндпоинт для США по адресу https://us.api.x.ai/v1 держит инференс внутри страны с наценкой 10%. Компания рекомендует задавать prompt_cache_key для надёжного попадания в кэш.

Коротко о главном

  • Grok 4.7 сохраняет ценообразование Grok 4.6: $2 на входе и $6 на выходе за миллион токенов.
  • Модель лидирует в стартовой таблице по EEBench (64,0%) и юридическому бенчмарку Harvey (19,6%).
  • Fable 5.1 Max по-прежнему впереди в четырёх из семи тестов, включая Terminal-Bench 4.0.
  • API предлагает контекстное окно на 500 000 токенов и четыре уровня рассуждений вплоть до xhigh.
  • Лишь 3,3% рискованных запросов двойного назначения прошли фильтр в HackerBench v0.3.

Подписывайтесь на наш канал Дзен и группу ВК

MarkTechPost

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *