SpaceXAI выпустила Grok 4.7, и новая модель сразу устроила соревнование с ведущими системами для программирования. В тесте CursorBench 4.0 она набрала результат на 4,6 процентного пункта выше GPT-5.6 Sol от OpenAI, хотя до Fable 5.1 от Anthropic всё ещё не дотянула — разрыв составил 5,5 п.п.

Причина таких результатов, по данным SpaceXAI, в новом подходе к обучению. Для Grok 4.7 использовали более крупную базовую модель и сложные задания, которые могли занимать у человека много часов. Кроме того, система лучше работает с длинным контекстом и чаще перепроверяет собственные ответы.

Есть у модели и другая заметная особенность — обновлённая защита. По данным SpaceXAI, в тестах Grok 4.7 пропускала только 3,3% опасных запросов и при этом редко мешала выполнению обычных задач в сфере кибербезопасности.

В рабочих сценариях картина оказалась неоднозначной. В тесте на создание документов, презентаций и другие офисные задачи Grok 4.7 опередила GPT-6 Astra, но уступила Fable 5.1. При этом SpaceXAI заявляет, что по соотношению стоимости и результата в программировании новая модель также обошла систему OpenAI.

Проверить Grok 4.7 уже можно в Cursor и внутри Grok Build. Некоторое время доступ к ней в Grok Bot будет бесплатным, но срок SpaceXAI не назвала. В API модель стоит $2 за миллион входных токенов и $6 за миллион выходных при контексте до 500 тыс. токенов; для более длинного контекста цена возрастает до $4 и $12.

Появление Grok 4.7 показывает, что гонка ИИ всё сильнее смещается от общих заявлений к конкретным задачам и цене их выполнения. Для разработчиков это означает больше вариантов, а для рынка — ещё более жёсткое соревнование моделей за реальные рабочие процессы.