SpaceXAI решила проверить, насколько долго ИИ способен работать над задачей практически без вмешательства человека. Компания представила Grok 4.6, которая, по её заявлению, способна конкурировать с GPT-5.6 Sol от OpenAI и Claude Fable 5 от Anthropic.
Главная особенность модели — работа на длинной дистанции. По данным компании, Grok 4.6 может самостоятельно проходить несколько этапов задачи, разбираться в незнакомом коде, тестировать результат и продолжать работу, пока не приблизится к цели.

В Artificial Analysis Intelligence Index модель получила 61 балл. Она обошла Kimi K3 от Moonshot, сравнялась с GPT-5.6 Sol по максимальному уровню рассуждений и отстала от Fable 5 Max всего на один балл.
По сравнению с Grok 4.5, выпущенной в июле, новая версия показала лучший результат во всех заявленных тестах, включая CursorBench, FrontierCode, APEX-Agents и Terminal-Bench. В SpaceXAI связывают это с более длительным обучением, качественными инженерными данными и усиленным обучением с подкреплением для программирования.
Для бизнеса есть ещё один важный момент — цена. API стоит $2 за 1 млн входных токенов и $6 за 1 млн выходных, при этом модель показывает рост эффективности в кодинге, терминале и агентных задачах.
Grok 4.6 уже доступна в Cursor, Grok Build, через API SpaceXAI, OpenRouter, Vercel и Cloudflare. Если заявленные результаты подтвердятся в реальной работе, компаниям станет проще запускать сложных ИИ-агентов без огромных затрат.
