SpaceXAI выпустила Grok 4.7: более крупная база при прежней цене
SpaceXAI представила Grok 4.7 для программирования и знаний: новая базовая модель, более длинное RL-обучение, контекст 500 тыс. токенов и та же цена — 2 и 6 долларов за миллион токенов.
SpaceXAI (бывшая xAI) 21 сентября выпустила новую флагманскую модель Grok 4.7 для программирования и интеллектуальной работы с текстом. Компания сохранила прежнюю цену — 2 доллара за миллион входных токенов и 6 долларов за миллион выходных, — но заявляет о более крупной базовой модели и более длительном обучении с подкреплением на сложных задачах.
Что изменилось
По данным компании, Grok 4.7 не использует базу Grok 4.6, а построена на новой, более крупной модели. Обучение с подкреплением стало длиннее и смещено в сторону задач, требующих многих часов работы. Модель, по заявлению разработчика, дольше работает над трудными задачами, тщательнее проверяет собственную работу и лучше удерживает длинный контекст. Окно контекста — 500 тыс. токенов, знание мира — до мая 2026 года, на входе текст и изображения, на выходе только текст.
Результаты и доступность
Список заявленных бенчмарков:
- CursorBench 4.0: 46,3 % против 40,4 % у Grok 4.6 и 51,8 % у Fable 5.1 Max;
- DeepSWE v1.1: 71,0 % против 65,2 % у Grok 4.6 и 72,7 % у GPT-5.6 Sol Max;
- Terminal-Bench 4.0: 38,0 % против 20,3 % у Grok 4.6;
- Harvey Legal Agent Benchmark (юридическая работа): 19,6 % против 15,8 % у Grok 4.6 и 2,5 % у GPT-5.6 Sol Max;
- GDPval (Elo): 1 695 против 1 605 у Grok 4.6; лидер — Fable 5.1 с 1 735.
Модель доступна в Cursor и Grok Build, а также через API, сторонние среды разработки и облачные платформы. Есть быстрый вариант: вдвое выше скорость вывода при вдвое большей цене.
Безопасность
Компания сообщает о полностью переработанном стеке защитных механизмов. Grok 4.7, по её данным, блокирует 96,7 % рискованных и вредоносных киберзапросов, возглавляет биобезопасный бенчмарк LatchBio (62,4 %) и показывает лучший результат среди протестированных моделей по устойчивости к джейлбрейкам. Отдельным партнёрам по кибербезопасности открыт доступ к возможностям red-teaming по приглашению.
Почему это важно
Grok 4.7 выходит в момент, когда сразу несколько лабораторий конкурируют не только по качеству, но и по стоимости выполнения завершённой задачи. SpaceXAI держит цену неизменной и делает ставку на «многочасовые» агентные сценарии — программирование, юридические и аналитические документы. При этом ни одна из сторон не публикует независимой проверки заявленных результатов, а разрыв с лидерами по ряду бенчмарков сохраняется. Для пользователей практический эффект — снижение цены за единицу качества на длинных агентных задачах.