AIPi

SpaceXAI выпустила Grok 4.7: более крупная база при прежней цене

SpaceXAI представила Grok 4.7 для программирования и знаний: новая базовая модель, более длинное RL-обучение, контекст 500 тыс. токенов и та же цена — 2 и 6 долларов за миллион токенов.

SpaceXAI выпустила Grok 4.7: более крупная база при прежней цене

SpaceXAI (бывшая xAI) 21 сентября выпустила новую флагманскую модель Grok 4.7 для программирования и интеллектуальной работы с текстом. Компания сохранила прежнюю цену — 2 доллара за миллион входных токенов и 6 долларов за миллион выходных, — но заявляет о более крупной базовой модели и более длительном обучении с подкреплением на сложных задачах.

Что изменилось

По данным компании, Grok 4.7 не использует базу Grok 4.6, а построена на новой, более крупной модели. Обучение с подкреплением стало длиннее и смещено в сторону задач, требующих многих часов работы. Модель, по заявлению разработчика, дольше работает над трудными задачами, тщательнее проверяет собственную работу и лучше удерживает длинный контекст. Окно контекста — 500 тыс. токенов, знание мира — до мая 2026 года, на входе текст и изображения, на выходе только текст.

Результаты и доступность

Список заявленных бенчмарков:

  • CursorBench 4.0: 46,3 % против 40,4 % у Grok 4.6 и 51,8 % у Fable 5.1 Max;
  • DeepSWE v1.1: 71,0 % против 65,2 % у Grok 4.6 и 72,7 % у GPT-5.6 Sol Max;
  • Terminal-Bench 4.0: 38,0 % против 20,3 % у Grok 4.6;
  • Harvey Legal Agent Benchmark (юридическая работа): 19,6 % против 15,8 % у Grok 4.6 и 2,5 % у GPT-5.6 Sol Max;
  • GDPval (Elo): 1 695 против 1 605 у Grok 4.6; лидер — Fable 5.1 с 1 735.

Модель доступна в Cursor и Grok Build, а также через API, сторонние среды разработки и облачные платформы. Есть быстрый вариант: вдвое выше скорость вывода при вдвое большей цене.

Безопасность

Компания сообщает о полностью переработанном стеке защитных механизмов. Grok 4.7, по её данным, блокирует 96,7 % рискованных и вредоносных киберзапросов, возглавляет биобезопасный бенчмарк LatchBio (62,4 %) и показывает лучший результат среди протестированных моделей по устойчивости к джейлбрейкам. Отдельным партнёрам по кибербезопасности открыт доступ к возможностям red-teaming по приглашению.

Почему это важно

Grok 4.7 выходит в момент, когда сразу несколько лабораторий конкурируют не только по качеству, но и по стоимости выполнения завершённой задачи. SpaceXAI держит цену неизменной и делает ставку на «многочасовые» агентные сценарии — программирование, юридические и аналитические документы. При этом ни одна из сторон не публикует независимой проверки заявленных результатов, а разрыв с лидерами по ряду бенчмарков сохраняется. Для пользователей практический эффект — снижение цены за единицу качества на длинных агентных задачах.

Источники

#grok#spacexai#модели