Волна ИИПодписаться
← Назад
Модели и агенты

Grok 4.7: SpaceXAI выпустила новую флагманскую модель с крупной базой и RL — но в бенчмарках не обходит всех лидеров

22.09.2026 · marktechpost.com ↗

SpaceXAI выпустила Grok 4.7 — новую флагманскую модель для программирования, агентных задач и работы со знаниями. По сравнению с Grok 4.6 под капотом четыре ключевых изменения: новая, более крупная базовая модель, более длительный этап RL на сложных задачах (с уклоном в задачи на много часов), улучшенная самопроверка и обработка длинного контекста, а также нативная поддержка Grok Bot harness. Модель доступна через API xAI, Cursor, Grok Build, OpenRouter, Vercel и Cloudflare. Цены — те же $2 за миллион входных токенов и $6 за миллион выходных.

На бенчмарках Grok 4.7 (режим xHigh) показывает уверенный рост по сравнению с 4.6: CursorBench 4.0 — 46.3% против 40.4%, DeepSWE v1.1 — 71.0% (против 65.2%, но ниже 72.7% у GPT-5.6 Sol Max), EEBench — 64.0% (лучший в таблице), Terminal-Bench — 38.0% (почти вдвое выше 20.3% у 4.6). В тесте Harvey Legal Agent Benchmark — 19.6% (лидер против 2.5% у GPT-5.6 Sol Max и 6.7% у Fable 5.1 Max). Однако по пяти из семи бенчмарков лидирует Fable 5.1 Max (например, Terminal-Bench 57.9%, HealthBench 62.1%), а GPT-5.6 Sol Max — на DeepSWE. При этом Grok 4.7 значительно дешевле: Fable стоит в 5–8 раз дороже, GPT-5.6 — в 2–3 раза.

SpaceXAI усилила безопасность: новый стек защиты обеспечивает рекордную устойчивость к отказам и джейлбрейкам. Модель набрала 62.4% на биобезопасностном бенчмарке LatchBio и пропускает лишь 3.3% рискованных задач на HackerBench v0.3. Партнёры по кибербезопасности получают пригласительный доступ к возможностям red-team. Доступна также версия Grok 4.7 Fast — с двойной скоростью вывода по двойной цене, только в Cursor и Grok Build (без бесплатного уровня). Региональный US-эндпоинт добавляет 10% к цене.

Источник: marktechpost.com
← Все новости AI Wave