Grok 4.7: спецификация, возможности, бенчмарки и цены Modelflare
Проверенный обзор Grok 4.7: опубликованная спецификация, уровни рассуждения, стартовые бенчмарки, официальные цены токенов и тарифы Modelflare grok-award и grok-stable на 21 сентября 2026.
xAI выпустила Grok 4.7 21 сентября 2026 года. ID модели в API — grok-4.7. Это текущая флагманская модель xAI для программирования, агентного использования инструментов и работы со знаниями. В тот же день Modelflare указала этот же ID в публичном каталоге цен.
В статье разделены три слоя. Спецификация — это то, что документирует xAI. Таблица бенчмарков — это то, что xAI сообщила при запуске. Цены Modelflare — это то, что вернул GET /api/pricing 21 сентября 2026 года. Оценка поставщика не является тестом Modelflare, а строка каталога не обещает, что каждый ключ, маршрут или промпт поведёт себя одинаково.
xAI не опубликовала число параметров, число слоёв и суммарное число токенов обучения для Grok 4.7. «Крупнее, чем Grok 4.6» — качественное описание компанией новой базовой модели. Сравнение ниже использует те цифры, которые действительно опубликованы: контекст, цены токенов, уровни рассуждения, модальности и стартовые оценки.
Что было опубликовано
Публикация о запуске описывает Grok 4.7 как новую базовую модель, более крупную, чем Grok 4.6, обученную более длинным прогоном обучения с подкреплением. Смесь задач сложнее и смещена к проблемам, которые занимают много часов. xAI говорит, что модель лучше проверяет собственную работу и лучше ведёт длинный контекст, и что её обучили понимать harness Grok Bot, который используется для диалоговой работы.
Два предложения этой публикации нельзя свести к одному. Заголовок говорит, что модель «вдвое быстрее и стоит вдвое дешевле сопоставимых моделей». Основной текст говорит, что она обслуживается по той же цене и с той же скоростью, что и Grok 4.6. Таблица токенов подтверждает второе предложение относительно Grok 4.6: у обоих указаны $2 за миллион входных токенов и $6 за миллион выходных токенов. Заголовок сравнивает модель с другими моделями в той таблице, у которых цены прайс-листа выше. xAI не публикует число токенов в секунду рядом с формулировкой «вдвое быстрее», поэтому эта статья не считает эту фразу измеренным результатом по задержке.
grok-4.7 доступен в API xAI и в Cursor и является моделью по умолчанию в Grok Build. Отдельный путь обслуживания Fast существует только в Cursor и в Grok Build. Его нет в публичном API xAI, и его не было в каталоге Modelflare, проверенном для этой статьи.
Сравнение спецификаций
Цены ниже — опубликованные цены прайс-листа xAI в USD за миллион токенов. «Короткий» означает промпт менее 200,000 токенов. «Длинный» означает промпт, который достиг 200,000 токенов. В таблице цен пересечение этой границы заново оценивает каждый токен запроса, а не только токены за границей.
| Пункт | grok-4.7 | grok-4.6 | grok-4.5 |
|---|---|---|---|
| Окно контекста | 500,000 токенов | 500,000 токенов | 500,000 токенов |
| Короткий ввод / кэшированный ввод / вывод | $2.00 / $0.50 / $6.00 | $2.00 / $0.50 / $6.00 | $2.00 / $0.30 / $6.00 |
| Длинный ввод / кэшированный ввод / вывод | $4.00 / $1.00 / $12.00 | $4.00 / $1.00 / $12.00 | $4.00 / $0.60 / $12.00 |
| Усилие рассуждения | low, medium, high (по умолчанию), xhigh | low, medium, high (по умолчанию), xhigh | low, medium, high (по умолчанию) |
Сведения о Grok 4.7, проверенные на странице модели в тот же день:
- Входы — текст и изображения. Выход — текст. Модель не генерирует изображения.
- На странице не указан фиксированный предел текстового вывода. Таймауты клиента, лимиты аккаунта и оставшееся окно контекста по-прежнему действуют.
- Отсечение знаний — май 2026 года. Более поздние события невидимы, если не включён инструмент поиска.
- Документированные интерфейсы — Responses API и Chat Completions.
- Документированные инструменты включают вызов функций, веб-поиск, поиск в X и выполнение кода.
- Рассуждение нельзя отключить. Если усилие опущено, значение по умолчанию —
high. - В Responses API
grok-4.7возвращаетreasoning.encrypted_content, даже если запрос этого не просит. В следующих ходах эти элементы рассуждения нужно отправлять обратно без изменений. Chat Completions этого поведения не получает.
Grok 4.5 останавливается на high. Grok 4.6 и Grok 4.7 добавляют xhigh. Цена прайс-листа для кэшированного ввода тоже изменилась: у Grok 4.5 это $0.30 на коротких промптах и $0.60 на длинных; у Grok 4.6 и Grok 4.7 — $0.50 и $1.00. Стандартные цены прайс-листа на ввод и вывод у этих трёх ID не изменились.
Измерения возможностей
Программирование и долгая агентная работа
Публикация о запуске нацеливает Grok 4.7 на работу, которая идёт долго: многошаговое программирование, проверку результата до того, как считать его готовым, и удержание длинного контекста. Все эти оценки программирования взяты из стартовой таблицы xAI:
- CursorBench 4.0, который нагружает более длинные задачи программирования: 46.3% на xHigh. Grok 4.6 High — 40.4%, GPT-5.6 Sol Max — 41.7%, Fable 5.1 Max — 51.8%.
- DeepSWE v1.1: 71.0%, помеченный xAI как оценка высокого усилия, а не xHigh. Grok 4.6 — 65.2%, Sol — 72.7%, Fable 5.1 — 70.0%.
- Terminal-Bench 4.0: 38.0%. Grok 4.6 — 20.3%, Sol — 37.3%, Fable 5.1 — 57.9%.
- EEBench, электротехника: 64.0%. Grok 4.6 — 53.0%, Sol — 39.4%, Fable 5.1 — 56.4%.
Читайте строки как карту того, где, по словам поставщика, сдвинулась модель, а не как оценку, которую получит ваш репозиторий. На CursorBench xAI называет результат соотношением цены и качества уровня frontier: оценка выше, чем у Sol и Grok 4.6, ниже, чем у Fable 5.1, при гораздо более низкой цене прайс-листа, чем у Sol или у Fable. DeepSWE близок к Fable и всё ещё ниже Sol, и это не число xHigh. Работа в терминале резко улучшилась относительно Grok 4.6 и находится рядом с Sol, тогда как Fable 5.1 по этой строке остаётся далеко впереди. EEBench — самое ясное лидерство в таблице.
Профессиональная работа со знаниями
xAI также сообщает офисные и профессиональные задачи:
- AA Briefcase v1.1, многочасовая офисная работа: 1,657. Grok 4.6 — 1,546, Sol — 1,487, Fable 5.1 — 1,678.
- Harvey Legal Agent Benchmark: 19.6%. Grok 4.6 — 15.8%, Sol — 2.5%, Fable 5.1 — 6.7%. Лидерство в этой таблице по-прежнему означает примерно один пункт из пяти. Это не доказательство того, что модель может вести юридическую работу без надзора.
- HealthBench Professional, клиническое рассуждение: 56.7%. Grok 4.6 — 48.5%, Sol — 60.5%, Fable 5.1 — 62.1%. В этой строке Grok 4.7 опережает предшественника и отстаёт от обеих моделей сравнения.
В публикации сказано, что Grok 4.7 лучше работает с документами и презентациями и улучшает результат Grok 4.6 по GDPval, оставаясь в том же диапазоне, что и другие модели уровня frontier. В прозе не напечатаны точечные значения GDPval, поэтому эта статья их не приводит.
В тексте запуска Grok 4.7 нет единого индекса интеллекта. Более ранняя публикация о Grok 4.6 опубликовала Artificial Analysis Intelligence Index. Этот запуск заменяет то единственное число таблицей задач выше. Используйте строку, которая соответствует работе. В одном выпуске модель может лидировать в электротехнике и отставать в клиническом рассуждении.
Усилие рассуждения
reasoning_effort принимает low, medium, high и xhigh. high — значение по умолчанию. xAI описывает low как более лёгкую настройку, medium — как больше размышлений там, где задержка менее чувствительна, high — как настройку для трудных многошаговых задач, а xhigh — как самую глубокую настройку, с самой высокой задержкой, для задач, в которых качество ответа важнее времени ответа.
Большее усилие обычно означает больше токенов рассуждения, а выходные токены — дорогая сторона цены прайс-листа. xhigh не является автоматически правильным значением по умолчанию для production. Сравните успех задачи, задержку и общее число токенов на собственных промптах, прежде чем оставлять эту настройку включённой.
В многоходовом диалоге Responses сохраняйте зашифрованные элементы рассуждения в следующем запросе. Если их отбросить, теряется контекст, которым модель пользовалась, чтобы прийти к предыдущему ответу. Chat Completions не возвращает это зашифрованное поле.
Инструменты, изображения и память
Вызов функций — это путь инструментов, который реализуете вы. Вы объявляете функцию, модель предлагает вызов, ваше приложение выполняет его, и вы отправляете результат обратно. Веб-поиск, поиск в X и выполнение кода размещает xAI. Модель может вызывать их сама, и каждое обращение тарифицируется отдельно от токенов.
Изображения можно отправлять на вход. Сводка страницы модели не указывает отдельную цену изображения. Входы-изображения расходуют контекст и появляются в использовании токенов запроса. Генерация изображений остаётся на моделях Grok Imagine, а это другой API.
Пятьсот тысяч токенов — это окно, а не бюджет, который следует заполнять. xAI рекомендует стабильный prompt_cache_key в Responses API и заголовок x-grok-conv-id в прямых Chat Completions, чтобы диалог с большей вероятностью попал на тот же сервер и в кэш. Без этой привязки сервер с холодным кэшем выставляет полную цену ввода. От длинных циклов также ожидается уплотнение более ранних ходов. Уплотнение меняет то, что модель может видеть. Сверьте сводку с исходными ограничениями, ID, решениями и открытыми ошибками.
Отсечение мая 2026 года — жёсткий предел запомненного знания. Всё более новое требует инструмента поиска, а поиск не входит в цену токенов.
Защитные механизмы
xAI говорит, что Grok 4.7 использует новый стек защитных механизмов и является самой сильной моделью, которую компания проверяла на отказах и устойчивости к jailbreak. В публикации о запуске напечатаны две цифры:
- Бенчмарк биобезопасности LatchBio: 62.4%.
- HackerBench v0.3, который xAI описывает как свой бенчмарк рискованных и вредоносных киберзадач: пропускается 3.3% рискованных промптов двойного назначения. xAI также говорит, что законная работа по безопасности блокируется редко.
В публикации сказано, что избранные партнёры по кибербезопасности имеют доступ только по приглашению к возможностям red team для оборонных исследований. Этот доступ не является частью описанного здесь публичного API grok-4.7.
Эти цифры — оценки поставщика. Это не независимый аудит и не повод пропускать человеческую проверку медицинских, юридических, связанных с безопасностью и других ответов с высокими ставками.
Официальные цены
Тарифы на токены
Страница цен xAI, проверенная 21 сентября 2026 года, указывает USD за миллион токенов:
| Размер промпта | Ввод | Кэшированный ввод | Вывод |
|---|---|---|---|
| Менее 200,000 токенов промпта | $2.00 | $0.50 | $6.00 |
| 200,000 токенов промпта и более | $4.00 | $1.00 | $12.00 |
Длинный тариф покрывает весь запрос, как только промпт достигает порога. Первые 200,000 токенов не сохраняют короткий тариф.
Три официальных примера
Плата за размещённые инструменты исключена.
| Запрос | Основа | Арифметика | Итого |
|---|---|---|---|
| 100,000 некэшированного ввода, 5,000 вывода | Короткий | 0.1 × $2 + 0.005 × $6 | $0.230 |
| 100,000 кэшированного ввода, 5,000 вывода | Короткий | 0.1 × $0.50 + 0.005 × $6 | $0.080 |
| 220,000 некэшированного ввода, 10,000 вывода | Длинный | 0.22 × $4 + 0.01 × $12 | $1.000 |
Скачок от первой строки к третьей — это не «немного больше текста». Пересечение 200,000 токенов удваивает каждый тариф, а дополнительные токены тарифицируются по удвоенному тарифу. Полностью кэшированный промпт из 100,000 токенов во второй строке стоит около трети некэшированного короткого промпта, потому что кэшированный ввод составляет четверть тарифа ввода, а плата за вывод не меняется.
Размещённые инструменты, Fast и регион США
Обращения к размещённым инструментам на той же странице цен:
- Веб-поиск (
web_search): $5 за 1,000 вызовов. - Поиск в X (
x_search): $5 за 1,000 вызовов на момент этой проверки. С 21 сентября 2026 года в 12:00 PT xAI заменяет эту цену за вызов на $5 за 1,000 полученных постов и $10 за 1,000 полученных профилей пользователей. Считается каждый возвращённый пост, включая родительские посты и цитаты. Считается каждый возвращённый профиль. - Выполнение кода (
code_executionиcode_interpreter): $5 за 1,000 вызовов. - Поиск по файловым вложениям: $10 за 1,000 вызовов.
- Поиск по коллекциям: $2.50 за 1,000 вызовов.
Модель сама выбирает, сколько обращений к размещённым инструментам сделать. Ответ с интенсивным поиском может стоить дороже по плате за инструменты, чем по токенам.
Региональный endpoint США https://us.api.x.ai/v1 удерживает инференс в Соединённых Штатах и умножает ввод, кэшированный ввод и вывод на 1.1, включая тарифы длинного контекста. Для grok-4.7 это $2.20 / $0.55 / $6.60 ниже 200,000 токенов промпта и $4.40 / $1.10 / $13.20 на этой границе и выше.
Grok 4.7 Fast — та же модель на более быстрой инфраструктуре. В прозе xAI сказано, что она тарифицируется по удвоенным стандартным тарифам токенов. Таблица цен печатает $4.00 / $1.00 / $12.00 ниже 200,000 токенов промпта и $6.00 / $1.50 / $18.00 при 200,000 и выше. Удвоение стандартной строки длинного контекста $4 / $1 / $12 дало бы $8 / $2 / $24. Напечатанная длинная строка Fast этому удвоению не соответствует. Составляйте бюджет по таблице и заново проверьте страницу цен, прежде чем полагаться на Fast. Fast продаётся через Cursor и Grok Build. Его нет в публичном API xAI, он не входит в бесплатный уровень Grok Build, и в каталоге Modelflare, проверенном 21 сентября 2026 года, не было ID модели Fast. Присутствовавшие ID Grok были grok-4.5, grok-4.6 и grok-4.7.
Стартовые бенчмарки
Оценки ниже скопированы из публикации xAI о запуске от 21 сентября 2026 года. Folkbench сравнивает маршруты по доступности, задержке и цене и хранит свои заметки об этой модели на folkbench.com/models/grok-4-7. Заголовки столбцов сохраняют настройку усилия, которую напечатала xAI. Оценки других моделей — те, которые xAI поместила в ту же таблицу. Modelflare их не перезапускала.
| Оценка | Grok 4.7 xHigh | Grok 4.6 High | GPT-5.6 Sol Max | Fable 5.1 Max |
|---|---|---|---|---|
| Цена прайс-листа на ввод, USD / 1M | 2 | 2 | 4 | 10 |
| Цена прайс-листа на вывод, USD / 1M | 6 | 6 | 20 | 50 |
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0% (high, не xHigh) | 65.2% | 72.7% | 70.0% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
Столбец Grok 4.7 — это не одна настройка усилия. DeepSWE явно является оценкой усилия high. Остальные ячейки Grok 4.7 стоят под заголовком xHigh. Grok 4.6 — это High. Sol и Fable — это Max. Более высокая оценка может исходить из более глубокой и более дорогой настройки рассуждения. Это стоит знать, и это не сопоставленное сравнение на одном уровне усилия.
В этой таблице Grok 4.7 лидирует в EEBench и в бенчмарке Harvey. Он близок к лидерам в CursorBench, DeepSWE, AA Briefcase и в Terminal-Bench относительно Sol. Он сильно отстаёт от Fable 5.1 в Terminal-Bench и отстаёт и от Sol, и от Fable 5.1 в HealthBench Professional.
Цена прайс-листа на ввод составляет половину цены Sol и одну пятую цены Fable. Цена прайс-листа на вывод составляет 30% цены Sol и 12% цены Fable. Формулировка «половина цены» подходит к ячейке ввода Sol и не подходит к каждой другой ячейке. Точное сравнение — это таблица.
Цены Modelflare и чем отличаются группы
21 сентября 2026 года публичный ответ с ценами Modelflare включал grok-4.7. Тариф прайс-листа каталога совпадает с ценой прайс-листа xAI для короткого контекста: ввод $2 за миллион токенов, коэффициент завершения 3, поэтому вывод равен $6, и коэффициент кэша 0.25, поэтому кэшированный ввод равен $0.50. Эта строка не публикует второй уровень длинного контекста. Не умножайте длинный тариф xAI $4 / $1 / $12 на коэффициент группы Modelflare и не считайте произведение счётом. Списание, сохранённое у завершённого запроса, и есть применённая величина.
Группа выбирается на ключе API. Обе группы вызывают один и тот же ID модели.
Таблица цен
| Группа | Коэффициент | Ввод / 1M | Кэшированный ввод / 1M | Вывод / 1M | Описание в каталоге |
|---|---|---|---|---|---|
grok-award |
0.03 | $0.06 | $0.015 | $0.18 | Маршрутизация с приоритетом цены для разработки, тестирования и гибких нагрузок, чувствительных к бюджету и допускающих повтор |
grok-stable |
0.11 | $0.22 | $0.055 | $0.66 | Повседневная разработка, более длинные проекты и production-приложения для индивидуальных разработчиков, которым нужна стабильность |
Арифметика — это тариф прайс-листа каталога, умноженный на коэффициент группы. Award — это $2.00 × 0.03, $0.50 × 0.03 и $6.00 × 0.03. Stable — это $2.00 × 0.11, $0.50 × 0.11 и $6.00 × 0.11. Относительно цены прайс-листа короткого контекста эти коэффициенты составляют 3% и 11%. Это не 3% и не 11% цены прайс-листа длинного контекста, региональной цены США или платы за размещённые инструменты.
Китайский текст каталога для grok-award добавляет предложение, которого нет в английском описании: очень низкая цена не гарантирует стабильность или качество модели. Держите это рядом с коэффициентом 0.03. grok-stable — описание каталога для обычной разработки и production. Ни одно из предложений не является измеренным соглашением о доступности, целевой задержкой или утверждением, что группы исполняют разные веса.
Три примера Modelflare
Формы токенов совпадают с официальными примерами. Они оценены по единственному тарифу каталога. Кэшированные строки предполагают, что запись использования считает эти входные токены попаданиями в кэш. Очень малые списания также могут сдвинуться, когда квота округляется до единицы биллинга, поэтому журнал запросов остаётся счётом.
| Запрос | grok-award | grok-stable |
|---|---|---|
| 100,000 некэшированного ввода, 5,000 вывода | $0.0069 | $0.0253 |
| 100,000 кэшированного ввода, 5,000 вывода | $0.0024 | $0.0088 |
| 220,000 некэшированного ввода, 10,000 вывода, по единственному тарифу каталога | $0.0150 | $0.0550 |
Строка на 220,000 токенов намеренно не равна 0.03 × $1.00 или 0.11 × $1.00. Один доллар — это списание прайс-листа xAI за длинный контекст. Если более поздняя редакция каталога добавит уровень длинного контекста, эта строка перестанет быть котировкой. Живая страница — это страница цены grok-4.7. Указатель — Модели и цены.
Вызов модели через Modelflare, а не открытие отдельного аккаунта xAI только ради этого ID, означает:
- ID модели остаётся
grok-4.7. Клиент не обращается к переименованному псевдониму. - Канонический базовый URL — совместимый с OpenAI адрес
https://modelflare.dev/v1. SDK OpenAI обычно нужны этот базовый URL, ключ Modelflare и ID модели. - Ключ помещается в
grok-awardилиgrok-stable. Тот же аккаунт может вызывать другие модели каталога, когда группа ключа это позволяет. - Разделение цены явно. Award — дешёвый маршрут для работы, которую можно повторить, с оговоркой о стабильности и качестве выше. Stable — маршрут, который каталог описывает для повседневной разработки и production.
- Перечисленные типы endpoint для этого ID — Chat Completions, Responses и compaction Responses.
В эту цену не входят измеренное преимущество по задержке относительно прямого вызова xAI, плата за размещённый поиск или выполнение кода, уровень обслуживания Fast и уровень сервиса за пределами описания группы.
Как вызвать Grok 4.7 в Modelflare
Создайте ключ API и выберите grok-award или grok-stable. Группа задана на ключе. Ключ в несвязанной группе может получить отказ на grok-4.7, хотя модель указана публично. Отправляйте ID модели в точности. Канонический базовый URL — https://modelflare.dev/v1. Тот же API также опубликован по адресам https://cf.modelflare.dev/v1 и https://origin.modelflare.dev/v1. Корневое имя хоста — это канонический сайт.
Chat Completions:
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"reasoning_effort": "high",
"messages": [
{
"role": "user",
"content": "Review this migration plan and list the three assumptions that most need a test."
}
]
}'
Responses:
curl -sS https://modelflare.dev/v1/responses \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"reasoning": {"effort": "high"},
"input": "Review this migration plan and list the three assumptions that most need a test."
}'
В Chat Completions reasoning_effort принимает low, medium, high и xhigh. В Responses задайте reasoning.effort теми же значениями. Ввод изображения использует обычный массив content OpenAI в сообщении пользователя. Собственные функции используют обычное поле tools. POST /v1/responses/compact указан для этой модели и пересылается как compaction на grok-4.7, а не как другой ID модели. Размещённые инструменты xAI, включая веб-поиск, — это поведение поставщика. Попробуйте их на том маршруте, которым будете реально пользоваться, и прочитайте запись использования, прежде чем полагаться на них или на плату xAI за обращения.
О различии двух форм запроса см. Responses API или Chat Completions. О методе стоимости за таблицами см. Как рассчитать стоимость токенов LLM и Отслеживание стоимости API ИИ.
Проверки перед переключением трафика
- Зафиксируйте
grok-4.7. Не принимайте тихую подмену на Grok 4.6 или Grok 4.5. - Подтвердите, что группа ключа —
grok-awardилиgrok-stable, и выбирайте её по допустимости повторов, а не только по коэффициенту. - Повторите один фиксированный набор без чувствительных данных на
low,medium,highиxhigh. Запишите успех, задержку, входные токены, кэшированный ввод, выходные токены и списание. - Прогоните Grok 4.6 на том же наборе, прежде чем заменять его. Цена прайс-листа похожа. Таблица оценок неоднородна.
- Оцените один промпт чуть ниже 200,000 токенов и один чуть выше, затем прочитайте записанное списание. Лист xAI и строка каталога Modelflare сейчас не публикуют одно и то же правило длинного контекста.
- Если рабочему процессу нужны изображения, вызовы функций, потоковая передача или отмена, проверьте эти пути. Один успех только на тексте их не покрывает.
- Сохраните маршрут отката. Завершённый ответ HTTP показывает лишь то, что один вызов закончился.
Источники
Проверено 21 сентября 2026 года.
- Представление Grok 4.7
- Руководство xAI для разработчиков: Grok 4.7
- Модели и цены xAI
- Цены API xAI
- Примечания к выпускам xAI
- Усилие рассуждения
- Публичный каталог цен Modelflare,
GET https://modelflare.dev/api/pricing, модельgrok-4.7 - Более раннее руководство: API Grok 4.6, цены и контекст 500K