Grok 4.7 — это наша самая способная модель для программирования и интеллектуальной работы. Она дольше работает над сложными задачами, тщательнее проверяет собственные результаты и оснащена нашими самыми точными средствами защиты на сегодняшний день. При той же цене и скорости, что и у Grok 4.6, она является крайне конкурентоспособной в своем классе.
В тесте CursorBench 4.0, который оценивает более длительные задачи по программированию, Grok 4.7 находится на передовой по соотношению цены и производительности.
Улучшения модели
Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6. Она была обучена с помощью более длительного прогона обучения с подкреплением на более сложной смеси задач с упором на проблемы, требующие многих часов на выполнение. Модель лучше справляется с проверкой собственной работы и управлением более длинным контекстом. Мы также обучили Grok 4.7 нативно понимать обвязку Grok Bot, что улучшило ее показатели в диалоговых задачах и общей интеллектуальной работе.
Grok 4.7 xHigh
Grok 4.6 High
GPT-5.6 Sol Max
Fable 5.1 Max
Цена за миллион входных токенов
$10
Цена за миллион выходных токенов
$20
$50
Программная инженерия CursorBench 4.0
46.3%
40.4%
41.7%
51.8%
Программная инженерия DeepSWE v1.1
71.0%*
65.2%
72.7%
70.0%
Электротехника EEBench
64.0%
53.0%
39.4%
56.4%
Многочасовая офисная работа AA Briefcase v1.1
1,657
1,546
1,487
1,678
Многочасовая работа в терминале Terminal-Bench 4.0
37.6%
20.3%
37.3%
57.9%
Юридическая работа Harvey Legal Agent Benchmark
19.6%
15.8%
2.5%
6.7%
Клиническое рассуждение HealthBench Professional
56.7%
48.5%
60.5%
62.1%
* высокий уровень усилий
Grok 4.7 лучше справляется с созданием документов и презентаций. В GDPval и AA Briefcase искусственному интеллекту поручается выполнять задачи профессионалов, таких как юристы, медсестры и финансовые аналитики. Grok 4.7 превосходит Grok 4.6 в обоих бенчмарках и демонстрирует производительность, сопоставимую с другими передовыми моделями.
Профессиональная интеллектуальная работа
GDPval
Безопасность и кибербезопасность
Grok 4.7 создана на базе принципиально нового стека защитных механизмов. Это самая устойчивая модель из всех, что мы тестировали, в отношении отказов и устойчивости к джейлбрейку. В областях двойного назначения, таких как кибербезопасность и биология, она лидирует как по полезности для добросовестных задач, так и по безопасному отказу для опасных, возглавляя биозащитный бенчмарк LatchBio с результатом 62.4%.
Grok 4.7 сочетает в себе мощные возможности киберзащиты и низкий уровень ложных отказов для легитимного использования. Она демонстрирует высочайший уровень безопасности в HackerBench v0.3, нашем бенчмарке для рискованных и вредоносных киберзадач, пропуская лишь 3.3% рискованных запросов двойного назначения и при этом редко блокируя законную работу по безопасности. Мы также начали предоставлять избранным партнерам по кибербезопасности эксклюзивный доступ к возможностям «красной команды» (red-team) Grok 4.7 для оборонных исследований.
Цены и доступность
Grok 4.7 доступна уже сегодня в Cursor и Grok Build. Она также доступна через API Grok, сторонние среды для программирования, маршрутизаторы моделей и облачные платформы.
Стоимость модели начинается от $2 за миллион входных токенов и $6 за миллион выходных токенов. Мы также предлагаем быстрый вариант с удвоенной скоростью генерации по двойной цене.
Попробуйте бесплатно в Grok Build
Начните работу сегодня на x.ai/build.
