
Содержание3 разделов
Коротко
- Grok 4.7 обучали на более длинных задачах, в том числе многочасовых.
- Цена и скорость не изменились: $2 за миллион входных и $6 за миллион выходных токенов.
SpaceXAI, ИИ-подразделение компании Илона Маска, выпустило Grok 4.7. Основные направления у модели два: программирование и научные задачи. Разработчики сделали упор на соотношение цены и качества. Скорость и стоимость остались на уровне Grok 4.6, а результаты подросли.
Что нового в Grok 4.7 для кода и научных задач
Модель дольше обучали с подкреплением, и набор задач был труднее, в том числе такие, на которые уходят часы. На практике разработчики обещают, что Grok 4.7 чаще перепроверяет результат перед тем, как отдать ответ, и не теряет детали из начала большого проекта, когда контекст становится длинным. Заодно модель лучше ведёт обычный диалог и отвечает на вопросы на общие темы, для чат-бота это важно.
В тесте CursorBench 4.0 на долгие задачи по программированию SpaceXAI называет Grok 4.7 лидером по соотношению цены и результата. Офисные документы и презентации тоже стали лучше: в тестах GDPval и AA Briefcase модель вышла на уровень других передовых систем.
Как Grok 4.7 отвечает на опасные запросы
Отдельный кусок анонса про безопасность, и он любопытнее, чем кажется. Самое сложное здесь запросы двойного назначения: вопрос про уязвимость может задать и защитник, и взломщик. Отказывать всем подряд плохо, помогать всем подряд опасно.
В бенчмарке HackerBench v0.3 Grok 4.7 пропустила 3,3% рискованных запросов и при этом редко отказывала в легитимных задачах по защите. В биотехнологическом тесте LatchBio модель заняла первое место с 62,4%. Некоторым партнёрам SpaceXAI уже дала Grok 4.7 как инструмент для стресс-тестирования их систем защиты.
Где попробовать Grok 4.7 и сколько он стоит
Grok 4.7 доступна в редакторе Cursor, в Grok Build, через Grok API, в сторонних сервисах генерации кода и на облачных платформах. Базовая цена $2 за миллион входных и $6 за миллион выходных токенов. Есть режим с удвоенной скоростью, он стоит вдвое дороже.
Для сравнения, вышедший в тот же день Claude Opus 5.5 стоит $4 и $20. Grok заметно дешевле, но сравнивать в лоб модели разного класса бессмысленно. Если вы выбираете модель для кода, дайте обеим одну и ту же задачу из своего проекта и посмотрите, сколько времени уйдёт на доработку ответа.
Кто уже пробовал Grok в Cursor: как он вам рядом с Claude и GPT?
Источники

Как вам материал?



Комментарии