xAI Илона Маска представила Grok 4.7 — свою наиболее мощную модель для программирования и интеллектуальной работы. По словам компании, она создана на основе более крупной базовой модели, обучалась с использованием более продолжительного обучения с подкреплением и призвана лучше проверять собственные результаты. Стоимость составляет 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов. Эти расценки ближе к китайским моделям, чем к передовым западным моделям, вероятно, не без причины. В независимом индексе интеллекта Artificial Analysis (v4.3.2), который объединяет результаты десяти бенчмарков, Grok 4.7 набирает 46 баллов и занимает место в середине рейтинга. Claude Fable 5.1 и GPT-6 лидируют, набрав по 53 балла.
Grok 4.7 (чёрный) набирает в общей сложности 46 баллов, значительно отставая от Claude Fable 5.1 и GPT-6, набравших по 53 балла. Два его самых высоких уровня рассуждений, по-видимому, показывают примерно одинаковые результаты. | Изображение: Artificial Analysis
В агентном программировании разрыв становится ещё больше. В Terminal-Bench 4.0 Grok 4.7 набирает всего 26 процентов против 60 процентов у GPT-6 Astra и 55 процентов у Claude Fable 5.1. Даже более дешёвая модель DeepSeek V4.1 Flash опережает её, набирая 27 процентов. Модель доступна через API Grok, Cursor и Grok Build.
Grok 4.7 набирает 26 процентов в тесте агентного программирования Terminal-Bench 4.0, значительно отставая от GPT-6 Astra (60 процентов) и Claude Fable 5.1 (55 процентов). | Изображение: Artificial Analysis
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, эксклюзивный ежегодный отчёт о передовых разработках «AI Radar», выходящий шесть раз в год, полный доступ к архиву и возможность оставлять комментарии.