xAI Ілона Маска представила Grok 4.7 — свою найпотужнішу на сьогодні модель для програмування та інтелектуальної роботи. За словами компанії, вона створена на основі більшої базової моделі, навчалася за допомогою тривалішого підкріплювального навчання та розроблена для кращої перевірки власних результатів. Ціна становить 2 долари за мільйон вхідних токенів і 6 доларів за мільйон вихідних токенів. Ці тарифи ближчі до цін на китайські моделі, ніж до цін на передові західні моделі, імовірно, не без причини. У незалежному індексі інтелекту Artificial Analysis (v4.3.2), який об’єднує десять бенчмарків, Grok 4.7 набирає 46 балів і посідає місце в середині рейтингу. Claude Fable 5.1 і GPT-6 лідирують, набравши по 53 бали.
Grok 4.7 (чорний) набирає загалом 46 балів, значно поступаючись Claude Fable 5.1 і GPT-6, які набрали по 53. Два його найвищі рівні міркування, схоже, працюють приблизно однаково. | Зображення: Artificial Analysis
У програмуванні з використанням агентів розрив стає ще більшим. У Terminal-Bench 4.0 Grok 4.7 набирає лише 26 відсотків проти 60 відсотків у GPT-6 Astra та 55 відсотків у Claude Fable 5.1. Навіть дешевша DeepSeek V4.1 Flash випереджає її з результатом 27 відсотків. Модель доступна через Grok API, Cursor і Grok Build.
Grok 4.7 набирає 26 відсотків у тесті агентського програмування Terminal-Bench 4.0, значно поступаючись GPT-6 Astra (60 відсотків) і Claude Fable 5.1 (55 відсотків). | Зображення: Artificial Analysis
Новини ШІ без зайвого галасу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний шість разів на рік звіт про передові технології «AI Radar», повний доступ до архіву та доступ до розділу коментарів.