xAI на Илон Мъск представи Grok 4.7 — най-способния си досега модел за програмиране и работа със знания. Според компанията той е изграден върху по-голям базов модел, обучен с по-продължително обучение с подсилване и проектиран така, че да проверява по-добре собствените си резултати. Цената е 2 долара за един милион входни токени и 6 долара за един милион изходни токени. Тези тарифи са по-близки до тези на китайските модели, отколкото до тарифите на водещите западни модели — вероятно с основание. В независимия индекс за интелигентност на Artificial Analysis (v4.3.2), който обединява десет бенчмарка, Grok 4.7 получава 46 точки и се нарежда в средата на класацията. Claude Fable 5.1 и GPT-6 водят с по 53 точки.
Grok 4.7 (в черно) получава общ резултат 46 — значително зад Claude Fable 5.1 и GPT-6, които имат по 53 точки. Изглежда, че двете му най-високи нива на разсъждение се представят приблизително еднакво. | Изображение: Artificial Analysis
Разликата става още по-голяма при агентното програмиране. В Terminal-Bench 4.0 Grok 4.7 постига едва 26 процента спрямо 60 процента за GPT-6 Astra и 55 процента за Claude Fable 5.1. Дори по-евтиният DeepSeek V4.1 Flash го изпреварва с 27 процента. Моделът е достъпен чрез Grok API, Cursor и Grok Build.
Grok 4.7 получава 26 процента на теста за агентно програмиране Terminal-Bench 4.0 — значително зад GPT-6 Astra (60 процента) и Claude Fable 5.1 (55 процента). | Изображение: Artificial Analysis
AI новини без сензация – подбрани от хора
Абонирайте се за THE DECODER за четене без реклами, седмичен бюлетин за AI, ексклузивния ни водещ доклад „AI Radar“ шест пъти годишно, пълен достъп до архива и достъп до секцията за коментари.