Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

SpaceXAI пуска Grok 4.7: По-голям базов модел на същата цена от $2/$6 като Grok 4.6

SpaceXAI пусна Grok 4.7 — своя нов водещ модел за програмиране, агентни задачи и интелектуален труд. Grok 4.7 е изграден върху по-голям базов модел и по-продължително обучение с подсилване. Той се предлага на същата цена и със същата скорост като Grok 4.6.

Може ли да бъде внедрен? Да, като хостван модел. Днес можете да използвате grok-4.7 чрез API на xAI, Cursor, Grok Build, OpenRouter, Vercel и Cloudflare.

Какво се промени под капака

SpaceXAI посочва 4 промени спрямо Grok 4.6:

  1. Нов, по-голям базов модел: Grok 4.7 не използва повторно базовия модел на Grok 4.6.
  2. По-продължително обучение с подсилване върху по-трудни задачи: Съставът на задачите е насочен към проблеми, чието решаване отнема много часове.
  3. По-добра самопроверка и работа с дълъг контекст: Компанията заявява, че моделът проверява работата си по-внимателно.
  4. Вградена поддръжка на Grok Bot harness: Моделът е обучен да разбира Grok Bot harness за разговори и интелектуален труд.

Документацията за разработчици посочва спецификациите на API:

СвойствоСтойност
Име на моделаgrok-4.7
Контекстен прозорец500 000 токена
Краен срок на знаниятамай 2026 г.
МодалностиТекстов и графичен вход, текстов изход
Ниво на разсъждениениско, средно, високо (по подразбиране), xhigh
APIResponses API, Chat Completions
ИнструментиИзвикване на функции, уеб търсене, търсене в X, изпълнение на код

Бенчмаркове

Таблицата при представянето сравнява Grok 4.7 при ниво xHigh с Grok 4.6 High, GPT-5.6 Sol Max и Fable 5.1 Max. Резултатът на Grok 4.7 в DeepSWE е получен при високо ниво на усилие. Всички резултати са предоставени от доставчиците.

БенчмаркGrok 4.7 xHighGrok 4.6 HighGPT-5.6 Sol MaxFable 5.1 Max
Цена за вход ($/M)$2$2$4$10
Цена за изход ($/M)$6$6$20$50
CursorBench 4.046.3%40.4%41.7%51.8%
DeepSWE v1.171.0%*65.2%72.7%70.0%
EEBench64.0%53.0%39.4%56.4%
AA Briefcase v1.11,6571,5461,4871,678
Terminal-Bench 4.038.0%20.3%37.3%57.9%
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%
HealthBench Professional56.7%48.5%60.5%62.1%

*Високо ниво на усилие

Grok 4.7 се подобрява спрямо Grok 4.6 във всеки ред. Най-големият скок е при Terminal-Bench 4.0 — от 20.3% на 38.0%. EEBench се повишава с 11 пункта до 64.0%, което е най-високият резултат в таблицата. В бенчмарка за правни агенти на Harvey Grok 4.7 постига 19.6% спрямо 6.7% за Fable 5.1 Max.

Grok 4.7 не води във всички категории. Fable 5.1 Max е начело в 4 от 7 бенчмарка, включително с резултат от 57.9% на Terminal-Bench. GPT-5.6 Sol Max държи най-високия резултат в DeepSWE v1.1 — 72.7%.

Цената е другият фактор. Fable 5.1 Max струва 5 пъти повече за вход и около 8.3 пъти повече за изход. GPT-5.6 Sol Max струва 2 пъти повече за вход и около 3.3 пъти повече за изход. В графика на CursorBench 4.0 за разходите на задача SpaceXAI позиционира Grok 4.7 на водещата граница по съотношение цена-ефективност.

В GDPval, който тества професионален интелектуален труд, Grok 4.7 xhigh постига 1,695 Elo. Това е увеличение спрямо 1,605 за Grok 4.6 high. Fable 5.1 max е начело с 1,735, а GPT-6 Astra max постига 1,542. SpaceXAI също заявява, че Grok 4.7 е по-добър при създаването на документи и презентации.

Безопасност и киберсигурност

Grok 4.7 се предлага с изцяло нов набор от защитни механизми. SpaceXAI го определя като най-силния модел, който е тествала по отношение на отказите и устойчивостта срещу jailbreak атаки. Той заема първо място в биобезопасностния бенчмарк на LatchBio с резултат 62.4%.

В HackerBench v0.3 — собствения бенчмарк на SpaceXAI за рискови и злонамерени киберзадачи — моделът е пропуснал 3.3% от рисковите заявки с двойна употреба. Компанията заявява, че рядко блокира легитимна работа по сигурността. Избрани партньори в областта на киберсигурността вече получават достъп само с покана до възможностите му за red-team тестване с цел изследвания в областта на защитата.

Цена и наличност

Grok 4.7 струва $2 за един милион входни токена и $6 за един милион изходни токена. Той е наличен в Cursor за всички планове и е моделът по подразбиране в Grok Build. Предлага се и чрез Grok API, OpenRouter, Vercel и Cloudflare.

Grok 4.7 Fast е същият модел, работещ върху по-бърза инфраструктура, с два пъти по-висока скорост на изхода при двойно по-висока цена. В документацията се посочва, че той работи само в Cursor и Grok Build, а не в публичния API на xAI. Също така е изключен от безплатния план на Grok Build.

Регионален endpoint за САЩ на адрес https://us.api.x.ai/v1 запазва обработката на заявките в Съединените щати срещу 10% надценка. SpaceXAI препоръчва да зададете prompt_cache_key за надеждно използване на кеша.

Копиране на кодКопираноИзползвайте друг браузър
import os
from xai_sdk import Client
from xai_sdk.chat import user

client = Client(api_key=os.getenv("XAI_API_KEY"))
chat = client.chat.create(model="grok-4.7")
chat.append(user("Explain this repo."))
print(chat.sample().content)

Интерактивно обяснение

Основни изводи

  • Grok 4.7 запазва цената на Grok 4.6 — $2 за вход и $6 за изход на един милион токена.
  • Той води в таблицата при представянето в EEBench (64.0%) и Harvey Legal Agent Benchmark (19.6%).
  • Fable 5.1 Max все още е начело в 4 от 7 бенчмарка, включително Terminal-Bench 4.0.
  • API предлага контекстен прозорец от 500 000 токена и 4 нива на разсъждение до xhigh.
  • Само 3.3% от рисковите заявки с двойна употреба са преминали в HackerBench v0.3 на SpaceXAI.

Разгледайте съобщението, документацията и публикацията в X. Цялата заслуга принадлежи на изследователя на този проект. Също така, не се колебайте да ни последвате в Twitter и не забравяйте да се присъедините към нашия 150k+ ML SubReddit и да се абонирате за нашия бюлетин. Чакайте! В Telegram ли сте? Сега можете да се присъедините към нас и в Telegram.

Имате нужда от партньор за популяризиране на вашето GitHub хранилище ИЛИ страница в Hugging Face ИЛИ продуктово представяне ИЛИ уебинар и т.н.? Свържете се с нас

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от MarkTechPost на

Прочетете оригинала в MarkTechPost ↗

Текстът и изображенията са собственост на MarkTechPost и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини