Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← До новин

Meta наближається до лідерів із Muse Spark 1.3 і знижує ціну порівняно з конкурентами

Meta наближається до лідерів із Muse Spark 1.3 і знижує ціни порівняно з конкурентами
Максиміліан Шрайнер
3 вересня 2026
Nano Banana Pro за запитом THE DECODER

Ключові моменти

  • Meta випустила Muse Spark 1.3. Рівень xhigh уже доступний, а потужніша версія max поки що працює в режимі обмеженого попереднього перегляду.
  • Модель найбільше покращилася в агентних завданнях, але все ще поступається лідерам на кшталт Claude Fable 5.1 у більшості тестів.
  • За ціни $0,55 за завдання це наразі найдешевша модель у своєму класі за продуктивністю. Meta також повідомляє, що готується версія з відкритими вагами.

Meta випустила Muse Spark 1.3, свою четверту модель за п’ять місяців. Незалежне тестування показує значний прогрес в агентних завданнях, але відставання від лідерів зберігається. Модель приваблює своєю ціною.

Meta випустила Muse Spark 1.3 через Muse Code і Meta Model API. Серія стартувала у квітні, у липні вийшла версія 1.1, а в серпні — 1.2. Рівень xhigh уже доступний, тоді як більш вимогливий до обчислень рівень max з’явиться лише після додаткового тестування безпеки й наразі доступний партнерам у режимі обмеженого попереднього перегляду, згідно з Artificial Analysis.

За незмінної ціни $1,25 і $4,25 за мільйон вхідних і вихідних токенів одне індексне завдання коштує $0,55. Жодна модель із результатом 59 балів або вище не є дешевшою, а конкуренти на тому самому рівні індексу коштують від $0,94 до $1,23. Muse Spark 1.3 справді дорожча за версію 1.2, яка коштувала $0,40.

Приріст зосереджений там, де індекс приносить результат

В Індексі інтелекту версія max набирає 62 бали, а xhigh — 61, порівняно з 57 у серпні та 53 у липні. Стрибок пояснюється тим, як індекс зважує свої тести. На GDPval-AA v2 припадає 20 відсотків, на Terminal-Bench 2.1 — 16 відсотків, а на τ³-Bench Banking — 14 відсотків, і найбільший прогрес Meta припадає саме на ці три тести.

У τ³-Banking, де агенти використовують інструменти в змодельованому банківському середовищі, max досягає 52 відсотків. За даними Artificial Analysis, це наразі перше місце, і це єдина беззаперечна перевага моделі. Доступний рівень xhigh досягає 47 відсотків, зрівнюючись із Claude Fable 5.1 (max) і GLM-5.3-Flash, а не випереджаючи їх. Попередня версія 1.2 мала результат 35 відсотків.

Terminal-Bench 2.1, який перевіряє програмування в терміналі, підвищується з 80 до 85 відсотків у xhigh і до 86 у max, але Claude Fable 5.1 все ще посідає перше місце з результатом 91,4 відсотка у своєму рівні max, 91,0 у xhigh і 89,9 у high. У тесті GDPval-AA v2, що має найбільшу вагу в індексі, Meta покращує результат із 1 615 до 1 709 і 1 754 за шкалою, відкаліброваною за показниками людей-експертів на рівні 1 000 у 220 реальних професійних завданнях. Claude Fable 5.1 (max) набирає 1 853. Meta купує перевагу варіанта max обчислювальними ресурсами, витрачаючи на 62 відсотки більше токенів міркування, ніж xhigh.

Зображення: Artificial Analysis

Поза агентними тестами модель залишається в середині списку

У GPQA Diamond, який містить наукові запитання експертного рівня, Muse Spark підвищує результат із 90 до 94 відсотків. Це група лідерів, але все ще нижче за Gemini 3.8 Flash (high) із результатом 95,3 і Grok 4.6 (high) із 94,9. CritPt, що охоплює дослідницьку фізику, зростає з 18 до 26 відсотків, значно поступаючись GPT-5.6 Sol (max) із 32,3 і Claude Fable 5.1 (xhigh) із 31,1 відсотка.

Два показники фактично погіршилися порівняно з версією 1.2. AA-LCR знизився з 83 до 79 відсотків. Фактична точність в AA-Omniscience зменшилася на три пункти, оскільки модель частіше відмовляється відповідати, коли не впевнена.

Ні Meta, ні Artificial Analysis поки не назвали ціну варіанта max. Більші моделі та версія з відкритими вагами вже готуються.

Новини ШІ без хайпу — відібрані людьми

Підпишіться на THE DECODER, щоб читати без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний звіт про передові технології «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.

Джерело: Meta / Muse Spark 1.3 | Artificial Analysis / Індекс інтелекту

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням The Decoder

Читати оригінал на The Decoder ↗

Текст і зображення належать The Decoder і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини