Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← Към новините

Claude Fable 5.1 на Anthropic обещава по-добро програмиране и проучване с до 45 процента по-ниска цена

Anthropic's Claude Fable 5.1 promises better coding and research at up to 45 percent less
Матияс Бастиан
1 септември 2026 г.

Основни моменти

  • Anthropic пусна два нови модела — Claude Fable 5.1 и Mythos 5.1, които предлагат по-добри резултати при програмиране и по-високо качество на текста.
  • По-евтиното четене на кеша намалява разходите навсякъде, спестявайки около 25 процента при типични задачи и до 45 процента при сложни агентни работни процеси.
  • Fable 5.1 превъзхожда предшественика си Fable 5 и конкурента GPT-5.6 Sol при агентни бенчмаркове. Моделът вече е наличен.

Anthropic представя Claude Fable 5.1 и Mythos 5.1 — най-способните си досега модели с изкуствен интелект. Наред с подобренията в агентното програмиране и качеството на текста, компанията намалява разходите с до 45 процента.

Подобно на предшествениците си, двата модела от серията 5.1 споделят един и същ базов модел, но се различават по защитните механизми за безопасност. Fable 5.1 е широко достъпен, докато Mythos 5.1 е ограничен до специални програми за достъп за нуждите на киберсигурността и науките за живота.

Те са и първите модели Claude, които се предлагат с вградени водни знаци. Anthropic пуска API за откриване в частен предварителен преглед, който позволява на регулатори, медии, проверители на факти и изследователски институции да проверяват дали даден текст съдържа водния знак. Компанията планира постепенно да разшири достъпа, а заинтересованите страни могат да се регистрират тук.

Fable 5.1 струва около 25 процента по-малко от Fable 5 при типични работни натоварвания, като спестяванията достигат приблизително 45 процента при задачи с интензивно използване на агенти, включващи дълги автономни изпълнения с множество извиквания на инструменти. Anthropic постигна това, като намали цената за четене на кеша от 1 на 0,25 долара за милион токени. Всички останали цени за API остават непроменени — 10 долара за милион входни токени и 50 долара за милион изходни токени. За сравнение, Opus 5 работи на половината от тази цена — 5 долара за входни и 25 долара за изходни токени на милион.

Високата цена беше най-голямото оплакване към Fable 5 и вероятно допринесе за слабото приемане на модела сред корпоративните клиенти. Ценовият натиск се натрупва от пускането на Opus 5 в края на юли, който още тогава се изравняваше с Fable 5 или го превъзхождаше в повечето бенчмаркове на по-ниска цена. Подобно на по-ранните модели Claude, новите версии разполагат със система за нива на усилие, която контролира използването на изчислителни ресурси. При ниско или средно ниво на усилие Fable 5.1 би трябвало да постига резултатите на Fable 5 на по-ниска цена.

Големи скокове в бенчмарковете за програмиране и изследвания

Fable 5.1 постига значителни подобрения в агентните бенчмаркове. В Terminal-Bench-Science 0.1 моделът достига 52,6 процента — повече от два пъти резултата на Fable 5 от 24,7 процента и значително пред GPT-5.6 Sol с 22,4 процента. В Terminal-Bench 4.0 за агентно програмиране Fable 5.1 постига 55,8 процента, докато Mythos 5.1 достига 60,9 процента, в сравнение с 42,0 процента за Fable 5 и 37,3 процента за GPT-5.6 Sol. Дали тези подобрения ще се пренесат в реалната употреба в същия мащаб, ще стане ясно през следващите седмици.

Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Агентни научни изследвания Terminal-Bench-Science 0.1 52,6% 24,7% 29,0% 22,4%
Агентно програмиране Terminal-Bench 4.0 55,8% / 60,9% (Mythos 5.1) 42,0% 52,3% 37,3%
Интелектуален труд GDPval-AA v2 1853 1723 1824 1711
Използване на компютър OSWorld 2.0 (частично) 77,9% 72,9% 75,4%
Използване на компютър OSWorld 2.0 (строго) 41,7% 36,1% 39,6%
Мултидисциплинарно разсъждение: Humanity's Last Exam (без инструменти) 60,9% 57,8% 56,6%
Мултидисциплинарно разсъждение: Humanity's Last Exam (с инструменти) 65,0% 63,8% 63,6%
Бизнес работни процеси AutomationBench 31,4% 17,1% 26,9% 19,6%
Агентно програмиране CursorBench 3.2.0 73,4% 70,5% 70,0% 67,2%

Изследователят на Anthropic Феликс Ризеберг казва, че Fable 5.1 подобрява и стила си на писане. По-ранните модели разчитаха прекалено много на списъци и удебелен текст в чатовете, докато Fable 5.1 ограничава тази тенденция, следва по-отблизо стиловите инструкции и като цяло звучи по-естествено.

Claude Fable 5.1 оглавява индекса Artificial Analysis Intelligence с резултат 66, пред Claude Opus 5 с 63 и GPT-5.6 Sol с 61. | Изображение: Artificial Analysis

Fable 5.1 се отваря за работа в сферата на киберсигурността

Филтрите за безопасност при въпроси, свързани с киберсигурност, биология и медицина, са по-малко агресивни от тези в по-ранните версии. При моделите 5.0 те бяха толкова чувствителни, че се задействаха и при добронамерени заявки, което водеше до разочароващо висок процент фалшиви положителни резултати.

Филтрите за киберсигурност във версия 5.1 генерират с 60 процента по-малко фалшиви положителни резултати, а при заявки, свързани с биология, филтрите се задействат с 85 процента по-рядко при безобидни въпроси за основи на биологията и медицината.

Fable 5.1 вече може за първи път да идентифицира уязвимости в софтуера, макар че не може да разработва експлойти. Тестовете за проникване и генерирането на експлойти все още се насочват към моделите Opus. Mythos също е част от Claude Security за отбранителни цели.

Как да получите достъп до Fable 5.1 и Mythos 5.1

Claude Fable 5.1 е достъпен незабавно на всички платформи, включително AWS, Google Cloud и Microsoft Azure. Разработчиците могат да получат достъп до него чрез API, използвайки claude-fable-5-1. За корпоративните клиенти Anthropic въвежда Enterprise Frontier Safeguards (EFS), които съхраняват данните на клиентите единствено в собствената облачна инфраструктура на клиента.

Claude Mythos 5.1 понастоящем е ограничен до организации в САЩ чрез две програми: Cyber Verification Program за отбранителна работа в сферата на сигурността и Life Sciences Verification Program, разработена съвместно с правителството на САЩ. Anthropic планира да разшири достъпа до международни партньори.

Anthropic също така засилва борбата с атаките за дестилация, при които възможностите на даден модел се извличат систематично чрез хиляди фалшиви акаунти. Новите API акаунти вече не могат да редактират предишния контекст на Claude в разговори с множество обмени, като същевременно запазват стенограмата на разсъжденията — мярка, която според Anthropic блокира документирана техника за дестилация.

Новини за изкуствения интелект без сензации – подбрани от хора

Абонирайте се за THE DECODER и получете четене без реклами, седмичен бюлетин за изкуствения интелект, нашия ексклузивен шест пъти годишно доклад за водещите технологии „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.

Източник: Anthropic

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Decoder на

Прочетете оригинала в The Decoder ↗

Текстът и изображенията са собственост на The Decoder и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини