Claude Fable 5.1 від Anthropic обіцяє краще програмування та дослідження до 45 відсотків дешевше
Основні моменти
- Anthropic випустила дві нові моделі — Claude Fable 5.1 і Mythos 5.1, які демонструють кращі результати в програмуванні та вищу якість тексту.
- Зниження вартості читання кешу скорочує витрати за всіма напрямами: приблизно на 25 відсотків для типових завдань і до 45 відсотків для складних агентних робочих процесів.
- Fable 5.1 перевершує свою попередницю Fable 5 і конкурента GPT-5.6 Sol на агентних тестах. Модель уже доступна.
Anthropic представляє Claude Fable 5.1 і Mythos 5.1 — свої найпотужніші на сьогодні моделі ШІ. Окрім покращень в агентному програмуванні та якості тексту, компанія знижує витрати до 45 відсотків.
Як і їхні попередниці, обидві моделі версії 5.1 мають однакову базову модель, але відрізняються запобіжниками безпеки. Fable 5.1 доступна широкому загалу, тоді як Mythos 5.1 обмежена спеціальними програмами доступу для кібербезпеки та наук про життя.
Це також перші моделі Claude із вбудованими водяними знаками. Anthropic запускає API виявлення у форматі приватного попереднього перегляду, який дає змогу регуляторам, медіа, фактчекерам і науково-дослідним установам перевіряти, чи містить текст водяний знак. Компанія планує поступово розширювати доступ, а зацікавлені сторони можуть зареєструватися тут.
Fable 5.1 коштує приблизно на 25 відсотків дешевше за Fable 5 для типових робочих навантажень, а для завдань із високим рівнем агентності, що передбачають тривалі автономні запуски з великою кількістю викликів інструментів, економія зростає приблизно до 45 відсотків. Anthropic змогла цього досягти, знизивши вартість читання кешу з 1 до 0,25 долара за мільйон токенів. Усі інші ціни API залишаються без змін: 10 доларів за мільйон вхідних токенів і 50 доларів за мільйон вихідних токенів. Для порівняння, Opus 5 працює за вдвічі нижчою ціною — 5 доларів за мільйон вхідних і 25 доларів за мільйон вихідних токенів.
Висока вартість була найбільшою претензією до Fable 5 і, ймовірно, сприяла тому, що модель мала низький рівень впровадження серед корпоративних клієнтів. Ціновий тиск посилюється відтоді, як наприкінці липня вийшла Opus 5, яка вже за нижчою ціною зрівнялася або перевершила Fable 5 у більшості тестів. Як і попередні моделі Claude, нові версії мають систему рівнів зусиль, яка контролює використання обчислювальних ресурсів. За низького або середнього рівня зусиль Fable 5.1 має показувати результати на рівні Fable 5 за нижчою ціною.
Значний прорив у тестах із програмування та досліджень
Fable 5.1 демонструє значне покращення на агентних тестах. У Terminal-Bench-Science 0.1 модель набирає 52,6 відсотка — більш ніж удвічі більше за результат Fable 5 у 24,7 відсотка та значно випереджає GPT-5.6 Sol із 22,4 відсотка. У Terminal-Bench 4.0 для агентного програмування Fable 5.1 отримує 55,8 відсотка, а Mythos 5.1 — 60,9 відсотка, порівняно з 42,0 відсотка у Fable 5 і 37,3 відсотка у GPT-5.6 Sol. Чи трансформуються ці покращення у практичне використання в такому ж масштабі, стане зрозуміло протягом найближчих тижнів.
| Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol | |
|---|---|---|---|---|
| Агентні наукові дослідження Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Агентне програмування Terminal-Bench 4.0 | 55,8% / 60,9% (Mythos 5.1) | 42,0% | 52,3% | 37,3% |
| Інтелектуальна праця GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| Робота з комп’ютером OSWorld 2.0 (частковий) | 77,9% | 72,9% | 75,4% | — |
| Робота з комп’ютером OSWorld 2.0 (суворий) | 41,7% | 36,1% | 39,6% | — |
| Мультидисциплінарне міркування: Humanity's Last Exam (без інструментів) | 60,9% | 57,8% | 56,6% | — |
| Мультидисциплінарне міркування: Humanity's Last Exam (з інструментами) | 65,0% | 63,8% | 63,6% | — |
| Бізнес-робочі процеси AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| Агентне програмування CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
Дослідник Anthropic Фелікс Різеберг каже, що Fable 5.1 також покращила стиль написання. Попередні моделі надто часто використовували марковані списки та жирний текст у чаті, а Fable 5.1 робить це рідше, точніше дотримується стильових інструкцій і загалом звучить природніше.

Fable 5.1 відкриває можливості для роботи з кібербезпекою
Фільтри безпеки для запитань про кібербезпеку, біологію та медицину стали менш агресивними, ніж у попередніх версіях. У моделях версії 5.0 вони були настільки чутливими, що спрацьовували навіть на доброзичливі запити, створюючи дратівливо велику кількість хибних спрацьовувань.
Фільтри кібербезпеки у версії 5.1 генерують на 60 відсотків менше хибних спрацьовувань, а для запитів, пов’язаних із біологією, фільтри на 85 відсотків рідше спрацьовують на нешкідливі запитання про базову біологію та медицину.
Fable 5.1 тепер уперше може виявляти вразливості програмного забезпечення, хоча й не розробляти експлойти. Тестування на проникнення та створення експлойтів і надалі спрямовуватимуться до моделей Opus. Mythos також є частиною Claude Security для оборонних цілей.
Як отримати доступ до Fable 5.1 і Mythos 5.1
Claude Fable 5.1 уже доступна на всіх платформах, зокрема AWS, Google Cloud і Microsoft Azure. Розробники можуть отримати до неї доступ через API, використовуючи claude-fable-5-1. Для корпоративних клієнтів Anthropic впроваджує Enterprise Frontier Safeguards (EFS), які зберігають дані клієнтів виключно у власній хмарній інфраструктурі клієнта.
Claude Mythos 5.1 наразі доступна лише американським організаціям через дві програми: Cyber Verification Program для оборонної роботи у сфері безпеки та Life Sciences Verification Program, розроблену спільно з урядом США. Anthropic планує розширити доступ для міжнародних партнерів.
Anthropic також посилює боротьбу з атаками дистиляції, під час яких можливості моделі систематично вилучаються за допомогою тисяч фальшивих облікових записів. Нові облікові записи API більше не можуть редагувати попередній контекст Claude у багатотурових розмовах, зберігаючи при цьому стенограму міркувань, що, за словами Anthropic, блокує задокументований метод дистиляції.
Новини ШІ без хайпу — відібрані людьми
Підпишіться на THE DECODER, щоб читати без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний звіт про передові технології «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.