Claude Fable 5.1 от Anthropic обещает более качественное программирование и исследования на 45 процентов дешевле
Ключевые моменты
- Anthropic выпустила две новые модели — Claude Fable 5.1 и Mythos 5.1, которые демонстрируют более высокую производительность в программировании и улучшенное качество текста.
- Снижение стоимости чтения кэша уменьшает расходы в целом: примерно на 25 процентов для типичных задач и вплоть до 45 процентов для сложных агентных рабочих процессов.
- Fable 5.1 превосходит предшественницу Fable 5 и конкурирующую GPT-5.6 Sol в агентных тестах. Модель уже доступна.
Anthropic выпускает Claude Fable 5.1 и Mythos 5.1 — свои самые мощные ИИ-модели на сегодняшний день. Наряду с улучшениями в агентном программировании и качестве текста компания снижает расходы вплоть до 45 процентов.
Как и их предшественницы, обе модели серии 5.1 используют одну и ту же базовую модель, но отличаются ограничениями безопасности. Fable 5.1 доступна широкому кругу пользователей, а Mythos 5.1 ограничена специальными программами доступа для сфер кибербезопасности и наук о жизни.
Это также первые модели Claude со встроенными водяными знаками. Anthropic запускает API для обнаружения в режиме закрытого предварительного тестирования, который позволяет регулирующим органам, СМИ, фактчекерам и исследовательским учреждениям проверять наличие водяного знака в тексте. Компания планирует со временем расширить доступ, а заинтересованные стороны могут зарегистрироваться здесь.
Fable 5.1 примерно на 25 процентов дешевле Fable 5 для типичных рабочих нагрузок, а для задач с интенсивным использованием агентов, предусматривающих длительные автономные сеансы с множеством вызовов инструментов, экономия достигает примерно 45 процентов. Anthropic удалось добиться этого, снизив стоимость чтения кэша с 1 до 0,25 доллара за миллион токенов. Все остальные цены API остаются неизменными: 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов. Для сравнения, Opus 5 работает по вдвое более низкой цене — 5 долларов за входные и 25 долларов за выходные токены на миллион.
Высокая стоимость была главной претензией к Fable 5 и, вероятно, способствовала тому, что модель не получила широкого распространения среди корпоративных клиентов. Ценовое давление усилилось после того, как в конце июля вышла Opus 5, которая уже соответствовала Fable 5 или превосходила её в большинстве тестов при более низкой цене. Как и предыдущие модели Claude, новые версии оснащены системой уровней усилий, регулирующей использование вычислительных ресурсов. При низком или среднем уровне усилий Fable 5.1 должна обеспечивать результаты, сопоставимые с Fable 5, но с меньшими затратами.
Значительный скачок в тестах по программированию и исследованиям
Fable 5.1 демонстрирует существенный прогресс в агентных тестах. В Terminal-Bench-Science 0.1 модель набирает 52,6 процента — более чем вдвое больше, чем Fable 5 с её результатом 24,7 процента, и значительно опережает GPT-5.6 Sol с 22,4 процента. В Terminal-Bench 4.0 для агентного программирования Fable 5.1 получает 55,8 процента, а Mythos 5.1 достигает 60,9 процента, тогда как Fable 5 набирает 42,0 процента, а GPT-5.6 Sol — 37,3 процента. В ближайшие недели станет ясно, насколько эти улучшения будут соответствовать реальному использованию в том же масштабе.
| Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol | |
|---|---|---|---|---|
| Агентные научные исследования Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Агентное программирование Terminal-Bench 4.0 | 55,8% / 60,9% (Mythos 5.1) | 42,0% | 52,3% | 37,3% |
| Интеллектуальная работа GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| Работа с компьютером OSWorld 2.0 (частичный режим) | 77,9% | 72,9% | 75,4% | — |
| Работа с компьютером OSWorld 2.0 (строгий режим) | 41,7% | 36,1% | 39,6% | — |
| Междисциплинарное рассуждение: Humanity's Last Exam (без инструментов) | 60,9% | 57,8% | 56,6% | — |
| Междисциплинарное рассуждение: Humanity's Last Exam (с инструментами) | 65,0% | 63,8% | 63,6% | — |
| Бизнес-процессы AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| Агентное программирование CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
Исследователь Anthropic Феликс Ризеберг говорит, что Fable 5.1 также улучшает стиль письма. Предыдущие модели слишком часто использовали маркированные списки и жирный текст в чате, а Fable 5.1 делает это реже, точнее следует инструкциям по стилю и в целом звучит естественнее.

Fable 5.1 открывает возможности для работы в сфере кибербезопасности
Фильтры безопасности для вопросов о кибербезопасности, биологии и медицине стали менее строгими, чем в предыдущих версиях. В моделях версии 5.0 они были настолько чувствительными, что срабатывали и на добросовестные запросы, вызывая раздражающе большое количество ложных срабатываний.
Фильтры кибербезопасности в версии 5.1 генерируют на 60 процентов меньше ложных срабатываний, а для запросов, связанных с биологией, фильтры на 85 процентов реже срабатывают на безобидные вопросы об основах биологии и медицины.
Fable 5.1 впервые может выявлять уязвимости в программном обеспечении, но не разрабатывать эксплойты. Тестирование на проникновение и создание эксплойтов по-прежнему направляются моделям Opus. Mythos также входит в Claude Security для защитных целей.
Как получить доступ к Fable 5.1 и Mythos 5.1
Claude Fable 5.1 сразу доступна на всех платформах, включая AWS, Google Cloud и Microsoft Azure. Разработчики могут получить к ней доступ через API, используя claude-fable-5-1. Для корпоративных клиентов Anthropic внедряет Enterprise Frontier Safeguards (EFS), которые хранят данные клиентов исключительно в собственной облачной инфраструктуре клиента.
Claude Mythos 5.1 в настоящее время доступна только организациям из США через две программы: Cyber Verification Program для защитных задач в сфере безопасности и Life Sciences Verification Program, разработанную совместно с правительством США. Anthropic планирует расширить доступ для международных партнёров.
Anthropic также ужесточает борьбу с атаками дистилляции, в ходе которых возможности модели систематически извлекаются через тысячи поддельных аккаунтов. Новые аккаунты API больше не могут редактировать предыдущий контекст Claude в многошаговых беседах, сохраняя при этом расшифровку процесса рассуждений, что, согласно Anthropic, закрывает задокументированный метод дистилляции.
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, эксклюзивный годовой отчёт о передовых разработках «AI Radar» шесть раз в год, полный доступ к архиву и возможность оставлять комментарии.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.