Новий реліз Fable від Anthropic дешевший і менш обмежений
У вівторок Anthropic випустила Fable і Mythos 5.1 — парні версії найсучаснішої моделі компанії зі штучного інтелекту. Окрім підвищення продуктивності, новий реліз Fable містить зміни, покликані знизити вартість токенів і кількість хибнопозитивних обмежень, які накладають засоби захисту моделі.
Як і попередня модель Mythos, Mythos 5.1 буде доступна лише зареєстрованим партнерам Anthropic, які займаються дослідженнями у сфері кібербезпеки або наук про життя. Fable 5.1, версія без обмежень, доступна відсьогодні на хмарних платформах або через API Anthropic.
Однією з найважливіших змін є раніше повідомлене впровадження Anthropic системи Zero Data Retention, яка дає клієнтам змогу запускати моделі Anthropic у власній інфраструктурі без витоку даних. Раніше недоступний для Fable через проблеми з безпекою сервіс із високим рівнем конфіденційності (під назвою Enterprise Frontier Safeguards) тепер стане доступним користувачам у червні. Примітно, що система й надалі відстежуватиме зловживання з боку агентів або людей-користувачів, але клієнти контролюватимуть, як саме відбуватиметься моніторинг.
У межах оголошення Anthropic запевнила клієнтів, що до їхніх даних не отримували неналежного доступу. «Anthropic ніколи не навчала моделі на корпоративних даних без чіткого дозволу й ніколи цього не робитиме», — ідеться в оголошенні.
Як це зазвичай буває з релізами Anthropic, нові моделі встановили рекорди в низці тестів, зокрема Terminal-Bench 4.0 (для програмування на основі CLI) і Humanity’s Last Exam (для загального міркування). Anthropic також оприлюднила три нові наукові результати, отримані моделями до їхнього релізу, зокрема власну оптимізацію GPU та карту Венери високої роздільної здатності, складену з наявних фотографій.
Як і попередні релізи, моделі супроводжуються детальною системною карткою, яка максимально зрозуміло пояснює їхні можливості. У системній картці Mythos оцінюється як «низькоризикова» щодо проблем, пов’язаних з автоматизованою розробкою ШІ, — коли штучний інтелект удосконалює сам себе, — що дехто вважає чинником, здатним призвести до втрати людського контролю. У ній сказано: «його здатність прискорювати внутрішній прогрес у дослідженнях і розробці ШІ відповідає поточним тенденціям».
Щодо загальної неналежної поведінки Mythos дещо більш схильна до неї, ніж Opus, можливо, через свої розширені можливості.
«Mythos 5.1 дещо гірша за Opus 5 у плані загальної неузгодженої поведінки, але краща за Mythos 5 і Claude Sonnet 5», — ідеться в системній картці. «Вона дещо охочіше співпрацює з людьми, які зловживають нею, і приймає неперевірені твердження про наявність дозволу, ніж Opus 5, але рідше ігнорує чіткі обмеження, вигадує вхідні дані або неправдиво заявляє про виконання завдань, ніж попередні моделі».
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.