Anthropic выпустила Opus 5.5 с более низкими ценами и производительностью уровня Fable
Новейшая модель Anthropic, Opus 5.5, была выпущена во вторник, установив новый отраслевой рекорд по показателям в программировании и интеллектуальной работе, заявила компания. Opus — наиболее мощный и дорогой уровень в трёхуровневой линейке Claude от Anthropic; Sonnet занимает среднее положение, а Haiku является самой быстрой и дешёвой моделью. Примечательно, что, по словам Anthropic, новая модель превосходит более крупную модель Fable во многих тестах и успешно справилась с рядом неформальных задач, которые Fable выполнить не смогла.
Новая модель также значительно дешевле предшественницы. За выходные токены Opus 5.5 будет взиматься плата в размере 20 долларов за миллион токенов по сравнению с 25 долларами за предыдущую модель. Другие показатели также подешевели примерно в той же степени. Модель работает быстрее, что отражает общее снижение вычислительных ресурсов, необходимых для её обслуживания.
Новая версия также существенно изменила стиль общения Opus: Opus 5.5 реже использует жаргон и чаще помещает важную информацию в начало своих сообщений.
Запуск состоялся всего через два месяца после выхода Opus 5 24 июля. Согласно объявлению, Sonnet 5.5 и Haiku 5.5 — следующие уровни в линейке — будут выпущены «в ближайшие недели» и получат аналогичные улучшения производительности.
Anthropic заявляет, что Opus 5.5 сопоставима с Mythos по возможностям в области биологии и кибербезопасности, поэтому её выпуск подпадает под те же меры защиты, что и модель Fable компании. Эти меры ограничивают возможности использования моделей для обнаружения уязвимостей в скомпилированных программах или разработки биологического оружия, которое можно распознать, а также для выполнения других задач.
Opus 5.5 — первая модель Anthropic, выпущенная после того, как генеральный директор компании Дарио Амодеи поддержал призывы сдерживать темпы развития передовых моделей, намеренно замедляя прогресс в области возможностей ИИ, чтобы привести его в соответствие с темпами развития методов согласования.
«Я пришёл к убеждению, что для полного устранения рисков требуется ещё большая осторожность, — написал Амодеи в публикации ранее в этом месяце, — не только инвестировать в предотвращение рисков, но и регулировать темпы развития возможностей таким образом, чтобы предотвращение рисков успевало за ним».
Обучение безопасности Opus 5.5 в целом было аналогично обучению её предшественниц: оно включало тестирование согласования и предрелизную оценку со стороны внешних организаций, таких как METR и Frontier Design. Однако Anthropic подчеркнула, что для будущих моделей уже готовятся более совершенные системы обучения и оценки, включая улучшенные системы безопасности и мониторинга.
«По мере того как ИИ становится более мощным, государственная политика должна играть более значительную роль в обеспечении безопасности систем, на которые рассчитывают люди. Создание соответствующих возможностей требует времени, и мы уже начали закладывать инфраструктуру для их поддержки, — говорится в публикации в блоге. — Мы рассчитываем вскоре поделиться дополнительными подробностями об этих усилиях».
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.