Anthropic випустила Opus 5.5 з нижчими цінами та продуктивністю рівня Fable
Найновішу модель Anthropic, Opus 5.5, було випущено у вівторок, і, за словами компанії, вона встановила новий найвищий стандарт у програмуванні та виконанні інтелектуальної роботи. Opus — це найпотужніший і найдорожчий рівень у трирівневій лінійці Claude від Anthropic; Sonnet посідає середню позицію, тоді як Haiku є найшвидшою та найдешевшою моделлю. Примітно, що, як стверджує Anthropic, за багатьма тестами цей реліз випереджає більшу модель Fable і успішно впорався з низкою неформальних завдань, які Fable не змогла виконати.
Нова модель також значно дешевша за свою попередницю. Вихідні токени для Opus 5.5 коштуватимуть 20 доларів за мільйон токенів, порівняно з 25 доларами для попередньої моделі. Інші показники також мають аналогічне зниження цін. Модель також працює швидше, що відображає загальне зменшення обчислювальних ресурсів, необхідних для її обслуговування.
Нова версія також суттєво змінила спосіб спілкування Opus: Opus 5.5 рідше використовує жаргон і частіше розміщує важливу інформацію на початку своїх повідомлень.
Запуск відбувся лише через два місяці після випуску Opus 5 24 липня. Згідно з оголошенням, Sonnet 5.5 і Haiku 5.5, які є наступними рівнями в лінійці, будуть випущені «найближчими тижнями» та матимуть аналогічні покращення продуктивності.
Anthropic заявляє, що за можливостями у сфері біології та кібербезпеки Opus 5.5 можна порівняти з Mythos, тому його випуск підпадає під ті самі запобіжні заходи, що й модель Fable компанії. Ці заходи обмежують можливості використання моделей для пошуку вразливостей у скомпільованих програмах або розробки біологічної зброї, яку можна розпізнати, серед інших завдань.
Opus 5.5 — перший реліз моделі Anthropic після того, як генеральний директор компанії Даріо Амодеї підтримав заклики стримувати розвиток передових технологій, навмисно сповільнюючи вдосконалення можливостей ШІ, щоб узгодити їх із темпами прогресу у сфері вирівнювання.
«Я переконався, що для повного усунення ризиків потрібна ще більша обачність, — написав Амодеї у дописі на початку цього місяця, — не лише інвестування в запобігання ризикам, а й регулювання темпів розвитку можливостей таким чином, щоб запобігання ризикам встигало за ними».
Навчання Opus 5.5 з питань безпеки загалом було схожим на навчання його попередників і включало тестування узгодженості та передрелізне оцінювання, проведене зовнішніми організаціями, такими як METR і Frontier Design. Водночас Anthropic наголосила, що для майбутніх моделей уже готуються досконаліші системи навчання та оцінювання, зокрема покращені системи безпеки й моніторингу.
«У міру того як ШІ стає потужнішим, державна політика має відігравати більшу роль у забезпеченні безпеки систем, на які покладаються люди. Для розбудови такого потенціалу потрібен час, і ми вже почали створювати інфраструктуру для його підтримки», — йдеться в дописі в блозі. «Найближчим часом ми плануємо поділитися докладнішою інформацією про ці зусилля».
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.