Claude Opus 5.5 се изравнява по производителност с Fable 5.1 на по-ниска цена и обещава по-малко писане в стил „Claudish“
Anthropic представя Claude Opus 5.5, първия модел от ново семейство. Компанията заявява, че той осигурява производителност на нивото на Claude Fable 5.1, като същевременно струва значително по-малко и работи по-бързо от предшественика си.
Според Anthropic Opus 5.5 се изравнява с Claude Fable 5.1 „при повечето задачи“, като разходите за работата му са с около 40 процента по-ниски от тези на Opus 5. Очаква се Claude Sonnet 5.5 и Haiku 5.5 да излязат през следващите седмици, с подобни подобрения в производителността, ефективността и безопасността. Бенчмарковете на Anthropic показват, че новият модел Opus превъзхожда както Fable 5.1, така и значително по-скъпия GPT-6 Astra на OpenAI при повечето задачи.
| Бенчмарк / възможност | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Агентно програмиране Terminal-Bench 4.0[1] |
66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| Агентно програмиране FrontierCode v1.1 (Main) |
54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| Агентно програмиране CursorBench 4.0 |
57.8% | 51.8% | 46.6% | N/A | 41.7% |
| Работа със знания GDPval-AA v2.1 |
1,846 | 1,735 | 1,708 | 1,542 | 1,588 |
| Бизнес работни процеси AutomationBench[1] |
40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Мултидисциплинарно разсъждение Humanity's Last Exam |
67.7% (с инструменти) |
65.6% (с инструменти) |
63.6% (с инструменти) |
57.2% (с инструменти) |
N/A |
| Агентни научни изследвания Terminal-Bench-Science 0.1[1] |
58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| Използване на компютър OSWorld 2.0 |
81.8% (частично) |
80.7% (частично) |
74.0% (частично) |
N/A | N/A |
| Разпознаване на визуални диаграми Chartography |
89.0% (с инструменти) |
88.4% (с инструменти) |
83.4% (с инструменти) |
N/A | N/A |
Anthropic заявява, че новата серия основно отговаря на обратната връзка от клиентите относно цената, ефективността и качеството на комуникацията, особено във финансовите услуги, правото и разработката на софтуер.
По-ниски цени и по-малко използвани токени намаляват оперативните разходи
Anthropic определя цена за Opus 5.5 от 4 долара за милион входни токени и 20 долара за милион изходни токени, спрямо съответно 5 и 25 долара за Opus 5. Това е 20-процентно намаление на цените на токените. Компанията също така е намалила разходите за четене на кеша с 60 процента.
Anthropic заявява, че общите оперативни разходи, които включват както цените на токените, така и използваното количество токени, би трябвало да са с около 40 процента по-ниски от тези на Opus 5. Моделът използва по-малко токени и генерира резултат с над 30 процента по-висока скорост.
| Цени за 1 млн. токена | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Четене на кеша | $0.20 | $0.50 |
| Входни токени | $4 | $5 |
| Изходни токени | $20 | $25 |
| Запис в кеша | $5 | $6.25 |
Петчасовите лимити за използване от абонатите ще се увеличат с 20 процента. Благодарение на по-ниските разходи за модела Anthropic заявява, че тези лимити ще позволяват общо с 25 процента повече използване. Потребителите могат също да запазят нулирането на лимита за момента, в който им е най-необходимо.
Anthropic използва бенчмаркове за програмиране, за да обоснове твърденията си за цената и производителността. При FrontierCode компанията заявява, че Opus 5.5 превъзхожда GPT-6 Astra на OpenAI при около 20 процента от разходите за задача. При Terminal-Bench 4.0 тя твърди, че постига същата производителност като Astra при 40 процента от разходите. При CursorBench компанията заявява, че Opus 5.5 превъзхожда GPT-5.6 Sol с 11 пункта при една трета от разходите.
Намаляването на цената е отговор на натиска от OpenAI и особено от китайските AI модели, които предлагат по-ниска производителност, но струват част от тази цена.
Anthropic обещава по-малко „Claudish“
Очаква се Opus 5.5 да комуникира по-естествено от по-ранните модели. Anthropic заявява, че моделът поставя най-важната информация на първо място, използва по-малко жаргон и следва по-стриктно инструкциите за писане. Ранните тестери описват писането му като по-ясно и по-лесно за разбиране, което според Anthropic го прави по-добър партньор при продължителни работни сесии. Настоящите модели Claude са обект на множество критики заради формулираното им, усложнено писане, понякога наричано „Claudish“.

Opus 5.5 е и първият модел Opus със защитни мерки за киберсигурност, биология и разработка на авангардни LLM, които съответстват на тези на Fable 5.1. Когато тези защитни мерки се задействат, Anthropic заявява, че заявките се пренасочват прозрачно към друг модел.
Потребителите все още могат да откриват и отстраняват грешки в кода си, но повечето задачи по киберсигурност ще се изпълняват от по-стария Opus 4.8. Заявките, маркирани от класификаторите като свързани с биология или разработка на авангардни LLM, ще бъдат пренасочвани към Opus 5.
Проверени организации могат да кандидатстват за използване на модела за биологични изследвания чрез Програмата за проверка в областта на науките за живота. Anthropic планира да разшири съществуващата си Програма за проверка на киберсигурността и към Opus 5.5 през следващите седмици.
Claude Opus 5.5 е достъпен от днес на всички платформи, включително Amazon Web Services, Google Cloud и Microsoft Azure. Разработчиците, използващи Claude Platform, могат да получат достъп до него с идентификатора на модела claude-opus-5-5.
Anthropic призовава за по-високи стандарти за безопасност с нарастването на възможностите на моделите
Anthropic планира да проверява по-строго средите за обучение с обучение чрез подсилване. Компанията заявява, че дефектните среди за обучение са основен източник на несъответстващо на целите поведение на моделите. Компанията също така работи върху по-добри награди за съответствие, автоматизирани начини за създаване на сценарии за обучение по безопасност и по-строги мерки за безопасност и наблюдение.
AI лабораториите обсъждат колко бързо да пускат по-мощни модели. Наскоро OpenAI призова за международни стандарти за AI системи, които могат да се самоусъвършенстват, докато няколко изследователи публично призоваха лабораториите да забавят пускането на модели, докато методите за съответствие не ги догонят. Anthropic заема сходна позиция, като призовава за по-висок стандарт за безопасност на модели, които биха могли изцяло да автоматизират изследванията в областта на AI. Компанията заявява, че публичната политика трябва да има по-голяма роля при определянето на този стандарт. Външните организации Frontier Design и METR са тествали Opus 5.5 преди пускането му.
Новите ограничения са насочени срещу дистилацията и подпомагат спазването на Закона на ЕС за AI
Anthropic въвежда и мерки срещу това, което нарича атаки за дистилация. Компанията заявява, че нападателите използват хиляди фалшиви акаунти, за да извличат възможностите на даден модел в индустриален мащаб и да създават високоспособни модели без неговите защитни мерки. Anthropic се позовава на доклад за заплахите от септември 2026 г., в който е документирана незаконна дейност по дистилация, открита и спряна от компанията до момента.
Opus 5.5 се пуска с „Preserved Thinking“ — мярка срещу дистилацията, въведена за първи път с Fable 5.1. Тя не позволява на потребителите на API да редактират предходния контекст на Claude, за да извличат разсъжденията му. Мярката се прилага за Fable 5.1 и Opus 5.5 при API акаунти, създадени на или след 31 август 2026 г.
Opus 5.5 включва и мерки за воден знак с цел спазване на Закона на ЕС за AI. Моделът вече не може да работи с изключен режим „Thinking“ и е достъпен при нулево задържане на данни.
AI новини без преувеличения – подбрани от хора
Абонирайте се за THE DECODER за четене без реклами, седмичен AI бюлетин, нашия ексклузивен годишен шесткратен доклад за авангардните технологии „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.