Claude Haiku 5.5 виходить із величезним зниженням цін, доводячи, що цінова гонка у сфері ШІ ще далека від завершення
Ключові моменти
- Anthropic випустила Claude Haiku 5.5 — свою найшвидшу й найдоступнішу малу модель, створену для високонавантажених завдань, як-от запити до даних і підтримка клієнтів.
- Haiku 5.5 демонструє значне покращення результатів тестів порівняно з Haiku 4.5 за цін на токени до 90 відсотків нижчих. Вона також випереджає бюджетну модель OpenAI GPT-6 Luna у таких сферах, як агентне програмування.
- Haiku 5.5 уже доступна на AWS, Google Cloud і Azure. Anthropic також удвічі знижує вартість читання кешу для Sonnet 5.5 і запроваджує щомісячні кредити API для передплатників.
Anthropic випустила Claude Haiku 5.5 — найшвидшу й найдоступнішу малу модель компанії на сьогодні. Результати тестів свідчать про значний приріст продуктивності порівняно з попередницею, а Anthropic також знижує ціни на Sonnet 5.5.
За даними Anthropic, Haiku 5.5 призначена для високонавантажених і чутливих до вартості завдань, як-от узагальнення, запити до баз даних, класифікація та оперативна підтримка клієнтів. У середньому модель коштує приблизно на 75 відсотків дешевше за Haiku 4.5. Для запитів із промптами обсягом до 100 000 токенів, на які, за словами Anthropic, припадало близько 90 відсотків усіх попередніх запитів до Haiku, ціни знижуються до 90 відсотків. Промпти довші за 100 000 токенів коштують у п’ять разів дорожче.
| Ціна за 1 мільйон токенів | Haiku 5.5 (промпти до / понад 100 тис.) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Читання кешу | $0.01 / $0.05 | $0.10 | $0.10 |
| Запис у кеш | $0.125 / $0.625 | $1.25 | $2.50 |
| Вхідні токени | $0.10 / $0.50 | $1.00 | $2.00 |
| Вихідні токени | $0.50 / $2.50 | $5.00 | $10.00 |
Anthropic зазначає, що Haiku 5.5 використовує оновлений токенізатор, який споживає трохи більше токенів на завдання, ніж її попередниця. Те саме сталося з моделями Opus 4.x, де використання токенів зросло приблизно на 30 відсотків лише через зміну токенізатора. Реальна економія, імовірно, буде меншою, ніж випливає з цін за токен.
Тести демонструють значний стрибок порівняно з Haiku 4.5
Haiku 5.5 набирає 1 620 балів у тесті на знання GDPval-AA v2.1 — більш ніж удвічі більше за 735 балів, які отримала її попередниця. У Humanity's Last Exam вона досягає 45,9 відсотка без інструментів і 57,4 відсотка з інструментами — проти 10,2 та 18,7 відсотка відповідно раніше.
Найбільший стрибок спостерігається у використанні комп’ютера, коли модель самостійно керує комп’ютером. Оскільки використання комп’ютера потребує великої кількості токенів, дешева й швидка модель на кшталт Haiku 5.5 добре підходить для цього. У OSWorld-2.1 вона набирає 72,4 відсотка проти 15,7 відсотка раніше. У тесті агентного програмування Terminal-Bench 4.0 вона досягає 39,2 відсотка, тоді як Haiku 4.5 набрала нуль.
Anthropic також наводить для порівняння бюджетну модель OpenAI GPT-6 Luna, і Haiku 5.5 випереджає її в кожній протестованій категорії. Однак контрольні результати Sonnet 5.5 показують, що Haiku 5.5 усе ще значно поступається більшій моделі Anthropic.
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 | |
|---|---|---|---|---|
| Робота зі знаннями / GDPval-AA v2.1 | 1 620 | 735 | 1 437 | 1 840 |
| Робота зі знаннями / AA-Briefcase v1.1 | 1 578 | 614 | 1 336 | 1824 |
| Використання комп’ютера / OSWorld 2.1 | 72,4% (офлайн-підмножина) | 15,7% (офлайн-підмножина) | 48,9% (офлайн-підмножина) | 83,9% (офлайн-підмножина) |
| Міждисциплінарне міркування / Humanity's Last Exam | 45,9% (без інструментів) | 10,2% (без інструментів) | — | 56,9% (без інструментів) |
| 57,4% (з інструментами) | 18,7% (з інструментами) | — | 64,5% (з інструментами) | |
| Агентне програмування / Terminal-Bench 4.0 | 39,2% | 0,0% | 16,4% | 70,6% |
| Агентне програмування / FrontierCode 1.1 (Main) | 46,4% | — | 42,4% | 52,1% (Xhigh) |
| Візуальне міркування / Chartography | 46,4% (без інструментів) | 6,4% (без інструментів) | 29,1% (без інструментів) | 61,6% (без інструментів) |
Перша модель Haiku дає користувачам змогу обмінювати вартість на продуктивність
Haiku 5.5 — перша модель класу Haiku з регульованими рівнями міркування, що дає користувачам змогу балансувати між вартістю та якістю. Anthropic стверджує, що модель найкраще працює із чітко окресленими завданнями, як-от стиснення, узагальнення або робота субагентів. Для складного агентного програмування кращим вибором залишаються Sonnet 5.5 і Opus 5.5.
Засоби кібербезпеки тут суворіші, ніж у попередниці, але дають змогу виконувати ширший спектр захисних завдань, ніж Sonnet 5.5, частково через загалом нижчу спроможність моделі. Тестування на проникнення залишається заблокованим. Організації з ширшими потребами можуть подати заявку на участь у програмах Anthropic з верифікації у сферах наук про життя та кібербезпеки.
Haiku 5.5 уже доступна на всіх платформах, зокрема Amazon Web Services, Google Cloud і Microsoft Azure.
Sonnet 5.5 також дешевшає, а Anthropic роздає кредити API
Одночасно із запуском Haiku компанія Anthropic на 50 відсотків знижує вартість читання кешу для Sonnet 5.5 — із $0.20 до $0.10 за мільйон токенів. Компанія заявляє, що це має зменшити витрати на більшість агентних завдань приблизно на 20 відсотків. Цей крок майже напевно є реакцією на нову серію GPT-6.1 від OpenAI, що свідчить: цінові війни у сфері ШІ точаться як ніколи запекло.
Anthropic також запроваджує щомісячні кредити API. Передплатники Max-5x отримають $100, передплатники Max-20x — $200, а передплатники Team — до $500 на місяць. Користувачі можуть витрачати ці кредити на експерименти з інструментами, застосунками та агентами через API.
Компанія також оновлює свої SDK для Python і TypeScript, додаючи бета-підтримку використання комп’ютера та браузера.
Новини ШІ без хайпу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний піврічний звіт про передові технології «AI Radar», повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.