Anthropic выпускает Claude Haiku 5.5: небольшую модель с контекстом в 1 млн токенов по цене $0,10 за миллион входных токенов
Anthropic выпустила Claude Haiku 5.5 — свою самую дешёвую и быструю малую модель на сегодняшний день. Она предназначена для высоконагруженных задач, таких как создание резюме, сжатие контекста, классификация и задачи субагентов. Модель сохраняет контекстное окно на 1 млн токенов и поддерживает до 128 тыс. выходных токенов. Стоимость начинается с $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов. Это на 90% ниже стоимости Claude Haiku 4.5 для запросов объёмом до 100 тыс. токенов.
Можно ли её развернуть? Да, в качестве размещаемого API. Haiku 5.5 общедоступна в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform в AWS.
Что выпустила Anthropic
Haiku 5.5 — первая модель класса Haiku с регулируемой настройкой уровня усилий. Адаптивное мышление включено по умолчанию, а параметр усилий по умолчанию имеет значение medium.
Модель принимает текст и изображения, выдаёт текст и имеет срез знаний за июнь 2026 года. Пакетные задания в бета-версии поддерживают до 300 тыс. выходных токенов.
Важно отметить два ключевых момента. Значения temperature, top_p или top_k, отличные от значений по умолчанию, приводят к ошибке 400. Новый токенизатор также считает один и тот же текст примерно на 30% большим количеством токенов, чем Haiku 4.5. Оба момента рассматриваются в руководстве по миграции.
Цены: двухуровневая структура
Цены разделяются на уровне 100 тыс. токенов запроса. Для объёма до 100 тыс. входные токены стоят $0,10, а выходные — $0,50 за миллион. Чтение кэша стоит $0,01, а запись в кэш на 5 минут — $0,125. При превышении 100 тыс. токенов ставки повышаются до $0,50 за входные и $2,50 за выходные токены.
Haiku 4.5 стоила $1 за входные и $5 за выходные токены. Anthropic сообщает, что около 90% запросов к Haiku 4.5 имели объём менее 100 тыс. токенов. С учётом корректировки на токенизатор компания оценивает, что Haiku 5.5 в среднем обходится примерно на 75% дешевле. Пакетная обработка снижает стоимость ещё на 50%.
В GPT-6 Luna указаны такие же тарифы для короткого контекста. Её повышенный тариф начинается только после 272 тыс. входных токенов и составляет $0,20 и $0,75. Для запроса на 150 тыс. токенов Luna дешевле по опубликованной цене.
Результаты тестов
Все приведённые ниже показатели предоставлены Anthropic (см. системную карту):
- OSWorld 2.1 (офлайн-подмножество): 72,4% против 48,9% у GPT-6 Luna и 15,7% у Haiku 4.5.
- Terminal-Bench 4.0: 39,2% против 16,4% у Luna и 0,0% у Haiku 4.5.
- FrontierCode 1.1 (основной набор): 46,4% против 42,4% у Luna.
- Humanity’s Last Exam: 45,9% без инструментов и 57,4% с инструментами.
- GDPval-AA v2.1: 1620 против 1437 у Luna и 735 у Haiku 4.5.
Sonnet 5.5 по-прежнему лидирует в каждой строке, включая 70,6% в Terminal-Bench 4.0. Сама Anthropic рекомендует Sonnet 5.5 и Opus 5.5 для сложного агентного программирования.
Лучшие варианты использования
Три типа задач подходят Haiku 5.5 лучше всего:
- Первый — работа субагентов под управлением Opus 5.5 или Sonnet 5.5. В Rogo субагент на базе Haiku 5.5 извлекает строку о выручке из отчёта 10-K, пока более крупная модель создаёт презентацию.
- Второй — обработка вопросов и ответов по документам в больших объёмах и создание резюме. AlphaSense протестировала модель в функции, обрабатывающей около 8 млн вызовов в неделю.
- Третий — чувствительные к скорости задачи, такие как поддержка клиентов в реальном времени и использование браузера.
Haiku 5.5 и её ближайшие конкуренты
| Характеристика | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| Входные / выходные (на 1 млн) | $0,10 / $0,50 | $0,10 / $0,50 | $0,30 / $2,50 |
| Цены для длинных запросов | $0,50 / $2,50 после 100 тыс. | $0,20 / $0,75 после 272 тыс. | Фиксированная ставка |
| Чтение кэша (на 1 млн) | $0,01 | $0,01 | $0,03 + хранение |
| Контекстное окно | 1 млн токенов | 1 050 000 токенов | 1 048 576 токенов |
| Максимальный объём вывода | 128 тыс. токенов | 128 000 токенов | 65 536 токенов |
| Входные данные | Текст, изображения | Текст, изображения | Текст, изображения, видео, аудио, PDF |
| Управление рассуждениями | Адаптивное мышление + усилия (по умолчанию medium) | reasoning.effort от none до max (по умолчанию medium) | Поддержка мышления |
| Использование компьютера | Поддержка SDK в бета-версии | Поддерживается (Responses API) | Поддерживается (предварительная версия) |
| Скидка на пакетную обработку | 50% | 50% (Batch и Flex) | 50% |
| Срез знаний | Июнь 2026 года | 18 мая 2026 года | Не указан на странице модели |
| Где запускать | Claude API, Bedrock, Google Cloud, Microsoft Foundry, Claude Platform в AWS | OpenAI API | Gemini API |
Источники: документация Anthropic, объявление Anthropic, страница модели OpenAI, цены OpenAI, страница модели Google, цены Google. Опубликованные цены стандартного уровня, проверены 7 октября 2026 года.
Интерактивное объяснение
Ключевые выводы
- $0,10 за входные и $0,50 за выходные токены на 1 млн токенов для запросов объёмом до 100 тыс. токенов.
- Контекст на 1 млн токенов, вывод до 128 тыс. токенов, адаптивное мышление с настройкой усилий (по умолчанию
medium). - 72,4% в OSWorld 2.1 против 15,7% у Haiku 4.5 (по данным Anthropic).
- Такая же опубликованная цена для короткого контекста, как у GPT-6 Luna; Luna дешевле при объёме свыше 100 тыс. токенов.
- Предназначена для работы в качестве субагента под управлением Opus 5.5 и Sonnet 5.5, а не в качестве ведущей модели для программирования.
Ознакомьтесь с разделом «Технические детали». Все заслуги принадлежат исследователю этого проекта. Также подписывайтесь на нас в Twitter и не забудьте присоединиться к нашему сабреддиту по машинному обучению с аудиторией более 150 тыс. человек и подписаться на нашу рассылку. Стоп! Вы есть в Telegram? теперь к нам можно присоединиться и в Telegram.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.