Anthropic выпустила Claude Haiku 5.5: малая модель в среднем на 75% дешевле Haiku 4.5

Anthropic выпустила Claude Haiku 5.5: малая модель в среднем на 75% дешевле Haiku 4.5

Anthropic анонсировала Claude Haiku 5.5 и называет её самой дешёвой, самой быстрой и самой способной малой моделью из всех, что компания выпускала. Модель рассчитана на массовые задачи, где важна цена: краткие пересказы, сжатие контекста (compaction), запросы к базам данных, классификацию. Её предлагают использовать как субагента в паре с Opus 5.5 и Sonnet 5.5 при работе над кодом, а также там, где важна скорость, например, в живой поддержке клиентов и при работе в браузере.

Главное изменение, цена. По словам Anthropic, в среднем Haiku 5.5 обходится примерно на 75% дешевле Haiku 4.5. Эта цифра, средняя и учитывает смену токенизатора. Для запросов до 100 000 токенов цена на 90% ниже, чем у Haiku 4.5, для запросов длиннее 100 000 токенов, на 50% ниже. У Haiku 4.5 примерно 90% запросов укладывались в первую категорию. У Haiku 5.5 обновлённый токенизатор (похожий на токенизаторы Sonnet 5.5 и Opus 5.5), поэтому на ту же работу уходит чуть больше токенов. Haiku 5.5, самая быстрая модель компании при стандартной скорости каждой модели, но в быстром режиме (Fast Mode) она работает медленнее моделей Opus.

Haiku 5.5, первая модель класса Haiku с настраиваемым уровнем усилий (effort): как и в других моделях Anthropic, можно выбирать между экономией и качеством. В анонсе есть графики по трём бенчмаркам на разных уровнях усилий и таблица цен, а ранние клиенты, по заявлению компании, сообщали о результатах, согласующихся с заявленным ростом качества и экономии.

В безопасности Anthropic отмечает существенный прогресс по почти всем оценкам согласованности относительно Haiku 4.5: заметно меньше случаев нежелательного поведения и ниже готовность помогать при злоупотреблениях. Защита в кибербезопасности строже, чем у Haiku 4.5, но несколько мягче, чем у других недавних моделей компании; она допускает более широкий круг оборонительных задач, чем защита Sonnet 5.5, но по-прежнему блокирует тестирование на проникновение и другие приёмы, которые чаще применяют атакующие. Защита в биологии такая же, как у Sonnet 5, Sonnet 5.5 и Opus 5: исследовательские вопросы разрешены, запросы с вероятным вредом ограничены. Организации с более широкими задачами в биологии и кибербезопасности могут подать заявку в программы Life Sciences Verification Program и Cyber Verification Program.

Модель доступна уже сейчас на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure; в Claude Platform имя модели, claude-haiku-5-5. Есть руководство по миграции.

Вместе с запуском Anthropic объявила ещё два шага. Во-первых, с момента анонса цена чтения кэша (cache reads) у Claude Sonnet 5.5 снижена вдвое: $0,10 за миллион токенов вместо $0,20. Поскольку чтение кэша составляет большую долю потребления токенов, это удешевляет Sonnet 5.5 примерно на 20% на большинстве агентных задач. Во-вторых, на этой неделе подписчики Max и Team получат ежемесячный кредит на API Claude Platform: Max 5x, $100 в месяц, Max 20x, $200, Team, до $500 на всех пользователей сообща. Кредиты предназначены для экспериментов с инструментами, приложениями и агентами, вызывающими API, и подходят для любых моделей Anthropic.

Для разработчиков обновляются Python- и TypeScript-SDK: в бета-версии добавлена поддержка computer use и browser use. Anthropic считает Haiku 5.5 особенно подходящей для таких задач благодаря сочетанию скорости, возможностей и цены. При этом компания подчёркивает границы модели: для сложного агентного программирования, как в Terminal-Bench 4.0, лучше подходят Sonnet 5.5 и Opus 5.5, а Haiku 5.5 лучше всего работает с узкими задачами, которые раньше могли быть слишком дорогими, сжатием контекста, пересказами, работой субагентов.

Ключевые факты

  • Claude Haiku 5.5, по заявлению Anthropic, самая дешёвая, быстрая и способная малая модель компании; доступна на всех платформах, включая AWS, Google Cloud и Microsoft Azure (claude-haiku-5-5).
  • В среднем модель обходится примерно на 75% дешевле Haiku 4.5: на 90% ниже цена для запросов до 100 000 токенов и на 50% ниже для более длинных; расчёт учитывает новый токенизатор.
  • Это первая модель класса Haiku с настраиваемым уровнем усилий (effort), позволяющим выбирать между стоимостью и качеством.
  • Цена чтения кэша у Sonnet 5.5 снижена вдвое, до $0,10 за миллион токенов вместо $0,20, что даёт около 20% экономии на большинстве агентных задач.
  • Подписчики Max и Team получают ежемесячный кредит на API: $100 (Max 5x), $200 (Max 20x), до $500 на всю команду (Team).

Почему это важно

Anthropic заметно удешевляет самую малую модель линейки: в среднем примерно на 75% относительно Haiku 4.5. Одновременно компания снижает цену кэша у Sonnet 5.5 и вводит API-кредиты для подписчиков, то есть пересматривает соотношение цены и качества по всей линейке. Для массовых, повторяющихся задач, классификации, пересказов, запросов к базам, это может изменить расчёт стоимости. Новинка также впервые даёт в классе Haiku настройку уровня усилий.

Кому это важно

Разработчикам и командам, у которых большой поток недорогих запросов: поддержка клиентов, классификация, сжатие контекста, пересказы. Тем, кто строит агентные системы с субагентами: Anthropic прямо предлагает Haiku 5.5 на эту роль рядом с Opus 5.5 и Sonnet 5.5. Подписчикам Max и Team, из-за нового ежемесячного API-кредита. Пользователям Sonnet 5.5 с большим расходом на кэш.

Как это применить

Модель доступна под именем claude-haiku-5-5 на Claude Platform, а также в AWS, Google Cloud и Microsoft Azure; для перехода с прежней версии есть руководство по миграции. Уровень усилий можно настраивать, выбирая между стоимостью и качеством. Обновлённые Python- и TypeScript-SDK в бета-версии поддерживают computer use и browser use. Подписчики Max и Team в течение недели получат ежемесячный API-кредит, который можно тратить на любые модели Anthropic. Для узких задач выбирайте Haiku 5.5, для сложного агентного программирования Anthropic рекомендует Sonnet 5.5 или Opus 5.5.

Можно ли доверять

Это материал самой Anthropic, то есть первоисточник по цене, доступности и составу предложения. Оценки качества и скорости («самая способная», «самая быстрая»), заявления компании; независимой проверки в тексте нет. Отзывы ранних клиентов Anthropic лишь упоминает со слов компании. Цифра о 75%, средняя и зависит от структуры запросов и смены токенизатора, а не фиксированная скидка.

Риски и подводные камни

Средняя экономия не гарантирована каждому: на длинных запросах свыше 100 000 токенов цена ниже лишь на 50%, а новый токенизатор означает, что на задачу уходит чуть больше токенов. Скорость «самая высокая» относится к стандартному режиму: в быстром режиме (Fast Mode) модели Opus работают быстрее. Для сложного агентного программирования Haiku 5.5 не лучший выбор. Защита в кибербезопасности по-прежнему блокирует тестирование на проникновение и другие приёмы, которые чаще применяют атакующие; для более широких задач нужно подавать заявку в программы верификации. Экономия около 20% у Sonnet 5.5 относится к большинству агентных задач, но не ко всем нагрузкам.

«Самая дешёвая, самая быстрая и самая способная малая модель из всех, что мы когда-либо выпускали.»

— Anthropic, анонс Claude Haiku 5.5