Anthropic представила Claude Haiku 5.5, младшую модель своей линейки. По данным компании, это самая быстрая её модель на текущий момент.

По данным Anthropic, в среднем модель обходится примерно на 75 % дешевле Haiku 4.5.

Haiku 5.5 предназначена для массовых и недорогих задач, таких как краткие пересказы, сжатие контекста, запросы к базам данных и классификация. Её также предлагают использовать как субагента для Opus 5.5 и Sonnet 5.5 в задачах программирования, а благодаря скорости — в онлайн-поддержке и для управления браузером. Впервые в линейке Haiku появилась настройка уровня усилий, позволяющая пользователю выбирать между экономией на стоимости и получением более точного результата.

Для запросов до 100 000 токенов цена ниже на 90 %: $0,10 за миллион входных токенов и $0,50 за миллион выходных против $1 и $5 у Haiku 4.5. На длинных запросах скидка составляет 50 %. При этом новый токенизатор расходует на задачу немного больше токенов, что учтено в расчёте.

В тестах компании Haiku 5.5 значительно опережает предшественницу. В бенчмарке управления компьютером OSWorld 2.1 она набрала 72,4 % против 15,7 % у Haiku 4.5, а в Terminal-Bench 4.0 по агентному программированию — 39,2 % против нуля. Модель также превосходит GPT-6 Luna от OpenAI в большинстве приведённых тестов, но уступает Sonnet 5.5. Для сложных задач программирования в Anthropic по-прежнему рекомендуют старшие модели.

Одновременно компания вдвое снизила цену чтения из кеша у Sonnet 5.5, до $0,10 за миллион токенов. По оценке Anthropic, на большинстве агентных задач модель станет дешевле примерно на 20 %. Подписчики Max и Team на этой неделе начнут получать ежемесячные кредиты на API: $100 на тарифе Max 5x, $200 на Max 20x и до $500 на команду в Team.

Защитные ограничения в области кибербезопасности у Haiku 5.5 строже, чем у Haiku 4.5: модель помогает с защитными задачами, но блокирует, например, тестирование на проникновение. Модель уже доступна в API Anthropic, а также в Amazon Web Services, Google Cloud и Microsoft Azure.