Anthropic завершила обновление линейки Claude 5.5, выпустив её самую младшую модель — Haiku 5.5. Для запросов объёмом до 100 тысяч токенов обработка миллиона входных токенов стоит $0,10, а генерация миллиона выходных — $0,50. У Haiku 4.5 цены составляли $1 и $5 соответственно, в десять раз больше. Однако новая модель разбивает текст на большее число токенов, поэтому реальная экономия в среднем составляет около 75%, а не 90%. Haiku 5.5 уже доступна через облачные сервисы Amazon, Google Cloud и Azure.
Самая «легкая» модель при этом сильно «потяжелела» по возможностям и функционалу. На тесте OSWorld 2.1 (работа с компьютером) Haiku 5.5 набирает 72,4%, хотя Haiku 4.5 едва осилила 15,7%. На сложном экзамене Humanity's Last Exam результат поднялся с 10,2% до 45,9% без инструментов, а в Terminal-Bench 4.0, где модель работает в командной строке, с нуля до 39,2%. Все цифры взяты из таблицы самой Anthropic. Соперник из семейства GPT-6 по тем же замерам, GPT-6 Luna, набирает 48,9% на OSWorld и 16,4% на Terminal-Bench. Старшая Sonnet 5.5 остается впереди (83,9% и 70,6%), и компания прямо рекомендует брать ее и Opus 5.5 для сложного программирования с агентами.
Для чего же нужна дешевая модель? Для работы в качестве помощника старших. В типичной схеме Opus или Sonnet планируют задачу и принимают решения, а Haiku берет на себя рутину: сжимает длинные диалоги, классифицирует письма, пишет запросы к базам данных, пересказывает документы. Anthropic называет такие роли подагентами, и новая модель создана именно для них. Впервые у Haiku появился регулятор усилия, который позволяет менять качество на цену, а режим работы с компьютером и браузером доступен в бете через SDK (наборы для разработчиков).
Параллельно Anthropic снизила на 50% плату за чтение из кэша у Sonnet 5.5, до $0,10 за миллион токенов. По оценке компании, это удешевляет Sonnet 5.5 на большинстве агентных задач примерно на 20%. Подписчики Max и Team получили ежемесячные кредиты на API: $100 для Max 5x, $200 для Max 20x и до $500 на команду. Выглядит как попытка удержать разработчиков, которых тянут и китайские лаборатории с релизами каждые 44 дня, и Mistral с новой Large 4 по $1,36 за миллион входных токенов.
Впрочем, тесты проводила сама Anthropic, а не независимая лаборатория. Модель расходует чуть больше токенов на задачу, чем предшественница, поэтому реальная экономия зависит от задачи. Защита от обхода ограничений в Haiku 5.5 строже, чем у Haiku 4.5, но мягче, чем у Sonnet 5.5.
Для разработчиков главное преимущество Haiku 5.5 — цена: она в 20 раз дешевле Sonnet 5.5. Миллион входных токенов стоит $0,10 вместо $2, а выходных — $0,50 вместо $10. При этом в тесте GDPval-AA, который оценивает выполнение реальных офисных задач, разница в результатах гораздо скромнее: 1620 баллов у Haiku против 1840 у Sonnet.
