Миллион входных токенов в ClaudeHaiku 4.5 стоил $1, миллион выходных стоил $5. В новой Haiku 5.5 за запросы короче 100 000 токенов Anthropic берёт $0,10 и $0,50 соответственно, сообщает The New Stack.[1]
Модель вышла 7 октября. Anthropic называет её самой дешёвой, быстрой и способной малой моделью из всех, что компания выпускала. Haiku 5.5 рассчитана на большие объёмы задач, где стоимость имеет решающее значение. По словам компании, она хорошо работает в паре с Opus 5.5 и Sonnet 5.5 в роли субагента при работе с кодом. Модель уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure.[2][3][4][5]
Цены у новой модели зависят от длины запроса. До 100 000 токенов действует самый низкий тариф, для более длинных запросов он составляет $0,50 за входные и $2,50 за выходные токены. У Haiku 4.5 цена не зависела от размера запроса. Anthropic поясняет, что около 90% запросов к прошлой Haiku укладывались в 100 000 токенов. В среднем, по оценке компании, запуск новой модели обходится примерно на 75% дешевле.[6][7][8]
Есть и оговорка. Haiku 5.5 получила обновлённый токенизатор, похожий на токенизаторы Sonnet 5.5 и Opus 5.5, поэтому на одну задачу у неё уходит немного больше токенов, чем у Haiku 4.5. Среди нововведений и настраиваемый уровень effort: такого раньше не было ни у одной модели класса Haiku.[9][10]
Результаты тестов приводит The New Stack со ссылкой на Anthropic. На офлайн-подмножестве OSWorld 2.1, где проверяют работу с компьютером, Haiku 5.5 набрала 72,4%, её предшественница 15,7%, а GPT-6 Luna 48,9%. На GDPval-AA v2.1 у новой модели 1620 баллов против 735 у Haiku 4.5 и 1437 у GPT-6 Luna. В Terminal-Bench 4.0, тесте на многошаговые задачи в командной строке, Haiku 5.5 показала 39,2%. У Haiku 4.5 здесь 0%, у GPT-6 Luna 16,4%, у старшей Sonnet 5.5 70,6%.[11][12][13]
По отдельным показателям у новинки есть соперники. По данным Artificial Analysis, которые приводит The New Stack, GLM-5.3-Flash от Z.ai набирает на GDPval-AA v2.1 1647 баллов, то есть больше Haiku 5.5, а на AA-Briefcase v1.1 получает 1454. Qwen3.7 Flash в международном сервисе Alibaba стоит $0,03 за миллион входных и $0,13 за миллион выходных токенов, если запрос не длиннее 32 000 токенов.[14][15]
Защитные ограничения в области кибербезопасности у Haiku 5.5 строже, чем у Haiku 4.5, но несколько мягче, чем у других недавних моделей Anthropic. Компания уточняет, что модель по-прежнему блокирует пентестинг и другие техники, к которым чаще прибегают атакующие. Ограничения по биологии совпадают с теми, что действуют у Sonnet 5, Sonnet 5.5 и Opus 5. По внутренним оценкам выравнивания Anthropic видит у новой модели значительный прогресс почти по всем пунктам в сравнении с Haiku 4.5.[16][17][18][19]
Вместе с моделью компания объявила ещё несколько изменений. Чтение кэша в Sonnet 5.5 подешевело вдвое, с $0,20 до $0,10 за миллион токенов. Из-за того что кэш-чтения составляют большую долю потребления токенов, большинство агентных задач на Sonnet 5.5 станут примерно на 20% дешевле. Подписчики будут ежемесячно получать API-кредиты: $100 на тарифе Max 5x, $200 на Max 20x и до $500 в общем пуле на команду в тарифе Team. В Python и TypeScript SDK появилась бета-поддержка computer use и browser use.[20][21][22][23]
По подсчёту 9to5Mac, новая Haiku вышла примерно через год после предыдущего обновления. The New Stack отмечает, что это уже третья модель серии 5.5 у Anthropic за месяц, но Fable 5.5 среди них пока нет.[24][25]
По материалам
Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.
Haiku 5.5 is especially good value when used for tasks with prompts up to 100,000 tokens, which make up around 90% of requests to our previous Haiku model.
On the offline subset of OSWorld 2.1, which tests computer use, Haiku 5.5 scored 72.4%, up from 15.7% for its predecessor and ahead of GPT-6 Luna’s 48.9%.
On Terminal-Bench 4.0, which tests complex, multi-step tasks in a command-line environment, Haiku 5.5 scored 39.2%, compared with 0% for Haiku 4.5, 16.4% for GPT-6 Luna and 70.6% for Sonnet 5.5.
On Alibaba’s international service, Qwen3.7 Flash costs $0.03 per million input tokens and $0.13 per million output tokens for inputs of up to 32,000 tokens.
Haiku 5.5’s cybersecurity safeguards are more restrictive than Haiku 4.5’s, but somewhat less restrictive than those we’ve applied to other recent models.