Claude Haiku 5.5 вышла 7 октября 2026 года, и это самая дешёвая модель Anthropic: от $0,10 за миллион входных токенов и от $0,50 за миллион выходных. На запросах до 100 тысяч токенов это в 40 раз дешевле Opus 5.5. Ей стоит отдать поток однотипной работы: разобрать заявки по категориям, вытащить поля из документов, коротко пересказать переписку, искать нужное в файлах по заданию большой модели. Сложную разработку и длинные задачи, где агент сам планирует шаги, Anthropic в анонсе советует оставить Sonnet 5.5 и Opus 5.5. Данные на 9 октября 2026 года.
Haiku — младшая линейка моделей Claude. Предыдущая версия, Haiku 4.5, стоила $1 за миллион входных токенов и $5 за миллион выходных.
Главное о новой модели:
Для сравнения, Sonnet 5.5 стоит $2 и $10 за миллион токенов, Opus 5.5 — $4 и $20.
Anthropic делала её для большого потока однотипных запросов, где важна скорость, то есть для классификации, извлечения данных, маршрутизации и задач субагентов. В малом бизнесе под это подходят такие задачи:
В тестах Artificial Analysis на максимальном уровне усилия Haiku 5.5 заметно уступает Sonnet 5.5 и Opus 5.5 по уму, зато одна тестовая задача на ней стоила $0,21, а на Sonnet — $5,46, примерно в 26 раз дороже. Ответ Haiku пишет в полтора с лишним раза быстрее.
Слабые места модели Anthropic перечислила сама в руководстве по промптам для Haiku 5.5:
В тесте на программирование Terminal-Bench 4.0 из анонса Haiku 5.5 решила 39,2% задач, а Sonnet 5.5 почти вдвое больше, 70,6%. Если агент сам пишет и правит код в рабочем проекте, его лучше оставить на Sonnet или Opus.
Впервые у Haiku работают фильтры безопасности. Они могут отклонить запрос про вредоносный код, опасные лабораторные методы или что-то ещё, что запрещают правила использования Anthropic, и иногда срабатывают на безобидной работе. У Haiku 4.5 таких отказов не было. Повтор того же запроса, по словам Anthropic, обычно даёт тот же отказ.
На Hacker News одни разработчики пишут, что на анализе данных Haiku 5.5 сильнее прошлой версии, другие — что на их задачах Haiku 4.5 до сих пор лучше. Модель совсем новая, поэтому её стоит проверить на своих задачах до того, как переводить на неё работу.
В Claude Code главный агент на Opus или Sonnet может планировать работу и принимать решения, а черновые задачи раздавать субагентам на Haiku. Субагент заглянет в файлы, прочитает документацию, перескажет лог и вернёт короткий результат. Большая модель не тратит дорогой контекст на чтение.
Программировать для этого ничего не нужно, хватит одной строки:
С версии Claude Code 2.1.293 слово haiku означает Haiku 5.5, если вы работаете через API Anthropic напрямую. Чтобы поиск по файлам тоже шёл на дешёвой модели, документация Claude Code советует сделать своего агента с именем Explore и строкой model: haiku.
Если субагентов много и каждый читает весь проект, они быстро съедают лимит. Где субагенты экономят время, а где только усложняют работу, мы разбирали в статье про субагентов Claude Code и их реальную экономию.
Ступень после 100 тысяч токенов. Если в одном запросе больше 100 тысяч токенов, токен дорожает впятеро, и на вход, и на выход. Длинная сессия, где модели каждый раз отдают всю историю и пачку файлов, может перейти этот порог. Для массовых задач выгоднее короткие запросы: одно письмо, один документ, одна заявка.
Новый токенизатор. Haiku 5.5 делит текст на токены иначе, и тот же текст выходит примерно на 30% длиннее в токенах, чем на Haiku 4.5. Бюджет на токены, посчитанный под Haiku 4.5, придётся пересчитать.
Размышления. У Haiku 5.5 по умолчанию включены размышления. Сколько думать, модель решает сама, а токены размышлений оплачиваются как выходные. По тестам Anthropic, переход с low на medium в агенте с длинным системным промптом больше чем вдвое увеличил число выходных токенов. Если написать в промпте «отвечай сразу», модель всё равно думает. Меньше она думает только на более низком уровне усилия. Через API на уровнях от low до high размышления можно выключить совсем, а в Claude Code у моделей 5.5 они не отключаются.
Токен Haiku 5.5 на 90% дешевле, чем у Haiku 4.5, а задача в тестах Artificial Analysis подешевела только на четверть, с $0,28 до $0,21. За весь прогон тестов новая модель на уровне max написала 440 млн выходных токенов, Haiku 4.5 в режиме размышлений — 78 млн. Для потоковых задач с коротким промптом хватает уровней low и medium, а max стоит включать только там, где проверка показала разницу в качестве.
Стоит ли переходить на Claude Haiku 5.5 с Haiku 4.5? Если вы платите за API, скорее да: на запросах до 100 тысяч токенов токен дешевле в десять раз, а в тестах Artificial Analysis модель умнее. На Hacker News есть отзывы, что на некоторых задачах Haiku 4.5 пока работает лучше, поэтому перед переходом прогоните старые промпты и пересчитайте бюджет с учётом токенизатора и размышлений.
Чем Claude Haiku отличается от Sonnet? Haiku быстрее, а на запросах до 100 тысяч токенов в 20 раз дешевле за токен. Sonnet сильнее на сложных задачах: в тесте на программирование Terminal-Bench 4.0 у Haiku 39,2%, у Sonnet 70,6%. Для потоковой рутины подходит Haiku, для разработки и длинных задач — Sonnet.
Какую модель Claude выбрать для простых задач? Haiku 5.5 на уровне low или medium. Anthropic сделала её для классификации, извлечения данных и маршрутизации.
Можно ли писать код на Haiku 5.5? Можно для небольших правок и черновой работы, но проверку после правки запускайте сами: на low и medium модель иногда отчитывается о правке, не проверив её. Для сложной агентной разработки Anthropic советует Sonnet 5.5 или Opus 5.5.
Как включить Haiku 5.5 в Claude Code на подписке? Обновить Claude Code до версии 2.1.293 или новее и выбрать модель командой /model haiku. Если вы работаете через Amazon Bedrock или Google Cloud, под haiku там пока подключается Haiku 4.5.
Почему счёт за Haiku 5.5 вышел выше, чем по прайсу? Причин три: запрос длиннее 100 тысяч токенов, размышления, которые оплачиваются как выходные токены, и новый токенизатор, который даёт примерно на 30% больше токенов.
Больше всего Haiku 5.5 экономит в паре с большой моделью, когда Opus или Sonnet думает, а Haiku короткими запросами на низком уровне усилия читает, сортирует и пересказывает. Сложную разработку лучше оставить Sonnet или Opus. Любую новую задачу перед переводом на Haiku стоит проверить на своих данных.
Новые модели Claude и то, как их применять в бизнесе, мы разбираем в канале клуба.