Команда /model в Claude Code открывает список моделей — Sonnet, Opus, Haiku и Fable, у каждой своя цена за токен. Предпринимателя без своей команды разработки волнует то, как выбор модели скажется на скорости, с которой закончится недельный лимит подписки.
Прямого ответа Anthropic не даёт. Компания публикует цену за токен для каждой модели и признаёт, что Opus обходится в разы дороже Sonnet за один ход агента, но не публикует точный коэффициент того, во сколько раз быстрее из-за этого сгорает недельный лимит подписки.
Opus стоит ровно в 2,5 раза дороже Sonnet за токен и вдвое дешевле топовой модели Fable, и это ровно то, что чувствуется в интерфейсе. Прямым текстом об этом говорит сама Anthropic в гайде по оптимизации расходов: «per token it costs half what Fable 5 does and 2.5 times what Sonnet 5 does» (источник). В абсолютных числах Opus стоит 5 долларов за миллион входных токенов и 25 за миллион выходных, у Sonnet — 2 и 10.
Кроме цены, модели различает и официальная таблица характеристик — у Sonnet пометка «Fast» и описание «the best combination of speed and intelligence», у Opus «Moderate» и «complex agentic coding and enterprise work». Разница ощущается в интерфейсе напрямую, потому что ответы Sonnet приходят заметно быстрее, а на рутинной работе вроде правок в существующем файле, мелкого рефакторинга или ответов на вопросы по коду выигрыш в скорости и цене достаётся без потери в качестве.
Haiku стоит вдвое дешевле Sonnet и впятеро дешевле Opus за токен, при этом остаётся самой быстрой моделью в линейке. Anthropic рекомендует её для фоновых операций и read-only сабагентов вроде поиска по файлам, проверки формата или простой рутинной сверки, где скорость важнее глубины рассуждения. На сложной агентной работе разрыв в качестве с Opus у Haiku заметно шире, чем у Sonnet, поэтому рассчитывать на неё как на основную модель для всей сессии не стоит, разве что для точечных фоновых задач.
Как далеко это «в разы», официальная справка по лимитам не уточняет: «Opus costs several times more per turn than Sonnet, and Sonnet more than Haiku» (источник). Anthropic формулу пересчёта цены за токен в списание лимита не публикует, и судя по тому, что рассказывают пользователи Claude Code в открытых обсуждениях, сам механизм устроен сложнее прямой пропорции между ценой и расходом.
Разрыв между теорией и практикой хорошо иллюстрирует случай, который разбирали в открытом баг-трекере Claude Code (issue #52502). Подписчик тарифа Max 20x построил связку, в которой Opus работает только оркестратором и распределяет задачи между сабагентами, а сам не трогает ни файлы, ни код. Всю фактическую работу выполняют дешёвые сабагенты на Haiku, поэтому по расчёту почти весь расход должен был идти по ставке Haiku. На практике за 40 минут такой работы пятичасовое окно показало 22% расхода, а при таком темпе недельного лимита хватило бы на 2-3 дня вместо семи. Сам автор в обсуждении признаёт, что панель расхода Claude Code не показывает разбивку по моделям, и точную причину подтвердить со стороны пользователя невозможно: это может быть архитектура оркестрации, особенности маршрутизации сабагентов или что-то ещё, чего пользователь просто не видит.
С самим недельным лимитом происходит похожая история. Механику лимита, скользящее окно и то, откуда берутся кратные превышения цены API над стоимостью подписки, разбирали отдельно на примере реального счёта разработчика, который платил через API вместо оформления Max (разбор экономики недельного лимита Claude Code). И здесь Anthropic снова не даёт цифры — только общее «в разы». В сложных сборках с несколькими сабагентами экономия к тому же не всегда происходит ровно так, как ожидается на бумаге, поэтому полагаться вслепую на то, что Haiku дешевле и поэтому безопаснее для лимита, в многоагентных сборках не стоит, даже когда расчёт выглядит очевидным.
Sonnet у Anthropic описан как «best combination of speed and intelligence», а Opus — как «complex agentic coding and enterprise work», и на практике граница между ними держится ровно на этом. С архитектурными решениями и кодом, который агент видит впервые, сложнее, ведь ошибка на старте дорого аукается дальше по цепочке, и поэтому 2,5-кратная переплата за Opus окупается снижением риска именно такой ошибки.
Релиз Sonnet 4.6 в прошлом поколении линейки показывает, что граница между «средней» и «топовой» моделью условна: в собственном тестировании Anthropic разработчики предпочли Sonnet 4.6 прошлой версии Sonnet 4.5 в 70% случаев и даже тогдашнему топовому Opus 4.5 в 59% случаев (источник). Речь о моделях прошлого поколения, не о текущих Sonnet 5 и Opus 5, но сам факт снимает привычную интуицию, будто более дорогая модель всегда лучше для сложных задач: обновлённая средняя модель регулярно обгоняла по фактическим предпочтениям пользователей более старую топовую.
Claude Code частично снимает эту границу встроенным режимом opusplan. Алиас в команде /model включает Opus только на этапе планирования, там, где нужна архитектурная логика, и сам переключается на Sonnet, как только начинается непосредственное написание кода. Opus в этой логике нужен там, где решение стоит принять один раз в начале работы, а выполнять его дальше может модель подешевле. На практике агент сначала раскладывает задачу на шаги и продумывает архитектуру на дорогой модели, а потом пишет сам код уже на быстрой и дешёвой, без ручного вмешательства в переключение.
Модель меняется прямо посреди сессии командой /model. История диалога и уже прочитанные файлы при переключении сохраняются, поэтому сессия продолжается с того же места, но на другой модели. В открывшемся списке Enter сохраняет выбранную модель как значение по умолчанию для новых сессий, а клавиша s переключает только текущую сессию, не трогая настройку для следующих запусков.
На Pro, Team Standard и корпоративных местах по подписке сессия стартует на Sonnet 5. На Max, Team Premium и при прямом доступе через API — на Opus 5. Fable, самая дорогая модель в линейке, по умолчанию не включается ни на одном тарифе, её ставят только вручную командой /model fable. Есть и отдельная деталь для уже начатых диалогов: сессия, возобновлённая командой --resume или --continue, сохраняет ту модель, на которой велась работа раньше, независимо от текущей настройки по умолчанию, и поэтому переключение в одном диалоге не сбивает модель в другом.
Можно ли переключать модель посреди сессии? Да. Команда /model переключает модель мгновенно и не обнуляет ни историю диалога, ни уже прочитанные файлы. При выборе в открывшемся списке Enter сохраняет модель как значение по умолчанию для будущих сессий, а s меняет модель только для текущей сессии. Режим opusplan избавляет от ручного переключения вовсе, потому что сам ставит Opus на этап планирования и Sonnet на этап выполнения кода.
Тратит ли Haiku лимит так же, как Sonnet? Нет, по цене за токен Haiku вдвое дешевле Sonnet и впятеро дешевле Opus, и в обычной сессии это прямо снижает расход лимита. Точного официального коэффициента именно для лимита подписки Anthropic не публикует. В сборках с несколькими сабагентами эта экономия на практике не всегда подтверждается. Один из участников открытого обсуждения на GitHub-репозитории Claude Code с оркестратором на Opus и сабагентами на Haiku зафиксировал расход недельного лимита в разы быстрее ожидаемого — тот же случай, что разобран выше.
Прямого правила «всегда бери Sonnet» или «плати за Opus, если можешь себе позволить» из официальных данных не выводится, потому что Anthropic оставляет решение на пользователя, публикуя цену за токен и общие рекомендации вместо готовой формулы под конкретный лимит подписки. Рабочий ориентир складывается из всех этих цифр сам. Sonnet держат моделью по умолчанию для всего, что не требует архитектурного решения с нуля. Opus включают осознанно и под конкретный момент в работе — на час или два, не на весь день.
Выбор модели тоже остаётся практикой, которую проще откалибровать на чужом опыте, чем разбираться в одиночку после того, как счёт уже пришёл. В клубе AI Practiq предприниматели сверяют такие решения друг с другом до того, как выбор модели обходится дорого.