Anthropic выпустила Claude Opus 5 24 июля, и по бенчмаркам компании модель больше чем вдвое обходит предыдущий Opus 4.8 в задачах разработки. За три дня в рунете вышло не меньше десятка статей о релизе, и почти все ограничиваются пересказом анонса Anthropic.
Для клуба, где предприниматели уже больше года решают реальные бизнес-задачи через вайбкодинг на Claude Code, интереснее другой вопрос: что новая модель добавляет к задачам, которые здесь и так уже решают — от интеграций с 1С до автоматизации воронок продаж, без найма разработчика под каждую задачу. Вайбкодинг в российском бизнесе давно перестал быть баловством: больше 80% компаний уже допускают генеративный ИИ в разработке по данным ComNews.
Разбираемся по фактам из официального анонса и по одному реальному прецеденту из практики клуба — что случилось в прошлый раз, когда модель под капотом Claude Code стала заметно сильнее в коде.
Цена осталась на уровне Opus 4.8: 5 долларов за миллион входных токенов и 25 за миллион выходных. Модель сразу доступна в Claude Code, Claude Cowork и через API, без отдельного ожидания релиза для инструмента — это прямо указано в анонсе Anthropic.
По коду разрыв заметный: на бенчмарке Frontier-Bench v0.1 Opus 5 больше чем вдвое обходит результат Opus 4.8. Отдельно интересен Zapier AutomationBench — тест на многошаговые автоматизации, где модель должна сама пройти цепочку действий до результата, самостоятельно решая, что делать на каждом шаге. Там Opus 5 показывает результат примерно в полтора раза выше ближайшего конкурента. Для задач вроде тех, что клуб уже разбирал — агент, который сам ведёт сделку по воронке, или бот, который сверяет заявки с базой и раскладывает по системам, — это ближе к практике, чем абстрактное «пишет код лучше».
Даже мейнстримная деловая пресса вроде «Коммерсанта» написала о релизе в день выхода — редкий случай, когда обновление модели попадает не только в технические издания.
Похожий разбор уже был на примере Claude Code Skills — клуб писал о том, что новая функция появляется, шумиха вокруг неё одинаковая, а реальная ценность видна только на конкретной задаче. С Opus 5 логика повторяется: тогда обновлялась одна функция сверху, сейчас обновилась сама модель под капотом Claude Code.
Что даёт качество кода на длинных задачах, хорошо видно на кейсе Дениса Кулика — сложной интеграции, которую он уже решил на Claude Code, без специального технического образования.
Кулик не айтишник. Ещё до курса развернул сервер в Нидерландах на Ubuntu и подключил Claude Code. В его строительной компании руководители проектов вели планы по разным Google-таблицам, а финансисты вручную сводили цифры в общую — двойной ввод регулярно давал ошибки. Кулик завайбкодил портал на собственном домене: бюджеты, факт, планы команд и прогнозы по единой методике с учётом налоговых ставок и страховых взносов.
На разработку, тестирование и доработки ушло два дня. Один сбой всё же случился: после перезагрузки VS Code контекст задачи слетел, потому что memory не настроили с самого начала — Кулик с тех пор ставит это первым шагом на любом новом проекте.
Такие задачи — с несколькими источниками данных и методикой расчётов, которую нужно удерживать в голове целиком, — Claude Code уже решает и без Opus 5. Новая модель, если судить по бенчмаркам, добавляет запас качества именно на этом уровне сложности, а не на разовых скриптах. Проверить это на реальном проекте пока не успели: модели три дня.
Для бизнес-вайбкодинга цифры из бенчмарков переводятся в конкретные ситуации. Кейс Кулика попадает ровно в первую такую зону — долгие интеграционные задачи, где нужно держать в голове несколько источников данных и методику расчётов одновременно. По бенчмарк-данным разрыв с предыдущей моделью здесь должен быть заметнее, чем на простом скрипте в одну функцию.
Вторая зона — многошаговые автоматизации, где модель самостоятельно доводит цепочку действий до конца, решая на каждом шаге, что делать дальше, вместо одного ответа на один вопрос. Именно такой сценарий тестирует Zapier AutomationBench, и здесь у Opus 5 наибольший отрыв от конкурентов.
Попробовать и то, и другое можно сразу: стоимость не выросла, отдельный разговор о бюджете не нужен.
Чем Opus 5 отличается от Sonnet 5?
Opus и Sonnet занимают разные весовые категории в одной линейке. Opus рассчитан на самые сложные и долгие задачи и стоит дороже, Sonnet — быстрее и дешевле для повседневных сценариев. Для большинства коротких задач хватает Sonnet, Opus имеет смысл подключать там, где модели нужно держать в голове много контекста одновременно — как в кейсе Колесникова.
Стоит ли переходить прямо сейчас?
Для задач, которые и так решаются без сбоев, менять модель смысла нет — риска ноль, но и выигрыш не гарантирован на простых сценариях. Стоит попробовать там, где текущая модель заметно тормозит или регулярно теряет контекст на многошаговой задаче: именно там, судя по бенчмаркам, разрыв больше всего.
Доступен ли Opus 5 в Claude Code уже сейчас?
Да, модель сразу доступна на всех платформах Anthropic, включая Claude Code, Claude Cowork и API, без отдельного ожидания релиза для инструмента.
За три дня рано делать далекоидущие выводы, и полноценный кейс с Opus 5 в клубе появится позже, когда кто-то реально прогонит на нём длинную задачу. Но прошлый переход между версиями уже показал, что рост в бенчмарках у Anthropic обычно снимает конкретный затык в конкретном проекте — как это случилось у Колесникова с контекстным окном.
В AI Practiq такие обновления разбираем по тому, что реально меняется в работающих проектах участников.
Присоединяйся к клубу — там такие апдейты обсуждают сообща, на живых кейсах, сразу после релиза.