Агрегаторы нейросетей: почему счёт агентства растёт, когда цены падают

2026-08-17 19:51:48 Время чтения 8 мин 67

Что покупают за семь миллиардов

Выручка компании, по данным The Information со ссылкой на источник, около 140 миллионов долларов в пересчёте на год – покупают примерно за пятьдесят годовых выручек. Своих моделей нет, исследовательской лаборатории тоже нет. Официального подтверждения Stripe не давал.

Роман Белодед, управляющий партнёр YellowRocks.vc: «Когда смотришь на любой технологический стек, вопрос всегда один – в каком слое остаётся маржа. Обычно она уходит туда, где сидит дефицит, и это почти никогда не тот слой, куда смотрят все».

Почему счёт за нейросети растёт, когда цены падают

Короткий ответ: дешевеет единица работы, а самих единиц требуется в разы больше.

Работа моделей на запросах подешевела радикально. По расчётам Epoch AI, запрос уровня GPT-3.5 стоил двадцать долларов за миллион токенов в ноябре 2022 года и семь центов к октябрю 2024-го.

Обычно это объясняют парадоксом Джевонса: дешевизна разгоняет потребление. Это измерили, и вышло иначе. В работе, где разобрали сто триллионов токенов, прошедших через OpenRouter за год, эластичность спроса померили напрямую: снижение цены на десять процентов даёт рост использования на полпроцента.

Рост идёт оттуда, что дешевизна открывает задачи, за которые раньше не брались: вместо одного запроса работает агент, который перечитывает собственный вывод и переспрашивает сам себя. По декабрьскому опросу Menlo Ventures среди американских компаний корпоративные расходы на ИИ выросли с 1,7 миллиарда долларов в 2023 году до 37 миллиардов в 2025-м.

Сколько берут агрегаторы нейросетей в России

Ведомости в начале июля оценили этот рынок примерно в три миллиарда рублей в год. Российские платформы доступа берут от десяти до двадцати процентов от стоимости запроса, зарубежный OpenRouter – около пяти.

Сравнение честное наполовину. Прямого доступа к флагманским моделям у российской компании нет: OpenAI блокирует трафик из стран, которые не обслуживает, Anthropic публично подтверждала запрет для России. Реальный выбор стоит между пятнадцатью процентами и отсутствием доступа, и часть надбавки оплачивает конкретную работу:

  1. платёж в рублях и договор с российским юрлицом;
  2. закрывающие документы для бухгалтерии;
  3. готовность держать сервис, когда провайдер отключает целые страны.

Остальное – рента за отсутствие альтернативы, и её размер как раз предмет разговора с поставщиком.

Где агрегаторы прячут наценку

Ответ короткий: в исходящих токенах, и для маркетинга это худшее место.

Официальная цена Anthropic на Claude Opus 5 в пересчёте по курсу ЦБ на середину августа – примерно 425 рублей за миллион входящих токенов и 2125 за миллион исходящих. У ProxyAPI те же токены стоят 1516 и 7579 рублей, ровный множитель в три с половиной раза по обеим позициям. У AITunnel вход стоит 100 рублей, дешевле официальной цены, а выход – 5000, вдвое дороже официальной. Соотношение выхода ко входу выходит пятьдесят при том, что у самой Anthropic оно равно пяти.

Пока исходящих токенов много относительно входящих, схема бьёт по карману. Если входящих примерно в девять раз больше, она сравнивается с официальной ценой, дальше становится дешевле.

Почему маркетинг платит больше разработки

Входящие токены – это то, что отправили в модель: контекст, брифы, выгрузки, база знаний. Исходящие – то, что модель написала. Разработчик, который просит агента разобраться в большом проекте, отправляет огромный контекст и получает короткую правку, его соотношение уходит далеко за девять к одному. Генеративные задачи маркетинга устроены зеркально: короткий бриф на входе, а на выходе тридцать вариантов заголовков, описания карточек товара, тексты рассылок, посты под тест креативов.

То есть агентство и внутренняя команда бренда живут ровно в той зоне прайса, где наценка посредника максимальна. Один и тот же агрегатор для разработки выходит дешевле официальной цены, а для генерации контента – вдвое дороже. Отсюда правило: своё соотношение входящих и исходящих токенов надо знать до выбора поставщика, именно оно решает, какая витрина окажется выгоднее.

Строки на нейросети нет ни в одной смете

Ramp считает расходы американских компаний на ИИ в пересчёте на сотрудника по обезличенным платежам семидесяти с лишним тысяч клиентов. В июльском срезе верхний процент тратит 7400 долларов на человека в месяц, медианная компания – 11 долларов 95 центов. Разрыв примерно в шестьсот раз, и деление на сотрудника уже сняло разницу в размере бизнеса. Часть его объясняется составом, в верхнем проценте сидят компании, для которых токены и есть себестоимость продукта, но и внутри одной отрасли разброс остаётся.

Для агентства это переводится в понятную вещь. Стоимость сотрудника перестала совпадать с его окладом: два копирайтера на одинаковой ставке обходятся по-разному, и при почасовой модели разница бьёт прямо в рентабельность проекта. При этом стандартные разборы «сколько стоит сотрудник» устроены одинаково – зарплата, налоги и взносы, оборудование, аренда, соцпакет. Строки на работу моделей нет ни в одном, и в смете клиенту её тоже нет.

Где этот слой может схлопнуться

Против позиции посредника есть аргументы, часть из них проговаривает сам основатель компании в августовском интервью подкасту 20VC.

Лабораториям есть прямой смысл прийти за теми, кто сидит поверх них: заняв стратегическую задачу, они поднимутся на уровень приложения и заберут её вместе с клиентами. Оценка в пятьдесят годовых выручек держится на ожиданиях, под которыми нет ни аудита, ни публичной отчётности. И вход в слой открыт всем: сверху давят облачные маркетплейсы моделей, снизу – открытый софт, на котором свой шлюз собирают за вечер.

Что забрать

Семь миллиардов Stripe платит за место между теми, кто делает модели, и теми, кто ими пользуется. В российском счёте за нейросети это место занимает от десяти до двадцати процентов, и в медиаплане оно никак не подписано.

Три вещи, которые стоит сделать до следующего бюджетного цикла:

  1. посчитать своё соотношение входящих и исходящих токенов за месяц, потому что без него сравнение прайсов бессмысленно;
  2. считать расходы на ИИ на одного человека вместо общей строки в бюджете и следить за их скоростью относительно численности команды;
  3. завести маржу посредника отдельной строкой в себестоимости проекта, чтобы заметить, когда она изменится.

Подписывайтесь на мой блог – здесь я считаю, в каком слое технологического стека остаётся маржа и во сколько это обходится командам, которые просто хотят пользоваться моделями.