Выручка компании, по данным The Information со ссылкой на источник, около 140 миллионов долларов в пересчёте на год – покупают примерно за пятьдесят годовых выручек. Своих моделей нет, исследовательской лаборатории тоже нет. Официального подтверждения Stripe не давал.
Роман Белодед, управляющий партнёр YellowRocks.vc: «Когда смотришь на любой технологический стек, вопрос всегда один – в каком слое остаётся маржа. Обычно она уходит туда, где сидит дефицит, и это почти никогда не тот слой, куда смотрят все».
Короткий ответ: дешевеет единица работы, а самих единиц требуется в разы больше.
Работа моделей на запросах подешевела радикально. По расчётам Epoch AI, запрос уровня GPT-3.5 стоил двадцать долларов за миллион токенов в ноябре 2022 года и семь центов к октябрю 2024-го.
Обычно это объясняют парадоксом Джевонса: дешевизна разгоняет потребление. Это измерили, и вышло иначе. В работе, где разобрали сто триллионов токенов, прошедших через OpenRouter за год, эластичность спроса померили напрямую: снижение цены на десять процентов даёт рост использования на полпроцента.
Рост идёт оттуда, что дешевизна открывает задачи, за которые раньше не брались: вместо одного запроса работает агент, который перечитывает собственный вывод и переспрашивает сам себя. По декабрьскому опросу Menlo Ventures среди американских компаний корпоративные расходы на ИИ выросли с 1,7 миллиарда долларов в 2023 году до 37 миллиардов в 2025-м.
Ведомости в начале июля оценили этот рынок примерно в три миллиарда рублей в год. Российские платформы доступа берут от десяти до двадцати процентов от стоимости запроса, зарубежный OpenRouter – около пяти.
Сравнение честное наполовину. Прямого доступа к флагманским моделям у российской компании нет: OpenAI блокирует трафик из стран, которые не обслуживает, Anthropic публично подтверждала запрет для России. Реальный выбор стоит между пятнадцатью процентами и отсутствием доступа, и часть надбавки оплачивает конкретную работу:
Остальное – рента за отсутствие альтернативы, и её размер как раз предмет разговора с поставщиком.
Ответ короткий: в исходящих токенах, и для маркетинга это худшее место.
Официальная цена Anthropic на Claude Opus 5 в пересчёте по курсу ЦБ на середину августа – примерно 425 рублей за миллион входящих токенов и 2125 за миллион исходящих. У ProxyAPI те же токены стоят 1516 и 7579 рублей, ровный множитель в три с половиной раза по обеим позициям. У AITunnel вход стоит 100 рублей, дешевле официальной цены, а выход – 5000, вдвое дороже официальной. Соотношение выхода ко входу выходит пятьдесят при том, что у самой Anthropic оно равно пяти.
Пока исходящих токенов много относительно входящих, схема бьёт по карману. Если входящих примерно в девять раз больше, она сравнивается с официальной ценой, дальше становится дешевле.
Входящие токены – это то, что отправили в модель: контекст, брифы, выгрузки, база знаний. Исходящие – то, что модель написала. Разработчик, который просит агента разобраться в большом проекте, отправляет огромный контекст и получает короткую правку, его соотношение уходит далеко за девять к одному. Генеративные задачи маркетинга устроены зеркально: короткий бриф на входе, а на выходе тридцать вариантов заголовков, описания карточек товара, тексты рассылок, посты под тест креативов.
То есть агентство и внутренняя команда бренда живут ровно в той зоне прайса, где наценка посредника максимальна. Один и тот же агрегатор для разработки выходит дешевле официальной цены, а для генерации контента – вдвое дороже. Отсюда правило: своё соотношение входящих и исходящих токенов надо знать до выбора поставщика, именно оно решает, какая витрина окажется выгоднее.
Ramp считает расходы американских компаний на ИИ в пересчёте на сотрудника по обезличенным платежам семидесяти с лишним тысяч клиентов. В июльском срезе верхний процент тратит 7400 долларов на человека в месяц, медианная компания – 11 долларов 95 центов. Разрыв примерно в шестьсот раз, и деление на сотрудника уже сняло разницу в размере бизнеса. Часть его объясняется составом, в верхнем проценте сидят компании, для которых токены и есть себестоимость продукта, но и внутри одной отрасли разброс остаётся.
Для агентства это переводится в понятную вещь. Стоимость сотрудника перестала совпадать с его окладом: два копирайтера на одинаковой ставке обходятся по-разному, и при почасовой модели разница бьёт прямо в рентабельность проекта. При этом стандартные разборы «сколько стоит сотрудник» устроены одинаково – зарплата, налоги и взносы, оборудование, аренда, соцпакет. Строки на работу моделей нет ни в одном, и в смете клиенту её тоже нет.
Против позиции посредника есть аргументы, часть из них проговаривает сам основатель компании в августовском интервью подкасту 20VC.
Лабораториям есть прямой смысл прийти за теми, кто сидит поверх них: заняв стратегическую задачу, они поднимутся на уровень приложения и заберут её вместе с клиентами. Оценка в пятьдесят годовых выручек держится на ожиданиях, под которыми нет ни аудита, ни публичной отчётности. И вход в слой открыт всем: сверху давят облачные маркетплейсы моделей, снизу – открытый софт, на котором свой шлюз собирают за вечер.
Семь миллиардов Stripe платит за место между теми, кто делает модели, и теми, кто ими пользуется. В российском счёте за нейросети это место занимает от десяти до двадцати процентов, и в медиаплане оно никак не подписано.
Три вещи, которые стоит сделать до следующего бюджетного цикла:
Подписывайтесь на мой блог – здесь я считаю, в каком слое технологического стека остаётся маржа и во сколько это обходится командам, которые просто хотят пользоваться моделями.