Речь не про сайт с кнопкой «сгенерировать». Речь про API AiHere - отдельный контур для кода, ботов и очередей. Точка входа: api.aihere.ru. Это российский поставщик нейросетей, который отдаёт картинки, видео, музыку, голос и текстовые LLM одним ключом и с оплатой из РФ.
Если уже пробовали собирать доступ по кускам - иностранная карта, "Обходы", три кабинета, разные форматы ответа - здесь схема короче. Ключ берёте в кабинете разработчика, запросы шлёте на https://api.aihere.ru/api/v1, результат забираете поллингом или коллбеком.
Витрина нужна человеку с промтом. API нейросетей нужен сервису: интернет-магазину, монтажной связке, внутренней админке, Telegram-боту, пайплайну агентства.
Через один ключ доступны разные семейства задач:
Не нужно держать отдельный аккаунт под каждую лабораторию. Меняется модель в теле запроса, баланс один.
Про цифры тут молчим специально: актуальная сетка живёт на странице тарифов API и лучше смотреть её, а не копировать в статью устаревшую строку.
Смысл тарифа другой. Нет ежемесячного пакета, который сгорает, если вы неделю не гоняли ролики. Списывается факт работы. Для студии и продукта это спокойнее: нагрузка скачет, а счёт идёт за задачи и токены, а не за «слот в тарифе».
Ещё одна полезная мелочь: если провайдер модели вернул ошибку, оценка за задачу возвращается на баланс. Не идеальный мир, но и не схема «списали и разобрались сами».
Ключ сам по себе пустой. Сначала пополнить баланс в кабинете разработчика на aihere.ru/developer.
Пополнение заточено под Россию:
Без валютного счёта и без квеста «найдите карту не из РФ». Деньги садятся на тот же счёт, с которого потом уходят генерации и чаты.
При пополнении работают бонусы за пополнение баланса. Для команд, которые гоняют видео пачками, выгоднее занести рабочий запас сразу, чем дробить платежи по сто рублей. Бонус приходит на тот же баланс, отдельный «купон в личном кабинете» ловить не нужно.
Страница первых шагов короткая специально. Подключить API нейросети можно за вечер, если уже есть любой HTTP-клиент.
Как это выглядит без прикрас:
Авторизация одна на все методы. Базовый адрес один. Не нужно учить отдельный протокол под видео и отдельный под картинку.
Для чатов путь ещё прямее: POST /api/v1/chats/completions, в теле модель и messages. Можно стримить ответ в формате, к которому уже привыкли по OpenAI.
Генерация в этом API асинхронная. Видео за три секунды не собирается, поэтому эндпоинт не держит соединение минутами. Отдал task_id - и свободен. Как забирать файл, подробно разобрано здесь: коллбеки и поллинг.
Два рабочих варианта.
Сами спрашиваете GET /task/{task_id}. Статусы идут цепочкой: очередь, генерация, успех или ошибка. Когда статус success, в ответе появляются ссылки на файл. Для чернового скрипта этого хватает. Только не долбите метод каждую секунду: разумный шаг - раз в несколько секунд, с паузой побольше на длинных роликах.
В запрос на создание задачи добавляете заголовок X-Callback-Url. Когда модель доработает, API сам пришлёт POST на ваш сервер: id задачи, статус, ссылки, имя модели.
Для продакшена обычно делают так: коллбек как основной путь, редкий поллинг как страховка. Обработку лучше вешать на task_id и не обрабатывать одну и ту же задачу дважды. Подпись коллбека проверяется по секрету из GET /callback/secret, чтобы к вам не прилетел чужой POST.
Если генерация сорвалась, деньги пытаются вернуть автоматически. Перед повтором всё равно гляньте GET /balance.
У картинки и ролика логика «задача стоит столько». У текста иначе. Для LLM включена токенная тарификация: отдельно вход, отдельно выход.
Это как раз те цены в токенах в чатах, которых не хватает в сервисах с тарифом «за сообщение». Длинный системный промт и короткий ответ - разные суммы. Короткий вопрос и огромный max_tokens - тоже разные.
Как это устроено на практике:
Сервер историю диалога за вас не хранит. В каждый запрос кладёте нужный кусок messages и платите за этот кусок. Зато нет сюрприза, что где-то на стороне копятся старые ветки и внезапно всплывают в счёте.
Для команд, которые считают экономику бота или ассистента, такая прозрачная токенная тарификация для текстовых LLM удобнее подписки. Видно, какая модель жрёт контекст, а какая отрабатывает дешевле на коротких репликах.
Не всё можно мерить токенами. Поэтому сетка на странице тарифов разделена по типу работы, без одной линейки на всех.
Списание идёт в момент постановки задачи. Баланс можно проверить тем же GET /balance. История и коммерческие условия - в кабинете разработчика, не в переписке с менеджером «уточните прайс».
Ещё один пункт, из-за которого люди отваливаются на старте: docs закрыты логином. У AiHere API описание открыто.
Можно без аккаунта прочитать:
Документация API без регистрации нужна не для красоты. Разработчик смотрит формат, продукт смотрит модели, финансист смотрит, как списывается баланс. Кабинет понадобится только когда решите выпустить ключ и положить деньги.
Если задача разовая, API ни к чему. Если генерации встроены в продукт - проще сразу идти в этот контур, а не обкладывать витрину парсером.
Откройте первые шаги. Параллельно пробегите тарифы и кусок про коллбеки. Затем ключ, пополнение через МИР или СБП, тестовый GET /balance и одна картинка или один чат.
Не нужно собирать зоопарк прокси. Нужен рабочий API нейросети Россия с понятным списанием и нормальной оплатой из РФ - этого контура обычно хватает, чтобы перестать решать инфраструктуру вместо своей задачи.