API поставщик нейросетей AiHere: российский доступ к моделям без "Обходов"

2026-09-09 11:49:03 Время чтения 10 мин 76

Речь не про сайт с кнопкой «сгенерировать». Речь про API AiHere - отдельный контур для кода, ботов и очередей. Точка входа: api.aihere.ru. Это российский поставщик нейросетей, который отдаёт картинки, видео, музыку, голос и текстовые LLM одним ключом и с оплатой из РФ.

Если уже пробовали собирать доступ по кускам - иностранная карта, "Обходы", три кабинета, разные форматы ответа - здесь схема короче. Ключ берёте в кабинете разработчика, запросы шлёте на https://api.aihere.ru/api/v1, результат забираете поллингом или коллбеком.

Home

Чем API отличается от витрины

Витрина нужна человеку с промтом. API нейросетей нужен сервису: интернет-магазину, монтажной связке, внутренней админке, Telegram-боту, пайплайну агентства.

Через один ключ доступны разные семейства задач:

  1. картинки: Nano Banana, Flux, Seedream, GPT Image, Grok Image и соседние модели;
  2. видео: Kling, Seedance, Veo, Sora, MiniMax, Wan и другие;
  3. музыка через Suno;
  4. озвучка и речь: Fish Audio, ElevenLabs;
  5. чаты: ChatGPT API, Claude, Gemini;
  6. готовые инструменты: фото на паспорт, оживление кадра, снятие фона.

Не нужно держать отдельный аккаунт под каждую лабораторию. Меняется модель в теле запроса, баланс один.

Документация

Низкие цены без абонентки «на полку»

Про цифры тут молчим специально: актуальная сетка живёт на странице тарифов API и лучше смотреть её, а не копировать в статью устаревшую строку.

Смысл тарифа другой. Нет ежемесячного пакета, который сгорает, если вы неделю не гоняли ролики. Списывается факт работы. Для студии и продукта это спокойнее: нагрузка скачет, а счёт идёт за задачи и токены, а не за «слот в тарифе».

Ещё одна полезная мелочь: если провайдер модели вернул ошибку, оценка за задачу возвращается на баланс. Не идеальный мир, но и не схема «списали и разобрались сами».

Бонусы при пополнении и оплата через МИР и СБП

Ключ сам по себе пустой. Сначала пополнить баланс в кабинете разработчика на aihere.ru/developer.

Пополнение заточено под Россию:

  1. СБП;
  2. карта МИР;
  3. привычные платежи российских банков.

Без валютного счёта и без квеста «найдите карту не из РФ». Деньги садятся на тот же счёт, с которого потом уходят генерации и чаты.

При пополнении работают бонусы за пополнение баланса. Для команд, которые гоняют видео пачками, выгоднее занести рабочий запас сразу, чем дробить платежи по сто рублей. Бонус приходит на тот же баланс, отдельный «купон в личном кабинете» ловить не нужно.

Кабинет разработчика

Лёгкость подключения: четыре шага и всё

Страница первых шагов короткая специально. Подключить API нейросети можно за вечер, если уже есть любой HTTP-клиент.

Как это выглядит без прикрас:

  1. Берёте ключ в кабинете разработчика и кладёте деньги на счёт.
  2. Проверяете баланс запросом GET /api/v1/balance с заголовком Authorization: Bearer ....
  3. Ставите задачу. Например, картинку через POST /api/v1/images/seedream-t2i. В ответе приходит task_id, а не готовый файл.
  4. Забираете результат. Либо спрашиваете статус сами, либо просите прислать его на ваш URL.

Авторизация одна на все методы. Базовый адрес один. Не нужно учить отдельный протокол под видео и отдельный под картинку.

Для чатов путь ещё прямее: POST /api/v1/chats/completions, в теле модель и messages. Можно стримить ответ в формате, к которому уже привыкли по OpenAI.

Как забирать результат: поллинг и коллбек

Генерация в этом API асинхронная. Видео за три секунды не собирается, поэтому эндпоинт не держит соединение минутами. Отдал task_id - и свободен. Как забирать файл, подробно разобрано здесь: коллбеки и поллинг.

Два рабочих варианта.

Поллинг

Сами спрашиваете GET /task/{task_id}. Статусы идут цепочкой: очередь, генерация, успех или ошибка. Когда статус success, в ответе появляются ссылки на файл. Для чернового скрипта этого хватает. Только не долбите метод каждую секунду: разумный шаг - раз в несколько секунд, с паузой побольше на длинных роликах.

Коллбек

В запрос на создание задачи добавляете заголовок X-Callback-Url. Когда модель доработает, API сам пришлёт POST на ваш сервер: id задачи, статус, ссылки, имя модели.

Для продакшена обычно делают так: коллбек как основной путь, редкий поллинг как страховка. Обработку лучше вешать на task_id и не обрабатывать одну и ту же задачу дважды. Подпись коллбека проверяется по секрету из GET /callback/secret, чтобы к вам не прилетел чужой POST.

Если генерация сорвалась, деньги пытаются вернуть автоматически. Перед повтором всё равно гляньте GET /balance.

Прозрачная токенная тарификация в чатах

У картинки и ролика логика «задача стоит столько». У текста иначе. Для LLM включена токенная тарификация: отдельно вход, отдельно выход.

Это как раз те цены в токенах в чатах, которых не хватает в сервисах с тарифом «за сообщение». Длинный системный промт и короткий ответ - разные суммы. Короткий вопрос и огромный max_tokens - тоже разные.

Как это устроено на практике:

  1. до ответа списывается оценка: вход по объёму текста, выход по вашему лимиту;
  2. после ответа сумма пересчитывается по фактическому usage;
  3. в ответе видно, сколько ушло, плюс поле со стоимостью в рублях;
  4. оборвался стрим или провайдер отдал 502 - оценку не оставляют «зависшей» без причины.

Сервер историю диалога за вас не хранит. В каждый запрос кладёте нужный кусок messages и платите за этот кусок. Зато нет сюрприза, что где-то на стороне копятся старые ветки и внезапно всплывают в счёте.

Для команд, которые считают экономику бота или ассистента, такая прозрачная токенная тарификация для текстовых LLM удобнее подписки. Видно, какая модель жрёт контекст, а какая отрабатывает дешевле на коротких репликах.

Удобное ценообразование: за генерацию или посекундно

Не всё можно мерить токенами. Поэтому сетка на странице тарифов разделена по типу работы, без одной линейки на всех.

  1. Фикс за задачу. Поставил генерацию картинки или готовый клип - списали стоимость задачи.
  2. Посекундно. Для видео, где длина задаётся вами: чем длиннее ролик, тем выше списание.
  3. За объём текста. Так у озвучки, где считается размер текста, а не «один вызов».
  4. За токены. Так у чатов GPT, Claude и Gemini.

Списание идёт в момент постановки задачи. Баланс можно проверить тем же GET /balance. История и коммерческие условия - в кабинете разработчика, не в переписке с менеджером «уточните прайс».

Документация без регистрации

Ещё один пункт, из-за которого люди отваливаются на старте: docs закрыты логином. У AiHere API описание открыто.

Можно без аккаунта прочитать:

  1. обзор API;
  2. первые шаги;
  3. логику тарифов;
  4. коллбеки и поллинг;
  5. интерактивный Swagger: light-docs.

Документация API без регистрации нужна не для красоты. Разработчик смотрит формат, продукт смотрит модели, финансист смотрит, как списывается баланс. Кабинет понадобится только когда решите выпустить ключ и положить деньги.

Кому это заходит в работе

  1. Продуктовым командам, которым нужен API для нейросетей из России без "Обходов".
  2. Агентствам, где ролики и картинки идут пачками, а не «раз в пятницу руками».
  3. Тем, кто поднимает чат-бота и хочет видеть расход токенов, а не средний чек «за диалог».
  4. Сервисам с очередью: поставил задачу, получил коллбек, отдал файл пользователю.

Если задача разовая, API ни к чему. Если генерации встроены в продукт - проще сразу идти в этот контур, а не обкладывать витрину парсером.

С чего начать сегодня

Откройте первые шаги. Параллельно пробегите тарифы и кусок про коллбеки. Затем ключ, пополнение через МИР или СБП, тестовый GET /balance и одна картинка или один чат.

Не нужно собирать зоопарк прокси. Нужен рабочий API нейросети Россия с понятным списанием и нормальной оплатой из РФ - этого контура обычно хватает, чтобы перестать решать инфраструктуру вместо своей задачи.