В 2026 году генерация аудиоконтента стала обыденностью, а не диковинкой. Я как контент-специалист постоянно тестирую инструменты, которые экономят время, и Маша GPT — один из них. Это агрегатор, где собраны разные модели для работы со звуком и текстом. Расскажу, как здесь можно озвучить рекламу и создать песню с нуля, поделюсь личным опытом и ограничениями, которые стоит обходить.
Первое, что я усвоила, что даже самая продвинутая нейросеть не спасет слабый текст. Поэтому начинаем не с выбора голоса, а с подготовки скрипта. Без этого финальный результат будет техничным, но неубедительным.
Для рекламных задач я иду в раздел «Чат» и выбираю модель Chat GPT 5.6. Она хорошо понимает маркетинговый контекст и строит фразы с правильной ритмикой, что критично для дальнейшей озвучки. В промпте обязательно указываю:
Без этих деталей текст получается шаблонным. Как только скрипт готов, копирую его — он понадобится дальше.
С готовым текстом перехожу в раздел «Аудио» и выбираю опцию «Озвучить рекламу». Справа открывается панель с голосами — библиотека впечатляет. Для теста я взяла MARK, который позиционируется как дружелюбный и понятный. Система рекомендует модель синтеза Eleven Multilingual v2, я соглашаюсь, вставляю текст и жму «Сгенерировать».
Результат технически безупречен — чистое звучание, никаких шумов. Но для гипотетической рекламы молодежного продукта голос оказался слишком размеренным. Это не ошибка алгоритма — просто пресет не подошел под конкретную задачу.
Я возвращаюсь к настройкам и выбираю Clyde — более харизматичный вариант. Дальше играю с ползунками:
Второй вариант уже гораздо ближе к тому, что нужно. Вывод прост: алгоритмы хорошо справляются с расстановкой пауз, но общую энергетику и темп лучше настраивать вручную. Не бойтесь тестировать разные комбинации — на бесплатном тарифе доступно пять генераций в день.
Если озвучка — это в основном работа с текстом, то создание песни затрагивает все элементы: мелодию, аранжировку, вокал. Я решила попробовать сделать детскую песенку и посмотреть, насколько глубоко можно управлять процессом.
Для творческих задач я переключаюсь на модель Claude — она лучше чувствует ритм и рифму. В промпте указываю ключевые слова («осень», «листья», «дождь») и уточняю, что это песня для детей 3-5 лет. Claude выдает несколько вариантов текста — я выбираю самый простой и ритмичный, чтобы его легко было положить на музыку.
Здесь многие ошибаются, так как для создания песни нужен именно раздел «Музыка», а не «Аудио». Это два разных движка. В «Музыке» выбираю «Создать трек с вокалом» и вставляю подготовленный текст.
Чтобы ИИ музыка получилась именно такой, как задумано, важно четко прописать все параметры:
Генерация занимает около двух минут. Система выдает два варианта с разной аранжировкой — в одном акцент на фортепиано, в другом на легких струнных. Вокал в обоих случаях соответствует заданию: чистый детский голос, попадание в ноты.
После тестирования я выделила для себя несколько ключевых моментов. Платформа удобна тем, что все собрано в одном месте — не нужно переключаться между сервисами. Интерфейс интуитивный, даже если вы раньше не работали с нейросетями.
Озвучка рекламы требует времени на подбор голоса и настройку параметров. Не надейтесь, что с первого раза получится идеально — заложите время на эксперименты. Особенно важно тестировать разные модели синтеза, потому что каждая дает свой оттенок звучания.