Перед началом
- Кредиты. Музыка стоит 20 кредитов за генерацию. Стоимость звуковых эффектов и звука по картинке показывается на карточке до того, как агент их запустит.
- Тариф. Музыка, эффекты из текста и MMAudio доступны на любом тарифе. Mirelo AI SFX помечена значком pro.
- Клип в Медиатеке (Media pool) — для звука по картинке. Сгенерированные клипы уже там.
- Иногда — выбор модели. Если запрос оставляет выбор открытым, агент может спросить, какую музыкальную модель использовать, и дождаться ответа, прежде чем тратить кредиты.
Запрос агенту
Фоновая музыка (/music-gen)
Звуковой эффект из текста (/voice)
Звук для немого клипа (/video-sfx)

/model; у музыки, звуковых эффектов и звука по видео в списке свои разделы.
Параметры
Музыка
Опишите жанр, настроение, темп (BPM), инструменты и место в монтаже («под закадровый голос», «стингер на открытии»). Если темп не указан, агент подберет подходящий сцене.
Звуковые эффекты из текста
ElevenLabs SFX генерирует один эффект длиной от 0,5 до 22 секунд (5 с, если не указать). Формулируйте конкретно («громко лающая собака»), добавляйте контекст («шаги по гравию, на улице») и стиль («звук 8-битной игры», «кинематографичный райзер»).Звук по картинке
Скажите агенту, что должно быть слышно («в конце хлопает дверь», «шаги в темпе ходьбы»), — синхронизация станет точнее. Для непрерывного фонового шума без видимого источника попросите эмбиент-подложку только по тексту.
Где появляется результат и что делать дальше
- Музыка и звуковые эффекты сохраняются в Медиатеку как аудиоассеты со значком Создано ИИ-агентом (Created by AI agent), получают имя по задаче (например Interview Ambient Bed) и ставятся на аудиодорожку, например A1. Музыкальная подложка под речью обычно выставляется заметно тише голоса (около −18 дБ) и с затуханием в конце. Скажите «с самого начала» или «под третьей сценой», чтобы задать место, или «только в библиотеку», чтобы не ставить ее на таймлайн.
- Звук, сгенерированный по клипу, — отдельный аудиоассет, выровненный по клипу-источнику, чтобы совпадать с картинкой.
- Карточки задач (Генерация музыки (Music generation), Звуковые эффекты для видео (Video sound FX)) показывают ход работы и завершаются сообщением «Генерация завершена — результат добавлен в библиотеку» с кнопками Показать в медиапуле (Reveal in library) и Сгенерировать заново (Regenerate). Сгенерировать заново дает еще один дубль с теми же настройками.
- Сведите микс в Инспекторе: задайте Громкость (Volume) для каждого клипа, добавьте аудиофейды в начале и в конце или анимируйте громкость ключевыми кадрами с пресетом Громкость (Gain). Или просто попросите: «приглуши музыку под закадровым голосом и плавно выведи ее за последние 3 секунды».
- Запустите
/beat-analyzeна музыкальной дорожке, чтобы получить BPM, метки битов, секции (интро, куплет, припев) и предлагаемые точки склеек, а потом скажите «нарежь монтаж по битам». Воркфлоуwf-montageделает все это от начала до конца.

Через Раскадровку
Основной путь — чат, но Раскадровка (Storyboard) тоже умеет генерировать аудио: на пустой доске есть кнопки Сгенерировать музыку (Generate music) и Синтезировать речь (Synthesize speech), а позже то же самое делает значок типа «аудио» в строке промпта. Результат появляется на доске как узел. См. Раскадровка.Советы
- Veo 3 Fast, Kling 3.0 Pro, Kling O3 Pro и модели Seedance могут генерировать собственный звук, если в настройках генерации включен Звук вкл. (Sound on). Возможно, сверху понадобится только музыка.
- Не пускайте эффекты в частотный диапазон музыки. Если подложка с тяжелыми басами, просите «четкие, яркие» эффекты.
- Одна идея на один музыкальный запрос. Если нужны и стингер для интро, и подложка, просите две генерации.
- Черновик соберите на лупах CassetteAI, а для ключевых моментов закажите стингер в Lyria 2.