Собери полную аудио-спеку из брифа. Верни JSON {"voice":"...","script":"...","music":"...","sfx":"...","consent":"..."}: voice — спека голоса; script — текст с разметкой пауз и ударений по структуре ролика; music — музыкальный промпт (жанр, настроение, BPM, инструменты); sfx — звуковые акценты с привязкой к событиям; consent — согласие/источник голоса и нужный дисклеймер.
Полный аудио-бриф безопасноМеханика полного аудио-брифа: голос, музыка и звук — три слоя, которые борются за одни частоты и внимание. Правило приоритета: голос всегда сверху, музыку приглушают под речью (это называют «дакинг»), SFX — точечные акценты. Собирай бриф так, чтобы исполнитель или модель не додумывали: голос (спека), скрипт (с разметкой), музыка (промпт), SFX (раскладка). Этика — не формальность: клонировать реальный голос можно только с явного согласия его владельца; синтетический голос в рекламе и новостях часто требует пометки; чужие мелодии и «голос знаменитости» — юридический риск. Инсайд: в брифе всегда держи поле «согласие/источник голоса» — оно защищает тебя и заказчика и отсекает половину проблем на старте. Второй инсайд: задавай уровни громкости словами (голос 0 dB, музыка -18 dB под речью), чтобы свести слои без каши. Ошибка новичка: сдать «красивый звук» без согласия на голос и без пометки, что он синтетический.