为影视、短片、广告和短剧规划叙事配乐,建立 Mxx Cue,并转换为可复制的 AI 音乐 Prompt。
| 项目 | 说明 |
|---|---|
| 类型 | Codex Skill |
| 调用 | $ai-music-prompt-designer |
| 默认输出 | 配乐方案、Cue 清单与音乐 Prompt,不调用 API |
| 可选输出 | 明确授权后通过 Gemini Lyria 生成一首 MP3 |
配乐师先解决“这一段为什么需要音乐、音乐如何发展”,再决定风格、配器和平台写法。它也可以分析参考音乐、诊断生成结果,并在用户明确要求时执行一次受控音频生成。
当前发布基线:v2.0.2。
- 根据剧本、字幕、导演说明和项目材料规划全片配乐。
- 建立按出现顺序编号的
M01、M02、M03…… Cue 清单。 - 为单个 Cue 建立平台中立的音乐设计母版和相对时间轴。
- 把同一音乐母版适配为 Lyria 或其他 AI 音乐平台的可复制 Prompt。
- 为对白密集场景控制配器、旋律、频段和动态,给对白保留空间。
- 分析指定参考音乐,并区分技术信息、算法估算和听感判断。
- 根据生成音频或用户反馈诊断问题,保留有效特征并修订 Prompt。
- 仅在收到明确的直接生成指令后,通过 Gemini Lyria 保存并返回一首 MP3。
读取用户指定的项目材料
↓
规划音乐功能、留白与 Cue 边界
↓
确认完整 Mxx Cue 清单
↓
设计单个 Cue 的平台中立母版
↓
输出平台 Prompt 或明确授权生成音频
↓
试听诊断并修订
可安装的完整 Skill 位于仓库的 skill/ 目录。以下安装位置依据当前 Codex Build skills 文档。
使用 $skill-installer,从
https://github.com/lawkuk9/ai-music-prompt-designer-public/tree/main/skill
安装 ai-music-prompt-designer。
先克隆仓库并进入目录:
git clone https://github.com/lawkuk9/ai-music-prompt-designer-public.git
cd ai-music-prompt-designer-publicWindows PowerShell:
$source = Join-Path (Get-Location) 'skill'
$targetRoot = Join-Path $env:USERPROFILE '.agents\skills'
$target = Join-Path $targetRoot 'ai-music-prompt-designer'
if (Test-Path -LiteralPath $target) {
throw "安装目标已存在:$target"
}
New-Item -ItemType Directory -Path $targetRoot -Force | Out-Null
Copy-Item -LiteralPath $source -Destination $target -RecursemacOS / Linux:
target="$HOME/.agents/skills/ai-music-prompt-designer"
test ! -e "$target" || { echo "Install target already exists: $target"; exit 1; }
mkdir -p "$HOME/.agents/skills"
cp -R "./skill" "$target"如果只希望它在某个项目中可用,将完整 skill/ 目录复制到:
<project-root>/.agents/skills/ai-music-prompt-designer/
安装后应能在 Codex 的 Skills 页面看到“配乐师 2.0”,或通过 $ai-music-prompt-designer 选择它。若未出现,重启 Codex 后再次检查。
使用 $ai-music-prompt-designer。
读取我指定的剧本和字幕,为全片设计配乐方案与 Mxx Cue 清单。
重点考虑对白避让和必要留白;先不要生成所有平台 Prompt。
使用 $ai-music-prompt-designer。
设计 M03:夜间车站重逢,人物保持克制,结尾留下未解决的危险感。
输出中文音乐设计分析、相对时间轴和可复制的 Lyria Prompt,不调用 API。
使用 $ai-music-prompt-designer。
分析我指定的参考音频,提取可以迁移到 M03 的速度、配器、结构、动态和空间特征。
区分文件技术信息、算法估算和听感判断,不复制旋律或标志性编曲。
使用 $ai-music-prompt-designer。
根据这份 M03 音频和我的反馈,说明偏差来自 Prompt、平台随机性、时长还是偏好变化。
先更新音乐母版,再输出修正版 Prompt。
- 明确指定的剧本、字幕、导演说明、客户要求或项目材料。
- 已确认的 Mxx Cue 清单、单个 Cue 需求或现有音乐 Prompt。
- 本地参考音频、公开参考页面、生成结果或具体听感反馈。
- 如需精确对白密度:带时间戳的 UTF-8
.srt或.vtt字幕。
配乐师只读取你明确指定的文件、路径、链接或片段。若只提供一个文件夹,它会先列出候选文件,不会自动扫描并打开全部内容。
- 中文完整配乐设计方案和带叙事功能的 Mxx Cue 清单。
- 单个 Cue 的平台中立音乐设计母版与必要的相对时间轴。
- 独立、可复制的平台 Prompt。
- 参考音乐的证据分层分析。
- 生成结果诊断、需要保留的特征和修订 Prompt。
- 明确授权后保存到指定目录的一首 MP3。
剧本阶段的时长属于估算,需以后期剪辑实际时长为准。相对时间轴用于指导音乐结构,不承诺逐帧卡点。
| 用户表达 | 实际行为 |
|---|---|
| “生成 M03”“写 Prompt”“适配 Lyria” | Prompt-only,不调用 API |
| “直接生成 M03 音频”“调用 Gemini API” | 确认保存目录后执行一次音频生成请求 |
| “重新生成” | 先诊断或修订,再等待新的明确生成授权 |
| 批量生成 | 必须先确认数量,按顺序执行,首次失败即停止 |
直接生成需要当前环境已有 GEMINI_API_KEY、可连接 Gemini API,并由你为当前项目选择一个已经存在的保存目录。每次请求使用唯一文件名,不覆盖旧文件,也不会把密钥、Prompt 或响应旁车文件写入公开仓库。
网络超时、传输失败或响应异常仍可能产生费用,因此不会自动重试。平台价格、地区和可用性等动态信息应以执行时的官方资料为准。
- 平台中立音乐母版是核心;切换平台时保留叙事功能、情绪弧线、核心音色、结构和结尾。
- Lyria Prompt 默认使用英文,设计分析和时间轴默认使用中文。
- 其他平台会先核对其当前官方能力,再把母版映射到对应字段,不会把同一长 Prompt 原样复制到所有平台。
- 本地音频分析可以使用已有的 FFmpeg 和可选 Python 音频包;缺少工具时会说明能力差异并降级,不会自动安装。
- 默认使用器乐配乐,不写歌词、对白或可理解人声;中心化人声设计需要先确认。
- 音乐 Prompt 不包含枪声、脚步、门声、车辆和碰撞等具体音效。
- 不直接模仿在世艺人、特定录音、受版权保护旋律或可辨识的标志性元素。
- 不根据字幕声称已经识别视频画面、镜头变化或逐帧同步点。
- API Key、私人文件、未授权剧本和不准备公开的核心 Prompt 不应提交到 Issue、邮件或公开仓库。
skill/ 可安装的 Skill、平台规则、分析与生成脚本
tests/ 完全虚构的生成脚本确定性测试
测试覆盖离线 dry-run、单次模拟响应、MP3 校验、错误分类、密钥脱敏和文件防覆盖,不代表任意账户、地区或音乐内容都能获得相同结果。
这是一个**公开可用(Source Available)**项目,不是开源项目。你可以查看、下载、学习并用于个人非商业用途。商业项目、企业部署、产品化、收费服务、转售或再许可必须先取得作者书面授权。完整条款见 LICENSE。
反馈、商业授权或合作联系:Kalven_kong@126.com