一个 AI 音乐生成 skill:给视频配乐、做翻唱、分离音轨
来源:GitHub 仓库 calesthio/OpenMontage 文件 1 个,SKILL.md 语言:英语
一个 AI 音乐生成 skill。
它基于 ACE-Step 1.5(MIT 协议),通过 tools/music_gen.py 运行,跑在 RunPod serverless 上。
它的能力:
- text2music(默认):从文本 prompt + 可选歌词生成音乐
- cover:从参考音频做风格迁移
- extract:分轨——从混合音频分离出人声、鼓、贝斯、吉他、钢琴等
- repaint(未来):重新生成特定时间段
- lego(未来):在现有音频上下文中生成单个乐器轨
- complete(未来):扩展不完整作曲
有 8 个场景预设:corporate-bg、upbeat-tech、ambient、dramatic、tension、hopeful、cta、lofi
提示词工程要点:
- Caption 分层描述:风格、情绪、乐器、音色、年代、制作、人声
- 歌词格式:结构标签 [Verse]、[Chorus],人声控制 [raspy vocal],能量指示(大写 = 高音强,括号 = 背景人声)
- 每行 6-10 个音节,节奏更自然
- BPM 和 key 用 metadata 参数,不要写进 caption
视频制作集成:
- 不同场景类型有对应的音乐预设
- 背景音乐和旁白混合时,音乐音量 10-20%
- 用 --brand <name> 加载品牌提示
- 用 --seed 42 固定种子,保证项目内声音一致
技术细节:
- 输出 48kHz MP3/WAV/FLAC
- 时长 10-600 秒
- BPM 30-300
- GPU 推理约 2-3 秒
适合谁:
- 做科普视频、教学视频的科研小组成员
- 需要背景音乐、人声、翻唱、分轨的人
- 想把音乐和视频制作流程结合起来的人
用法: 把 SKILL.md 内容复制到你的 AI 工具里,描述你想要的音乐风格就行。
评论 0
更多
登录后可点赞、收藏、评论和举报。
还没有评论,先发起一个具体问题。