哼唱成曲
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-hum2song 到我的 AI 助手中。
技能介绍
解决的问题
当你只有一段哼唱、清唱或临时录音,想把它整理成可继续制作的 MIDI 旋律,甚至生成完整歌曲时,传统方式往往要上传音频到云端。hum2song 更适合本地工作流:它把 WAV、MP3、M4A、FLAC、OGG 等音频转成 44.1kHz 单声道,再提取旋律,避免录音外传。
技能如何工作
- 旋律提取:使用 Spotify 的
Basic Pitch将哼唱或演唱转换为MIDI,支持C1到C8音域、多音检测和约10ms时序分辨率。 - MIDI 清洗:对提取出的音符进行清理和结构化,减少误检与节奏噪声。
- 生成完整歌曲:如果已手动安装
ACE-Step,可选用本地模型生成音频;如果没有 AI 模型,也可以使用MIDI + SoundFont合成器路线。 - 输出选项:支持
pop、rock、jazz、classical、electronic风格,以及upbeat、calm、energetic、melancholic情绪,时长可在30到300秒之间。
适用边界
该技能需要本地 Python 环境。ACE-Step 是可选依赖,基础模型约需 4GB RAM,启用时可能需要在本地下约 4GB 权重;一段两分钟歌曲的处理时间可能在 2 到 5 分钟。生成质量取决于哼唱清晰度,复杂和声不一定能被完整捕获。
使用场景
- 把手机里一段清唱旋律转成可编辑 MIDI,再交给 DAW 做编曲。
- 在离线环境中将哼唱录音提取为 MIDI,避免上传含人声素材到云端。
- 用 MIDI + SoundFont 路线生成一段演示音频,不想安装 ACE-Step。
- 将一段两分钟哼唱生成 30 到 300 秒的完整歌曲素材并输出 WAV。
适合人员
- 想把临时哼唱整理成可编辑 MIDI 的独立音乐人。
- 需要在本地处理录音、不上传敏感音频的播客或音频创作者。
- 想测试旋律 demo 但不想配置云端 API 的游戏音频策划。
- 需要把清唱素材转 MIDI 再进 DAW 编曲的编曲工程师。