模型分层选择与完整 MIDI 演示
先选主模型,再选该系列的版本或处理方式,演示随所选版本切换。
分轨和转 MIDI 中同系列的版本分为上下两层卡片,仍可分别查看状态与参数。MuScriptor 默认分段修复,YourMT3+ 默认 YPTF.MoE+Multi noPS。多乐器转 MIDI 统一使用《だから僕は音楽を辞めた》完整演示,并修复含特殊字符文件名的 MIDI 预览加载问题。
新功能、模型上新与替换、性能优化和修复,按上线时间持续记录。
先选主模型,再选该系列的版本或处理方式,演示随所选版本切换。
分轨和转 MIDI 中同系列的版本分为上下两层卡片,仍可分别查看状态与参数。MuScriptor 默认分段修复,YourMT3+ 默认 YPTF.MoE+Multi noPS。多乐器转 MIDI 统一使用《だから僕は音楽を辞めた》完整演示,并修复含特殊字符文件名的 MIDI 预览加载问题。
上传录音,检查素材并确认积分,训练可用于翻唱的私人声音模型;也可继续训练兼容的已有模型。
在“语音与演唱”中可直接打开 RVC 模型训练。独立页面与翻唱页共用素材检查、报价、训练进度、历史重试和模型保存,已有训练草稿可继续使用。
避免音频峰值过高导致男女声等分离任务在导出时失败。
Chorus 男女声分离在导出前检查整组音轨的峰值,需要降低音量时对所有音轨使用同一固定增益,保留相对音量、动态和完整时长;无需降低音量的结果保持原音量。共用导出链路的观众声移除、降噪、去回声和 DrumSep 鼓组分离也包含此修复。下载文件中的 audio-export.json 记录实际音量调整。
普通任务处理完且资源可用时开始训练;有新任务时保存断点并暂停,资源再次空闲后自动续训。暂停和继续不额外扣积分。
移动鼠标、触摸曲线或拖动滑块查看具体数值;滑块支持方向键、Home 和 End。 继续同一个任务会恢复已保存的模型、优化器和训练位置;意外中断后,最近一次保存之后尚未确认的步骤可能重算。 这里上传已有的 RVC 模型文件;只有录音时,请使用“训练我的声音”。上传默认私有,只有主动开启公开后其他用户才能选择该模型。
分离和转 MIDI 模型可逐个选择,查看各自状态、参数和公开成绩。
IDM、MSG-LD、ADTOF、ADT_STR 等模型改为独立卡片,任务名称对应实际所选模型。分类图表保留全部模型,仅在相同测试条件下显示可比成绩;缺少成绩会明确标注。OaFS 按实际完成的特征窗口、推理批次和解码工作回报进度。音轨和 MIDI 试听的增益上限调整为 +6 dB,并优化手机上的控制布局。 补充同类模型使用同一份完整素材的演示,并重新生成 AI 翻唱演示;音频保留无损输出。ADTOF Direct 可选择独立鼓轨或完整混音,后者先提取鼓声。修复音色目录刷新后短暂变空、恢复后仍不显示的问题。
多乐器混音与钢琴录音有了新的 MIDI 转写模型。
OaFS 识别 34 类乐器,导出 MIDI 和音符表;力度固定为 127。 SFT-CRNN 识别钢琴音符起止;力度固定为 100,不预测踏板。
IDM 分鼓,ADT_STR 与 MSG-LD 转写鼓点。
IDM 输出九类鼓件音轨,不输出 MIDI。 ADT_STR 识别 26 类鼓件的起音与力度,导出 MIDI。 MSG-LD 生成五类鼓件音轨并检测起音;MIDI 力度固定为 100,播放时长固定为 0.1 秒。
HookKern 新增四重奏,Tsumugi 与 SwiftF0 更新。
HookKern 保留主旋律和弦模型,新增弦乐四重奏模型。Tsumugi 新增和声 v1.5/v1.6 与鼓 v1.5,和声默认改为 v1.6;SwiftF0 从 0.1.2 更新至 0.2.0。
保留极短音符,试听新增鼓件,查看真实演示。
修复极短 MIDI 音符的结束事件,未改动时间的音符导出时保留原时值。IDM 九轨和 MSG-LD 五轨可在结果页试听;OaFS、SFT-CRNN 与 IDM 演示换为真实任务结果。
素材不足会显示有效时长,训练中断后保留进度。
素材检查会列出有效内容、所需时长和还需补充的时长。失败后可重试;训练任务在服务重启后保留队列与断点,满足调度条件时继续训练。
修复部分音频读取失败,已处理的 MIDI 可单独下载。
更新音频解码处理。若完整转写未完成,任务页可下载已生成片段,并明确标注结果不完整;失败任务的退款状态保持不变。
单乐器转 MIDI、主旋律和弦谱与声音合成功能恢复可用。
Basic Pitch 用于单乐器音频转 MIDI,HookKern 输出主旋律与和弦谱,ZONOS2 支持参考声音合成。对应演示已替换为本次真实任务产物。