Novos recursos, adição e substituição de modelos, melhorias de desempenho e correções por data de lançamento.
Publicado
Correções
Famílias de modelos e demonstrações MIDI completas
Escolha a família e depois a versão ou o modo de processamento. A demonstração acompanha a seleção.
Versões relacionadas de separação e MIDI aparecem em dois níveis de cartões, com estados e ajustes individuais. MuScriptor usa reparo por segmentos por padrão; YourMT3+ usa YPTF.MoE+Multi noPS. As demonstrações com vários instrumentos usam a música inteira だから僕は音楽を辞めた. Foi corrigido o carregamento de prévias MIDI com caracteres especiais no nome do arquivo.
Envie gravações, confira o material e confirme o orçamento em créditos para treinar uma voz privada para covers ou continuar o treinamento de um modelo compatível.
O treinamento RVC pode ser aberto diretamente em Voz e canto. A página dedicada compartilha análise do material, orçamento, progresso, novas tentativas pelo histórico e salvamento de modelos com a página de covers. Os rascunhos de treinamento existentes continuam disponíveis.
Evita que picos altos de áudio causem falhas na exportação de vozes e outras faixas.
O Chorus verifica os picos de todas as faixas antes de exportar as vozes masculinas e femininas. Quando é preciso atenuar, aplica o mesmo ganho constante a todas as faixas, preservando os níveis relativos, a dinâmica e a duração completa. Resultados que não precisam de atenuação mantêm o nível original. A correção também abrange a remoção de público, ruído e eco e a separação de bateria com DrumSep. O arquivo audio-export.json disponível para download registra o ajuste real de ganho.
O treinamento começa quando as tarefas comuns terminam e há recursos livres. Novas tarefas o pausam após salvar; ele retoma quando há recursos, sem créditos adicionais.
Mova o ponteiro, toque no gráfico ou arraste o controle para ver os valores. O controle aceita setas, Home e End. Continuar a mesma tarefa restaura modelo, otimizador e posição de treino. Após uma interrupção inesperada, passos posteriores ao último salvamento confirmado podem ser repetidos. Envie aqui um modelo RVC pronto. Se tiver apenas gravações, use o treinamento de voz. O modelo é privado por padrão; outros só podem selecioná-lo depois de ativar o compartilhamento público.
Cartões de modelos, resultados comparáveis e volume
Selecione modelos de separação e MIDI individualmente e consulte seu estado, parâmetros e resultados publicados.
IDM, MSG-LD, ADTOF, ADT_STR e outros modelos têm cartões próprios; o nome da tarefa identifica o modelo escolhido. O gráfico de cada categoria inclui todos os modelos e compara apenas pontuações obtidas nas mesmas condições. Resultados ausentes são indicados. OaFS informa janelas de características, lotes de inferência e etapas de decodificação concluídos. O ganho de reprodução de faixas de áudio e MIDI chega a +6 dB, com controles aprimorados para celulares. Foram adicionadas demonstrações com a mesma entrada completa para modelos comparáveis e a demonstração de cover com IA foi regenerada, preservando o áudio sem perdas. O ADTOF Direct aceita bateria isolada ou uma mixagem completa, da qual extrai a bateria primeiro. Corrigidas as listas de vozes que continuavam vazias após uma falha temporária de atualização.
Mais modelos MIDI para mixagens completas e gravações de piano.
OaFS detecta 34 classes de instrumentos e exporta MIDI e tabelas de notas com velocidade fixa de 127.
SFT-CRNN detecta início e fim das notas de piano; velocidade fixa de 100, sem previsão de pedal.
IDM separa pistas; ADT_STR e MSG-LD transcrevem batidas.
IDM exporta nove faixas de bateria sem MIDI.
ADT_STR detecta ataques e velocidades de 26 classes de bateria e exporta MIDI.
MSG-LD gera cinco faixas de bateria e detecta ataques; o MIDI usa velocidade 100 e duração fixa de reprodução de 0,1 segundo.
Quartetos no HookKern e novidades no Tsumugi e SwiftF0.
O HookKern mantém o modelo de melodia e acordes e adiciona quartetos de cordas. O Tsumugi adiciona harmonias vocais v1.5/v1.6 e bateria v1.5; a harmonia v1.6 passa a ser padrão. O SwiftF0 muda de 0.1.2 para 0.2.0.
Melhorias na exportação MIDI e na prévia da bateria
Preserve notas curtas, ouça novas pistas e explore exemplos reais.
Notas MIDI muito curtas agora terminam corretamente. Notas sem edição de tempo mantêm a temporização original na exportação. Ouça nove pistas IDM ou cinco MSG-LD nos resultados. As demos de OaFS, SFT-CRNN e IDM usam saídas de tarefas reais.
A análise mostra a duração útil e preserva o progresso após interrupções.
A análise informa a duração de áudio útil, a necessária e quanto ainda falta adicionar. Tarefas com falha podem ser repetidas. A fila e os pontos de controle sobrevivem às reinicializações do serviço; o treinamento continua quando as condições de execução permitem.
Recupere trechos concluídos se o MuScriptor falhar
Decodificação de áudio corrigida e download separado do MIDI já processado.
A decodificação de áudio foi atualizada. Se a transcrição completa não terminar, a página da tarefa oferece os trechos gerados, identificados como incompletos. O estado de reembolso da tarefa com falha permanece inalterado.
MIDI de instrumento único, partituras de melodia e acordes e síntese de voz voltaram.
O Basic Pitch converte áudio de um instrumento em MIDI. O HookKern produz partituras de melodia e acordes, e o ZONOS2 sintetiza fala com uma voz de referência. As demonstrações agora usam resultados de tarefas reais desta versão.