Familias de modelos y demos MIDI completas
Elige una familia y después su versión o modo de procesamiento. La demo cambia con la selección.
Las versiones relacionadas de separación y MIDI se organizan en dos niveles de tarjetas, con estados y ajustes propios. MuScriptor usa reparación por segmentos de forma predeterminada; YourMT3+, YPTF.MoE+Multi noPS. Las demos multinstrumento usan la canción completa だから僕は音楽を辞めた. Se corrige la carga de vistas previas MIDI con caracteres especiales en el nombre.
Entrenamiento de modelos RVC
Sube grabaciones, revisa el material y confirma el presupuesto en créditos para entrenar una voz privada para versiones o seguir entrenando un modelo compatible.
Abre el entrenamiento RVC desde Voz y canto. La página independiente comparte el análisis del material, los presupuestos, el progreso, los reintentos desde el historial y el guardado de modelos con la página de versiones. Puedes continuar con tu borrador de entrenamiento.
Corrección de la exportación de pistas separadas
Evita que los picos altos de audio hagan fallar la exportación de voces y otras pistas.
Chorus comprueba los picos de todas las pistas antes de exportar las voces masculinas y femeninas. Si hace falta atenuar, aplica la misma ganancia constante a todas las pistas para conservar sus niveles relativos, dinámica y duración completa. Si no hace falta, mantiene el nivel original. La corrección también se aplica a la eliminación de público, ruido y eco, y a la separación de batería con DrumSep. El archivo descargable audio-export.json registra el ajuste real de ganancia.
Historial de pausas y reanudaciones
El entrenamiento empieza cuando terminan las tareas normales y hay recursos libres. Las tareas nuevas lo pausan tras guardar un punto de control; se reanuda cuando hay recursos. Sin créditos adicionales.
Mueva el puntero, toque el gráfico o arrastre el control para ver valores. Admite flechas, Inicio y Fin. Continuar la misma tarea restaura el modelo, el optimizador y la posición. Tras una interrupción imprevista pueden repetirse pasos posteriores al último guardado confirmado. Suba aquí un modelo RVC existente. Si solo tiene grabaciones, use el entrenamiento de voz. Es privado por defecto; otros usuarios solo pueden elegirlo al activar la opción pública.
Tarjetas de modelos, resultados comparables y volumen
Elige por separado los modelos de separación y MIDI y consulta su estado, parámetros y resultados publicados.
IDM, MSG-LD, ADTOF, ADT_STR y otros modelos tienen tarjetas propias; el nombre de la tarea indica el modelo elegido. El gráfico de cada categoría incluye todos los modelos y solo compara puntuaciones con las mismas condiciones de prueba. Los resultados ausentes se señalan. OaFS informa de ventanas de características, lotes de inferencia y trabajo de decodificación completados. La ganancia de reproducción de pistas y MIDI llega a +6 dB, con controles mejorados en móviles. Se añadieron demos con la misma entrada completa para modelos comparables y se regeneró la demo de versiones con IA, conservando el audio sin pérdidas. ADTOF Direct admite batería aislada o una mezcla completa, de la que primero extrae la batería. Se corrigieron las listas de voces que seguían vacías tras un fallo temporal de actualización.
Nuevas opciones OaFS y SFT-CRNN
Más modelos de transcripción MIDI para mezclas completas y piano.
OaFS detecta 34 clases de instrumentos y exporta MIDI y tablas de notas con velocidad fija de 127.
SFT-CRNN detecta el inicio y final de notas de piano; velocidad fija de 100, sin predicción de pedal.
Tres nuevos modelos para batería
IDM separa pistas; ADT_STR y MSG-LD transcriben golpes.
IDM exporta nueve pistas de batería sin MIDI.
ADT_STR detecta ataques y velocidades de 26 clases de batería y exporta MIDI.
MSG-LD genera cinco pistas de batería y detecta ataques; el MIDI usa velocidad 100 y duración fija de reproducción de 0,1 segundos.
Modelos de partituras y voz actualizados
Cuartetos en HookKern y novedades en Tsumugi y SwiftF0.
HookKern conserva el modelo de melodía y acordes y añade cuartetos de cuerda. Tsumugi incorpora armonías vocales v1.5/v1.6 y batería v1.5; la armonía v1.6 pasa a ser predeterminada. SwiftF0 cambia de 0.1.2 a 0.2.0.
Mejoras al exportar MIDI y escuchar batería
Conserva notas cortas, escucha nuevas pistas y explora ejemplos reales.
Las notas MIDI muy cortas terminan correctamente. Las notas sin cambios de tiempo conservan su temporización al exportar. Escucha nueve pistas IDM o cinco MSG-LD en los resultados. Las demos de OaFS, SFT-CRNN e IDM usan salidas de tareas reales.
Reintentos y reanudación del entrenamiento RVC
La revisión muestra la duración útil y conserva el progreso del entrenamiento interrumpido.
Se indican la duración de audio útil, la requerida y la que falta añadir. Las tareas fallidas se pueden reintentar. La cola y los puntos de control sobreviven a los reinicios del servicio y el entrenamiento continúa cuando se cumplen las condiciones de ejecución.
Recupera los fragmentos terminados si MuScriptor falla
Correcciones de decodificación y descarga independiente del MIDI ya procesado.
Se ha actualizado la decodificación de audio. Si la transcripción completa no termina, la página de la tarea permite descargar los fragmentos generados, señalados como incompletos. Se mantiene el estado de reembolso de la tarea fallida.
Basic Pitch, HookKern y ZONOS2 disponibles
Vuelven la conversión de un instrumento a MIDI, las partituras de melodía y acordes y la síntesis de voz.
Basic Pitch convierte audio de un instrumento en MIDI. HookKern genera partituras de melodía y acordes, y ZONOS2 sintetiza voz a partir de una referencia. Las demostraciones utilizan resultados de tareas reales de esta versión.