Familles de modèles et démos MIDI intégrales
Choisissez une famille, puis une version ou un mode de traitement. La démo suit votre sélection.
Les versions de séparation et de MIDI apparentées sont regroupées sur deux niveaux de cartes, avec leurs propres états et réglages. MuScriptor utilise par défaut la réparation par segments et YourMT3+, YPTF.MoE+Multi noPS. Les démos multi-instruments reprennent le morceau entier だから僕は音楽を辞めた. Le chargement des aperçus MIDI dont le nom contient des caractères spéciaux est corrigé.
Entraînement de modèles RVC
Importez des enregistrements, vérifiez le contenu et confirmez le devis en crédits pour entraîner une voix privée destinée aux reprises, ou poursuivre un modèle compatible.
L’entraînement RVC est accessible directement dans Voix et chant. Sa page dédiée partage la vérification du contenu, les devis, le suivi, les nouvelles tentatives depuis l’historique et l’enregistrement des modèles avec la page de reprises. Les brouillons existants restent utilisables.
Correction de l’export des pistes séparées
Évite que des pics audio élevés fassent échouer l’export des voix et d’autres pistes.
Chorus vérifie les pics de toutes les pistes avant d’exporter les voix masculines et féminines. Si une atténuation est nécessaire, le même gain constant est appliqué à chaque piste pour préserver les niveaux relatifs, la dynamique et la durée complète. Sinon, le niveau reste inchangé. Cette correction commune concerne aussi la suppression du public, du bruit et de l’écho, ainsi que la séparation de batterie DrumSep. Le fichier téléchargeable audio-export.json indique l’ajustement de gain réellement appliqué.
Historique des pauses et reprises
L’entraînement démarre après les tâches ordinaires, lorsque les ressources sont disponibles. Une nouvelle tâche le met en pause après sauvegarde ; il reprend dès que les ressources se libèrent, sans crédits supplémentaires.
Déplacez le pointeur, touchez le graphique ou faites glisser le curseur pour voir les valeurs. Les flèches, Début et Fin sont pris en charge. Reprendre la même tâche restaure le modèle, l’optimiseur et la position. Après une interruption imprévue, les étapes suivant la dernière sauvegarde confirmée peuvent être répétées. Importez ici un modèle RVC existant. Pour de simples enregistrements, utilisez l’entraînement vocal. Les modèles sont privés par défaut et accessibles aux autres uniquement après activation du partage public.
Fiches des modèles, résultats comparables et volume
Choisissez chaque modèle de séparation ou de transcription MIDI et consultez son état, ses paramètres et ses résultats publiés.
IDM, MSG-LD, ADTOF, ADT_STR et les autres modèles disposent de fiches distinctes ; le nom de la tâche indique le modèle choisi. Le graphique de chaque catégorie inclut tous les modèles et compare uniquement les scores obtenus dans les mêmes conditions. Les résultats absents sont signalés. OaFS indique les fenêtres de caractéristiques, lots d’inférence et étapes de décodage terminés. Le gain de lecture audio et MIDI atteint +6 dB, avec des commandes adaptées aux téléphones. Les nouvelles démos utilisent la même entrée complète pour les modèles comparables, et la démo de reprise par IA a été régénérée sans perte audio. ADTOF Direct accepte une batterie isolée ou un mix complet, dont la batterie est d’abord extraite. Les listes de voix se rétablissent après un échec temporaire d’actualisation.
OaFS et SFT-CRNN rejoignent la transcription
De nouveaux modèles MIDI pour les mixages complets et le piano.
OaFS reconnaît 34 classes d’instruments et exporte le MIDI et les tables de notes avec une vélocité fixe de 127.
SFT-CRNN détecte le début et la fin des notes de piano ; vélocité fixe de 100, sans prédiction de pédale.
Trois nouveaux modèles de batterie
IDM sépare les pistes ; ADT_STR et MSG-LD transcrivent les frappes.
IDM exporte neuf pistes de batterie sans MIDI.
ADT_STR détecte les attaques et vélocités de 26 classes de batterie et exporte le MIDI.
MSG-LD génère cinq pistes de batterie et détecte les attaques ; le MIDI utilise une vélocité de 100 et une durée de lecture fixe de 0,1 seconde.
Modèles de partition et de voix actualisés
Quatuors pour HookKern, mises à jour de Tsumugi et SwiftF0.
HookKern conserve le modèle mélodie et accords et ajoute les quatuors à cordes. Tsumugi ajoute les harmonies vocales v1.5/v1.6 et la batterie v1.5 ; la version v1.6 devient le choix par défaut pour les harmonies. SwiftF0 passe de 0.1.2 à 0.2.0.
Export MIDI et écoute des pistes améliorés
Préservez les notes courtes et écoutez de nouvelles pistes et démos réelles.
Les notes MIDI très courtes se terminent correctement. Les notes dont le timing est inchangé le conservent à l’export. Écoutez neuf pistes IDM ou cinq MSG-LD sur la page de résultats. Les démos OaFS, SFT-CRNN et IDM proviennent de tâches réelles.
Relancer et reprendre l’entraînement RVC
Le contrôle indique la durée exploitable et conserve la progression après interruption.
Le contrôle affiche la durée audio exploitable, la durée requise et le complément nécessaire. Les tâches échouées peuvent être relancées. La file et les points de contrôle sont conservés au redémarrage du service ; l’entraînement reprend lorsque les conditions le permettent.
Récupérer les segments finis si MuScriptor échoue
Décodage audio corrigé et téléchargement séparé du MIDI déjà traité.
Le décodage audio a été mis à jour. Si la transcription ne va pas jusqu’au bout, la page de la tâche propose les segments produits, clairement signalés comme incomplets. Le statut de remboursement de la tâche échouée est conservé.
Basic Pitch, HookKern et ZONOS2 disponibles
Le MIDI pour instrument seul, les partitions mélodie-accords et la synthèse vocale sont de retour.
Basic Pitch convertit un instrument seul en MIDI. HookKern produit des partitions mélodie-accords et ZONOS2 synthétise la voix à partir d’une référence. Les démonstrations utilisent désormais les résultats de tâches réelles de cette version.