Neue Funktionen, neue und ersetzte Modelle, Leistungsverbesserungen und Fehlerbehebungen nach Veröffentlichungsdatum.
Veröffentlicht
Korrekturen
Modellfamilien und vollständige MIDI-Demos
Wählen Sie zuerst die Modellfamilie, dann Version oder Verarbeitungsmodus. Die Demo folgt der Auswahl.
Verwandte Trennungs- und MIDI-Versionen erscheinen auf zwei Kartenebenen mit eigenem Status und Einstellungen. MuScriptor startet mit abschnittsweiser Reparatur, YourMT3+ mit YPTF.MoE+Multi noPS. Mehrinstrument-Demos verwenden das vollständige Lied だから僕は音楽を辞めた. MIDI-Vorschauen mit Sonderzeichen im Dateinamen werden korrekt geladen.
Laden Sie Aufnahmen hoch, prüfen Sie das Material und bestätigen Sie das Punkteangebot, um eine private Stimme für Cover zu trainieren oder ein kompatibles Modell weiterzutrainieren.
RVC-Modelltraining ist direkt unter Stimme und Gesang verfügbar. Die eigene Seite nutzt dieselbe Materialprüfung, Angebote, Fortschrittsanzeige, Wiederholung aus dem Verlauf und Modellspeicherung wie die Cover-Seite. Vorhandene Trainingsentwürfe bleiben nutzbar.
Hohe Pegelspitzen führen beim Export von Gesangs- und anderen Spuren nicht mehr zum Abbruch.
Chorus prüft vor dem Export der männlichen und weiblichen Stimmen die Spitzen aller Spuren. Falls eine Absenkung nötig ist, erhalten alle Spuren denselben konstanten Verstärkungsfaktor. Relative Pegel, Dynamik und volle Länge bleiben erhalten. Ohne nötige Absenkung bleibt der Pegel unverändert. Die gemeinsame Exportkorrektur gilt auch für Publikumsentfernung, Entrauschen, Echoentfernung und DrumSep. Die herunterladbare Datei audio-export.json dokumentiert die tatsächliche Pegelanpassung.
Das Training startet, sobald normale Aufgaben beendet und Ressourcen frei sind. Neue Aufgaben pausieren es nach dem Speichern; bei freien Ressourcen geht es weiter. Dafür fallen keine weiteren Credits an.
Zeiger bewegen, Diagramm berühren oder Regler ziehen, um Werte zu sehen. Der Regler unterstützt Pfeiltasten, Pos1 und Ende. Dieselbe Aufgabe stellt Modell, Optimierer und Trainingsposition wieder her. Nach unerwarteten Unterbrechungen können Schritte seit der letzten bestätigten Speicherung wiederholt werden. Laden Sie hier ein vorhandenes RVC-Modell hoch. Für Aufnahmen nutzen Sie das Stimmtraining. Modelle sind standardmäßig privat und erst nach aktiver Freigabe für andere auswählbar.
Modellkarten, vergleichbare Ergebnisse und Lautstärke
Trennungs- und MIDI-Modelle einzeln auswählen und Status, Parameter sowie veröffentlichte Ergebnisse ansehen.
IDM, MSG-LD, ADTOF, ADT_STR und weitere Modelle haben eigene Karten; der Aufgabenname nennt das gewählte Modell. Das Kategoriediagramm enthält alle Modelle und vergleicht Werte nur unter gleichen Testbedingungen. Fehlende Ergebnisse sind gekennzeichnet. OaFS meldet abgeschlossene Merkmalsfenster, Inferenz-Batches und Dekodierungsschritte. Die Wiedergabeverstärkung für Audiospuren und MIDI reicht bis +6 dB; die Bedienung auf Mobilgeräten wurde verbessert. Demos für vergleichbare Modelle verwenden dieselbe vollständige Eingabe; die KI-Cover-Demo wurde neu erzeugt. Audio bleibt verlustfrei. ADTOF Direct verarbeitet isolierte Drums oder einen vollständigen Mix, aus dem zunächst die Drums extrahiert werden. Leere Stimmenlisten erholen sich nun nach vorübergehenden Aktualisierungsfehlern.
Weitere MIDI-Modelle für komplette Mischungen und Klavieraufnahmen.
OaFS erkennt 34 Instrumentklassen und exportiert MIDI und Notentabellen mit fester Anschlagstärke 127.
SFT-CRNN erkennt Beginn und Ende von Klaviernoten; Anschlagstärke 100, keine Pedalvorhersage.
IDM trennt Spuren; ADT_STR und MSG-LD transkribieren Schläge.
IDM exportiert neun Schlagzeugspuren ohne MIDI.
ADT_STR erkennt Anschlagszeiten und Anschlagstärken für 26 Schlagzeugklassen und exportiert MIDI.
MSG-LD erzeugt fünf Schlagzeugspuren und erkennt Anschläge; MIDI verwendet Anschlagstärke 100 und feste Abspieldauer 0,1 Sekunden.
Quartette für HookKern sowie Updates für Tsumugi und SwiftF0.
HookKern behält sein Melodie-und-Akkord-Modell und ergänzt Streichquartette. Tsumugi ergänzt Gesangsharmonien v1.5/v1.6 und Schlagzeug v1.5; Harmonie v1.6 wird zum Standard. SwiftF0 wechselt von 0.1.2 auf 0.2.0.
Kurze Noten erhalten, neue Spuren anhören und echte Beispiele ansehen.
Sehr kurze MIDI-Noten enden jetzt korrekt. Unveränderte Notenzeiten bleiben beim Export erhalten. Die Ergebnisseite spielt neun IDM- oder fünf MSG-LD-Spuren ab. Die Demos von OaFS, SFT-CRNN und IDM stammen aus echten Aufgaben.
Die Materialprüfung zeigt die nutzbare Dauer; unterbrochenes Training behält seinen Fortschritt.
Die Prüfung nennt nutzbare Audiodauer, Mindestdauer und noch fehlende Zeit. Fehlgeschlagene Aufgaben lassen sich erneut starten. Warteschlange und Checkpoints bleiben bei Dienstneustarts erhalten; das Training läuft weiter, sobald die Ausführungsbedingungen erfüllt sind.
Korrigierte Audiodekodierung und separate Downloads bereits verarbeiteter MIDI-Daten.
Die Audiodekodierung wurde aktualisiert. Wird die gesamte Transkription nicht fertig, bietet die Aufgabenseite erzeugte Abschnitte an und kennzeichnet sie als unvollständig. Der Erstattungsstatus der fehlgeschlagenen Aufgabe bleibt erhalten.
MIDI aus Einzelinstrumenten, Melodie- und Akkordpartituren sowie Sprachsynthese sind wieder nutzbar.
Basic Pitch wandelt Einzelinstrument-Audio in MIDI um. HookKern erzeugt Melodie- und Akkordpartituren, ZONOS2 synthetisiert Sprache mit einer Referenzstimme. Die Demos zeigen nun echte Aufgabenergebnisse dieser Veröffentlichung.