Rodziny modeli i pełne demonstracje MIDI
Wybierz rodzinę modelu, a następnie wersję lub tryb przetwarzania. Demonstracja odpowiada wybranemu wariantowi.
Powiązane wersje separacji i MIDI są ułożone na dwóch poziomach kart, z osobnymi stanami i ustawieniami. MuScriptor domyślnie stosuje naprawę segmentową, a YourMT3+ — YPTF.MoE+Multi noPS. Demonstracje wieloinstrumentowe używają całego utworu だから僕は音楽を辞めた. Poprawiono wczytywanie podglądu MIDI z nazwami zawierającymi znaki specjalne.
Trenowanie modeli RVC
Prześlij nagrania, sprawdź materiał i zatwierdź wycenę w punktach, aby wytrenować prywatny głos do coverów lub kontynuować trening zgodnego modelu.
Trenowanie RVC jest dostępne bezpośrednio w kategorii Głos i śpiew. Osobna strona współdzieli sprawdzanie materiału, wyceny, postęp, ponawianie z historii i zapisywanie modeli ze stroną coverów. Istniejące wersje robocze treningu nadal działają.
Poprawka eksportu rozdzielonych ścieżek
Zapobiega błędom eksportu wokali i innych ścieżek przy wysokich szczytach sygnału.
Chorus sprawdza szczyty całego zestawu ścieżek przed eksportem głosów męskich i żeńskich. Gdy potrzebne jest ściszenie, wszystkie ścieżki otrzymują ten sam stały współczynnik wzmocnienia, zachowując względne poziomy, dynamikę i pełną długość. Pozostałe wyniki zachowują oryginalną głośność. Poprawka obejmuje też usuwanie odgłosów publiczności, szumu i echa oraz separację perkusji DrumSep. Plik audio-export.json do pobrania zapisuje faktyczną zmianę wzmocnienia.
Historia wstrzymań i wznowień
Trening zaczyna się po zakończeniu zwykłych zadań, gdy zasoby są wolne. Nowe zadania wstrzymują go po zapisie; jest wznawiany po zwolnieniu zasobów bez dodatkowych kredytów.
Przesuń wskaźnik, dotknij wykresu lub przeciągnij suwak, aby sprawdzić wartości. Suwak obsługuje strzałki, Home i End. Wznowienie tego samego zadania odtwarza model, optymalizator i pozycję treningu. Po nagłej przerwie kroki od ostatniego potwierdzonego zapisu mogą się powtórzyć. Tutaj prześlij gotowy model RVC. Jeśli masz tylko nagrania, użyj treningu głosu. Domyślnie model jest prywatny; inni mogą go wybrać dopiero po włączeniu udostępniania publicznego.
Karty modeli, porównywalne wyniki i głośność
Wybieraj oddzielnie modele separacji i MIDI oraz sprawdzaj ich stan, parametry i opublikowane wyniki.
IDM, MSG-LD, ADTOF, ADT_STR i inne modele mają osobne karty, a nazwa zadania wskazuje wybrany model. Wykres kategorii zawiera wszystkie modele i porównuje tylko wyniki uzyskane w tych samych warunkach. Brak wyników jest wyraźnie oznaczony. OaFS raportuje ukończone okna cech, partie inferencji i operacje dekodowania. Wzmocnienie odtwarzania ścieżek audio i MIDI sięga +6 dB, a obsługa na telefonach została poprawiona. Dodano demonstracje z tym samym pełnym materiałem wejściowym dla porównywalnych modeli i ponownie wygenerowano demonstrację coveru AI, zachowując bezstratny dźwięk. ADTOF Direct przyjmuje samą perkusję lub pełny miks, z którego najpierw wydziela perkusję. Naprawiono listy głosów pozostające puste po chwilowym błędzie odświeżania.
Nowe transkrypcje OaFS i SFT-CRNN
Więcej modeli MIDI dla pełnych miksów i nagrań fortepianu.
OaFS rozpoznaje 34 klasy instrumentów i eksportuje MIDI oraz tabele nut ze stałą siłą uderzenia 127.
SFT-CRNN wykrywa początek i koniec nut fortepianu; stała siła uderzenia 100, bez przewidywania pedału.
Trzy nowe modele perkusyjne
IDM rozdziela ścieżki, a ADT_STR i MSG-LD zapisują uderzenia.
IDM eksportuje dziewięć ścieżek perkusji bez MIDI.
ADT_STR wykrywa początki i siłę uderzeń dla 26 klas perkusji oraz eksportuje MIDI.
MSG-LD generuje pięć ścieżek perkusji i wykrywa początki uderzeń; MIDI ma stałą siłę 100 i czas odtwarzania 0,1 sekundy.
Aktualizacje modeli nut i wokalu
Kwartety w HookKern oraz nowe Tsumugi i SwiftF0.
HookKern zachowuje model melodii i akordów oraz dodaje kwartety smyczkowe. Tsumugi dodaje harmonie wokalne v1.5/v1.6 i perkusję v1.5; domyślna harmonia to teraz v1.6. SwiftF0 przechodzi z 0.1.2 na 0.2.0.
Lepszy eksport MIDI i odsłuch perkusji
Zachowaj krótkie nuty, słuchaj nowych ścieżek i sprawdzaj rzeczywiste przykłady.
Bardzo krótkie nuty MIDI kończą się prawidłowo. Nuty bez zmian czasowych zachowują oryginalny czas przy eksporcie. Strona wyników odtwarza dziewięć ścieżek IDM lub pięć MSG-LD. Dema OaFS, SFT-CRNN i IDM pochodzą z rzeczywistych zadań.
Ponawianie i wznawianie treningu RVC
Kontrola materiału pokazuje użyteczny czas i zachowuje postęp przerwanego treningu.
Kontrola podaje użyteczny czas audio, wymagany czas i brakującą długość. Nieudane zadania można ponowić. Kolejka i punkty kontrolne pozostają po restarcie usługi; trening wraca po spełnieniu warunków uruchomienia.
Odzyskaj gotowe fragmenty po błędzie MuScriptor
Poprawione dekodowanie audio i osobne pobieranie przetworzonego MIDI.
Zaktualizowano dekodowanie audio. Jeśli cała transkrypcja się nie zakończy, strona zadania udostępnia wygenerowane fragmenty z wyraźnym oznaczeniem niekompletnego wyniku. Status zwrotu za nieudane zadanie pozostaje bez zmian.
Basic Pitch, HookKern i ZONOS2 są dostępne
Powraca MIDI z jednego instrumentu, zapis melodii i akordów oraz synteza głosu.
Basic Pitch zamienia audio jednego instrumentu na MIDI. HookKern tworzy zapis melodii i akordów, a ZONOS2 syntetyzuje mowę z głosu referencyjnego. Demonstracje korzystają z wyników rzeczywistych zadań tej wersji.