Separacja dźwięku sterowana tekstem i nagraniem referencyjnym
Hive paper, main test tableWartości pochodzą z podlinkowanego publicznego źródła. Wiersze podają zbiór testowy lub checkpoint; modele bez porównywalnego wyniku pominięto.
Sprawdzono źródła publiczne: 2026-09-10
| Stopień | Warunek testu | Model | SI-SDR (dB) ↑ | Szczegółowe metryki |
|---|---|---|---|---|
| #1 | Zbiór testowy Hive | AudioSep-HiveTelkNetHive paper | 5.02Najlepszy | SDR (dB) ↑5.67NajlepszyLPAPS ↓3.86NajlepszyFAD ↓0.80NajlepszyCLAP-Audio ↑0.65NajlepszyCLAP-T ↑0.31NajlepszyMUSHRA ↑68.40NajlepszyOQ ↑3.34NajlepszyRec ↑4.81Pre ↑3.40NajlepszyFai ↑4.39 |
| #2 | Zbiór testowy Hive | AudioSep (original)Hive paper | 1.58 | SDR (dB) ↑2.37LPAPS ↓4.22FAD ↓0.90CLAP-Audio ↑0.57CLAP-T ↑0.26MUSHRA ↑60.90OQ ↑2.94Rec ↑4.86NajlepszyPre ↑2.96Fai ↑4.47Najlepszy |