VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models
arXiv - 2026
Προεπιλεγμένη διαδρομή για δομημένο φωνητικό MIDI που μοιάζει με παρτιτούρα από καθαρότερο τραγούδι· το σταθερό checkpoint δεν έχει επίσημες ρυθμιζόμενες παραμέτρους inference.