Nazwy modeli, metryki, formaty plików i jednostki pozostają w oryginalnej postaci, a kontekst i ograniczenia są wyjaśnione po polsku.
Wyniki odnoszą się wyłącznie do wskazanych zbiorów danych, checkpointów i protokołów oceny. Wartości z nieporównywalnych ustawień nie są łączone w jeden ranking.
