Fine-grained Motion Retrieval via Joint-Angle Motion Images and Token-Patch Late Interaction
Il paper propone un metodo interpretabile per il recupero fine-granularità di movimenti 3D tramite immagini di angoli articolari e un'interazione tardiva token-patch, superando i limiti dei metodi basati su embedding globali e ottenendo risultati superiori su HumanML3D e KIT-ML.