Interpretable Audio Pattern Discovery in Keyword-Spotting Models via Waveform Optimization and Segment-Level Analysis
Questo articolo introduce GRADV, un workflow di analisi del segnale riproducibile che scopre e valuta i pattern audio della classe target nei modelli di keyword-spotting ottimizzando le forme d'onda e svolgendo un'analisi a livello di segmento, ottenendo elevati tassi di successo senza proporre nuove architetture di riconoscimento vocale.