Provenance Guided Incremental Learning Under Evolving Concept Definitions
Questo articolo introduce un framework di apprendimento incrementale guidato dalla provenienza che adatta efficientemente i modelli di apprendimento automatico a cambiamenti di concetto indotti da regole esplicite, rietichettando automaticamente i record interessati e riaddestrando selettivamente solo sulle componenti modificate, riducendo così significativamente la latenza computazionale e il riprocessamento dei dati pur mantenendo un'elevata accuratezza rispetto al riaddestramento completo.
Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo
Nel mondo dell'apprendimento automatico, i computer vengono spesso istruiti a fare previsioni studiando gli schemi nei dati. Immaginate un sistema addestrato per individuare transazioni bancarie fraudolente. Esso impara cosa costituisce una transazione normale e cosa una sospetta in base alle regole e alle definizioni stabilite dai suoi creatori. Tuttavia, il mondo reale non è statico. Le regole che definiscono ciò che conta come "frode" possono cambiare. Una banca potrebbe decidere che una transazione è sospetta solo se supera una certa cifra, o se proviene da un paese specifico, o se coinvolge un nuovo tipo di dispositivo. Quando queste definizioni cambiano, l'apprendimento precedente del computer diventa obsoleto. I dati che ha studiato ieri sono rimasti gli stessi, ma il significato della risposta è mutato. Questo crea un problema difficile: come si aggiorna un sistema di apprendimento quando la definizione stessa della verità è stata riscritta, senza dover buttare via tutto ciò che ha imparato e ricominciare da capo?
Per molto tempo, i ricercatori hanno affrontato questo problema osservando gli errori. Aspettano che il computer inizi a commettere errori, deducono che qualcosa sia cambiato e poi cercano di regolare il modello. Ma questo approccio è lento e spesso manca il bersaglio. Tratta il cambiamento come un mistero da risolvere tramite congetture, piuttosto che come un fatto noto su cui agire. In molti sistemi del mondo reale, il cambiamento non è affatto un mistero; è un aggiornamento deliberato di una politica o di una regola. La nuova definizione è nota immediatamente. La sfida consiste nel capire quali tra i milioni di record passati debbano essere effettivamente rivalutati a causa di questa nuova regola, e quali possano essere lasciati stare perché non influenzati.
Un nuovo studio introduce un metodo che tratta questo problema come un attento audit piuttosto che come un azzardo cieco. I ricercatori hanno sviluppato un sistema che osserva la vecchia regola e la nuova regola fianco a fianco per trovare la differenza esatta tra loro. Esso traccia poi come quella specifica differenza si connetta alla cronologia dei dati passati. Seguendo queste connessioni, il sistema può identificare un piccolo gruppo di record che sono realmente influenzati dal cambiamento. Può anche dimostrare che la stragrande maggioranza dei record è al sicuro e non deve essere toccata. Ciò consente al computer di aggiornare la sua conoscenza concentrandosi solo sulla piccola porzione rilevante di dati, mantenendo intatto il resto della sua comprensione.
I ricercatori hanno testato questo approccio su una vasta gamma di scenari del mondo reale, inclusi i processi finanziari, i dati demografici, i log di cybersicurezza e complessi network di relazioni. Hanno creato un insieme di sfide in cui le regole per etichettare i dati venivano cambiate in modi diversi: alzando o abbassando una soglia, aggiungendo una nuova condizione, rimuovendo una vecchia condizione o cambiando il modo in cui le diverse condizioni venivano combinate. In ogni caso, il nuovo metodo è stato in grado di identificare i record che necessitavano di attenzione con alta precisione. Invece di ricontrollare ogni singolo record nel database, il sistema ha rielaborato solo circa il 15 percento dei dati. Nonostante l'analisi di così pochi dati, ha mantenuto un'accuratezza del 92,3 percento, un risultato quasi identico a quello di ricontrollare l'intero database.
La velocità di questo processo è stato il risultato più sorprendente. Quando i ricercatori hanno costretto il sistema a ri-etichettare e ri-addestrare su tutta la cronologia dei dati, l'aggiornamento ha richiesto in media 993 secondi per completarsi. Con il nuovo metodo, lo stesso aggiornamento ha richiesto solo 179 secondi. Ciò rappresenta una riduzione dei tempi di oltre cinque volte. Il sistema ci è riuscito utilizzando una mappa di "provenance", che è essenzialmente un registro di come è stata presa ogni decisione passata. Se una decisione passata dipendeva da una parte della regola che non è cambiata, il sistema sa che quella decisione è ancora valida. Se una decisione dipendeva da una parte che è cambiata, il sistema la segnala per una revisione. Ciò permette al computer di certificare che la maggior parte della sua conoscenza passata è ancora corretta e di dedicare tempo solo alle parti che sono rotte.
Lo studio ha affrontato anche cosa accade quando la nuova regola non è perfettamente chiara. A volte, una politica rivista può dipendere da informazioni mancanti o che richiedono il giudizio umano. In questi casi, il sistema non va a tentativi. Invece, identifica i record specifici in cui la nuova regola è ambigua e chiede aiuto a un essere umano solo in quei casi. Ciò rende l'uso degli esperti umani molto più efficiente, poiché non perdono tempo su record che il computer può gestire autonomamente. Inoltre, il sistema conserva una memoria delle versioni precedenti delle regole. Se una regola cambia e poi torna a una versione precedente, il sistema può richiamare istantaneamente la vecchia configurazione e i dati ad essa associati, invece di dover imparare nuovamente il pattern da capo.
I ricercatori hanno scoperto che questo approccio funziona bene in diversi tipi di dati, dalle semplici liste di numeri ai complessi network di connessioni. Tuttavia, hanno anche evidenziato i suoi limiti. Il metodo è più efficace quando il cambiamento nella regola è localizzato, influenzando solo una piccola porzione dei dati. Se una nuova regola cambia il significato di quasi ogni record, il sistema deve ricontrollare quasi tutto, e il vantaggio di velocità svanisce. Allo stesso modo, se la cronologia di come sono state prese le decisioni non è stata registrata, il sistema non può facilmente capire quali record siano al sicuro e deve essere più cauto, controllando più dati di quanti ne controllerebbe altrimenti.
In definitiva, questo lavoro sposta la prospettiva su come i sistemi di apprendimento si adattano. Inveve di aspettare che compaiano gli errori e poi reagire, il sistema può usare la conoscenza esplicita di un cambiamento di regola per aggiornare la propria comprensione in modo chirurgico. Dimostra che comprendendo la struttura del cambiamento e come esso si connetta alla storia, un computer può preservare ciò che già conosce mentre corregge efficientemente ciò che è cambiato. Ciò permette ai sistemi di apprendimento di rimanere accurati e reattivi per lunghi periodi, adattandosi a nuove politiche senza l'oneroso costo di un costante e totale ri-addestramento.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.