Longitudinal Component Level Analysis of Neural Network Training Dynamics Beyond Accuracy and Loss
Deze studie introduceert een niet-intrusief framework voor het analyseren van de dynamiek van neurale netwerkcomponenten op epoch-niveau, wat onthult dat modellen met een vergelijkbare nauwkeurigheid vaak uiteenlopende interne gedragingen vertonen en demonstreert dat descriptor-gestuurde pruning beter kan presteren dan willekeurige pruning, terwijl wordt bevestigd dat interne metrieken complementaire diagnostische waarde bieden zonder echter nog de magnitude-gebaseerde criteria te overtreffen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Om te begrijpen hoe een computer leert patronen te herkennen, kijken we meestal naar de eindscore. Wanneer een machine wordt geleerd om handgeschreven cijfers te identificeren of een medische conditie te diagnosticeren, meten we het succes aan de hand van hoe vaak het antwoord juist is. We houden ook een getal bij dat "loss" (verlies) wordt genoemd, dat ons vertelt hoe ver de gokken van de machine aflagen van de waarheid. Deze twee getallen zijn het standaard rapportcijfer voor kunstmatige intelligentie. Ze vertellen ons of het systeem werkt, maar ze vertellen ons niet hoe het werkt. Ze zijn als een eindcijfer voor een toets; ze onthullen het resultaat, maar verbergen het rommelige, verschuivende proces van hoe de geest van de student veranderde tijdens het studeren. Al een lange tijd vragen onderzoekers zich af of twee computers die dezelfde eindscore halen, ook daadwerkelijk op dezelfde manier hebben geleerd, of dat ze simpelweg dezelfde bestemming hebben bereikt door zeer verschillende paden te bewandelen.
Een nieuwe studie van het Afeka College of Engineering in Israël besluit in de machine te kijken terwijl deze nog aan het leren is, in plaats van alleen maar te wachten op het eindexamen. De onderzoekers bouwden een stille waarnemer die de interne onderdelen van de computer observeert terwijl ze in de loop van de tijd veranderen. Ze veranderden niets aan hoe de computer leerde of wat deze probeerde te bereiken; ze namen simpelweg de dagelijkse activiteit van de interne componenten op. Ze volgden hoe vaak individuele onderdelen afvuurden, hoe sterk de signalen waren en hoeveel de verbindingen tussen hen verschoven. Door deze kleine bewegingen over vele dagen van training te volgen, ontdekte het team dat computers met identieke eindscores totaal verschillende interne levens kunnen leiden. Twee machines kunnen beide 98 procent accuraat zijn, terwijl de ene leunt op een paar hardwerkende onderdelen en de andere veel onderdelen heeft die volledig zijn gestopt met werken, of onderdelen die zich in een staat van uitputting bevinden.
De studie richtte zich op twee verschillende taken: het herkennen van handgeschreven cijfers en het onderscheiden tussen goedaardige en kwaadaardige borstkankercellen. De onderzoekers voerden hetzelfde trainingsproces meerdere keren uit, waarbij ze kleine details veranderden zoals de begincondities of de snelheid waarmee de computer leerde. Ze ontdekten dat zelfs wanneer de uiteindelijke nauwkeurigheid stabiel bleef, het interne gedrag van het netwerk verrassend instabiel was. Bij de taak van het herkennen van cijfers was de variatie in hoeveel de verbindingen van de ene dag naar de volgende veranderden meer dan honderd keer groter dan de variatie in de uiteindelijke nauwkeurigheid. Dit betekent dat terwijl de prestaties van de computer robuust leken, de interne machinerie zichzelf voortdurend aan het herstructureren was. De onderzoekers merkten ook op dat de snelheid waarmee de computer leerde een groot verschil maakte. Wanneer de leersnelheid werd verhoogd, ontwikkelde de computer veel sneller een groot aantal inactieve onderdelen. Dit waren verbindingen die vroeg stopten met werken en zo bleven, een fenomeen dat niet gebeurde wanneer de computer langzamer leerde.
Het team testte ook of het observeren van deze interne bewegingen hen kon helpen de computer te verbeteren door onnodige onderdelen te verwijderen. Ze probeerden een methode waarbij ze de verbindingen wegknipten die het minst actief leken of het minst veranderden tijdens de training. Bij de taak van het herkennen van cijfers werkte deze methode beter dan het simpelweg willekeurig wegknippen van verbindingen. De computer behield zijn hoge nauwkeurigheid zelfs nadat een vijfde van zijn verbindingen was verwijderd. Deze methode was echter niet beter dan de standaard manier van het wegknippen van verbindingen, namelijk het verwijderen van de verbindingen met de kleinste getallen eraan vastgeplakt. De onderzoekers kwamen tot de conclusie dat hun nieuwe methode geen wondermiddel was die altijd beter zou werken dan de oude manieren. Sterker nog, op de medische dataset was de nieuwe methode slechts iets beter dan een willekeurige kans, en de resultaten waren niet consistent over verschillende runs.
Wat deze studie echt laat zien, is dat de geschiedenis van hoe een computer leert even belangrijk is als het eindresultaat. De onderzoekers ontdekten dat onderdelen van de computer een tijdje inactief konden zijn, om vervolgens weer wakker te worden en te gaan werken, of dat ze permanent vast konden komen te zitten. Deze patronen van activiteit en inactiviteit verschilden afhankelijk van het type probleem dat de computer oploste en de specifien gebruikte instellingen. De studie suggereert dat we niet alleen naar de eindscore moeten kijken om een machine te begrijpen. In plaats daarvan moeten we kijken naar het verhaal van hoe het daar gekomen is. Hoewel de nieuwe methode van observeren en snoeien de standaardtools voor het kleiner maken van computers niet verving, bewees het dat er een rijke, verborgen laag van activiteit plaatsvindt binnen deze systemen. Deze laag bevat aanwijzingen over welke onderdelen werkelijk belangrijk zijn en welke slechts ruis zijn, aanwijzingen die volledig onzichtbaar zijn als je alleen naar het eindcijfer kijkt. Het werk beweert het mysterie van kunstmatige intelligentie niet opgelost te hebben, maar het heeft een venster geopend om het proces te zien op een manier die voorheen onmogelijk was, waarmee wordt getoond dat de reis van het leren vaak complexer en gevarieerder is dan de bestemming doet vermoeden.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.