← Nieuwste papers
💻 computer science

Sparse but not Simpler: A Multi-Level Interpretability Analysis of Vision Transformers

Dit onderzoek toont aan dat structurele sparsiteit in Vision Transformers, hoewel het leidt tot circuits met minder verbindingen, niet automatisch resulteert in beter semantisch interpreteerbare modellen, omdat de berekening wordt herverdeeld in plaats van te worden vereenvoudigd.

Oorspronkelijke auteurs: Siyu Zhang

Gepubliceerd 2026-03-18
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Siyu Zhang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Samenvatting: "Minder is niet altijd duidelijker"

Stel je voor dat je een enorm, ingewikkeld stadsverkeerssysteem hebt. Het heeft duizenden wegen, verkeerslichten en afritten. De vraag is: als we een groot deel van die wegen dichtdoen (zodat er minder verkeer is), wordt het systeem dan makkelijker te begrijpen?

Dat is precies wat deze onderzoekers hebben onderzocht, maar dan met kunstmatige intelligentie (AI) in plaats van verkeer. Ze keken naar een specifiek type AI dat foto's herkent (zoals een Vision Transformer) en probeerden het "dicht te maken" door een groot deel van de verbindingen in het brein van de AI weg te halen. Dit noemen ze sparsiteit (of "verspreidheid").

De algemene gedachte was: "Als we minder verbindingen hebben, moet het brein van de AI simpeler werken en dus makkelijker uit te leggen zijn."

Maar het onderzoek komt met een verrassend antwoord: Nee, niet echt.

Hier is hoe het werkt, vertaald naar alledaagse taal:

1. De Proef: Het "Knippen" van de AI

De onderzoekers namen een slimme AI die foto's van dieren en voorwerpen herkent (zoals een hond of een telescoop). Vervolgens gebruikten ze een techniek (genaamd Wanda) om ongeveer 70% van de verbindingen in het brein van de AI weg te knippen.

  • Het doel: Kijken of de overgebleven AI minder "rommelig" werkt en of we makkelijker kunnen zien waarom hij een bepaalde beslissing neemt.

2. De Meting: De "IMPACT"-Schaal

Om te zien of de AI echt begrijpelijker werd, gebruikten ze een meetlat genaamd IMPACT. Ze keken op vier niveaus:

  • Het Neuron-niveau: Kijken naar individuele "hersencellen". Is elke cel zich nu specialiseren in één ding (bijv. alleen oren zien), of doen ze nog steeds van alles tegelijk?
  • Het Laag-niveau: Kijken naar de tussenstappen. Is de informatie die de AI verwerkt nu duidelijker?
  • Het Circuit-niveau: Kijken naar het "stroomnetwerk". Hoeveel wegen zijn er nodig om een beslissing te nemen?
  • Het Model-niveau: Kijken naar de uiteindelijke uitleg. Als de AI zegt "dit is een hond", kunnen we dan precies zien op welke delen van de foto (de oren, de staart) hij zich baseerde?

3. De Resultaten: De "Verspreiding"-Valstrik

Hier komen de interessante ontdekkingen, met een paar analogieën:

A. Minder wegen, maar meer auto's
Op het eerste gezicht zag het er goed uit. De "verspreide" AI had inderdaad 2,5 keer minder wegen (verbindingen) nodig om een beslissing te nemen dan de volle AI.

  • Analogie: Het is alsof je een groot stadje hebt waar 100 wegen naar het centrum leiden. Je sluit 70 wegen af. Je denkt: "Nu is het veel rustiger en duidelijker!"
  • De realiteit: De auto's die overbleven, moesten nu allemaal over de resterende 30 wegen rijden. Ze verspreidden zich over meer van die overgebleven wegen. In plaats van dat één specifieke weg heel belangrijk werd, gebruikten ze nu allemaal een beetje van alles. Het circuit werd kleiner, maar niet simpeler.

B. De "Alles-kunners" blijven bestaan
In de dichte AI (voor het knippen) waren veel neuronen "polysemantisch". Dat betekent dat één cel een beetje naar een hond keek, een beetje naar een kat, en een beetje naar een auto.

  • De hoop: Door te knippen zouden deze cellen zich misschien specialiseren (één cel alleen voor honden, één voor katten).
  • De werkelijkheid: Nee. De cellen bleven net zo "dwaas" en deden nog steeds van alles tegelijk. Het wegknippen van verbindingen maakte ze niet specialer.

C. De Uitleg werd niet helderder
De onderzoekers keken ook naar de "warmtekaarten" (visuele uitleggen) die laten zien waar de AI naar kijkt.

  • De hoop: Met minder verbindingen zou de AI scherper kunnen wijzen: "Kijk hier, dit is de hond."
  • De werkelijkheid: De kaarten werden niet veel duidelijker. Soms zelfs iets waziger. De AI wist nog steeds niet precies welke delen van de foto het belangrijkst waren, zelfs niet nadat ze de helft van hun brein hadden verloren.

4. De Conclusie: "Verspreid, maar niet Simpel"

De titel van het paper, "Sparse but not Simpler" (Verspreid maar niet Simpel), vat het perfect samen.

Het idee dat je een AI kunt "ontwarren" door gewoon een deel van zijn gewichten weg te halen, werkt niet zo makkelijk.

  • Wat wel gebeurde: De AI werd compacter (mijn geheugengebruik daalde).
  • Wat niet gebeurde: De AI werd niet transparanter. Het bleef net zo moeilijk te begrijpen waarom hij bepaalde dingen deed.

De les voor de toekomst:
Als we willen dat AI-systemen eerlijker en begrijpelijker zijn, kunnen we niet zomaar een "verklein-knop" indrukken. We moeten waarschijnlijk de AI vanaf het begin anders trainen of een andere architectuur kiezen die van nature duidelijker is. Gewoon "wegknippen" maakt het brein niet noodzakelijkerwijs helderder; het maakt het alleen maar kleiner.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →