← Nieuwste papers
📊 statistics

Rethinking Intrinsic Dimension Estimation in Neural Representations

Deze paper toont aan dat gangbare schatters voor intrinsieke dimensies in neurale representaties niet de ware onderliggende dimensie volgen, en biedt een nieuw perspectief door de discrepantie tussen theorie en praktijk te analyseren en de werkelijke drijfveren van gerapporteerde resultaten te onderzoeken.

Oorspronkelijke auteurs: Rickmer Schulte, David Rügamer

Gepubliceerd 2026-04-23
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Rickmer Schulte, David Rügamer

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorme, chaotische berg van data hebt. In de wereld van kunstmatige intelligentie (AI) zijn deze bergen vaak zo groot en complex dat ze lijken op een ondoordringbaar oerwoud. Wetenschappers proberen al jaren een manier te vinden om te begrijpen hoe die AI-modellen eigenlijk "denken".

Een populaire theorie is de "Manifold-hypothese". Dit is een mooie metafoor: hoewel de data eruitziet als een enorme 3D-ruimte (of zelfs duizenddimensionaal), ligt de echte informatie eigenlijk op een heel dun, glad vel papier dat door die ruimte is gevouwen. De Intrinsieke Dimensie (ID) is gewoon de maat voor hoe "dik" of "complex" dat vel papier is. Is het een plat vel (2D)? Of een gekreukeld doek (3D)?

Tot nu toe dachten onderzoekers dat ze dit vel papier konden meten met speciale meetinstrumenten (de ID-schatters). Ze zagen een interessant patroon: in de eerste lagen van een AI-netwerk leek het vel papier erg dun, maar naarmate je dieper in het netwerk ging, leek het vel steeds dikker en complexer te worden. Ze concludeerden: "Ah! De AI maakt de data steeds abstracter en complexer naarmate het dieper gaat!"

Maar dit papier zegt: "Wacht even, dat meetinstrument werkt niet zoals we denken."

Hier is wat de auteurs, Rickmer Schulte en David Rügamer, hebben ontdekt, vertaald naar alledaags taal:

1. De Meetlat is gebroken (De Bias)

Stel je voor dat je de lengte van een olifant wilt meten met een liniaal die alleen tot 10 centimeter gaat. Je zult denken dat de olifant klein is, maar dat is omdat je liniaal niet groot genoeg is.
De auteurs tonen aan dat de meetinstrumenten die we gebruiken voor AI (zoals TwoNN en MLE) in hoge dimensies (zoals in moderne AI) systematisch fouten maken. Ze onderschatten de echte complexiteit. Maar het ergste is: ze meten niet eens de verandering in complexiteit correct. Het is alsof je thermometer niet alleen de temperatuur verkeerd aangeeft, maar ook denkt dat het warmer wordt als het eigenlijk koud blijft.

2. De Wiskundige Waarheid: Je kunt niet dikker worden

De auteurs bewijzen iets heel fundamenteels met wiskunde:

  • AI-netwerken zijn gemaakt van lagen die data "vervormen" (zoals rekken of vouwen), maar ze kunnen data nooit vermenigvuldigen in complexiteit.
  • De Analogie: Stel je voor dat je een stuk deeg hebt. Je kunt het uitrollen, vouwen of kneden. Je kunt het dunner maken of in een andere vorm brengen, maar je kunt er geen nieuwe deegmassa uit toveren.
  • In wiskundige termen: als je data door een AI-laag gaat, kan de "echte" intrinsieke dimensie nooit toenemen. Hij kan alleen gelijk blijven of kleiner worden.
  • Het Paradoxa: De eerdere studies zagen dat de ID toenam in de diepere lagen. De auteurs zeggen: "Dat is onmogelijk volgens de wetten van de natuurkunde van AI." Als de metingen zeggen dat het dikker wordt, maar de theorie zegt dat het niet kan, dan is de meting fout.

3. Wat meten ze dan wel? (De echte oorzaak)

Als het niet de complexiteit van het "vel papier" is, wat zien die meetinstrumenten dan?
De auteurs ontdekten dat de meetinstrumenten eigenlijk reageren op hoe ver de punten van elkaar verwijderd zijn.

  • De Expansie: In de diepere lagen van een AI (vooral bij taalmodellen zoals LLM's) beginnen de representaties van verschillende woorden of beelden steeds verder van elkaar af te drijven in de ruimte. Ze "zwellen op".
  • De Meting: Omdat de meetinstrumenten kijken naar de afstand tussen buren, en die buren steeds verder uit elkaar drijven, denken de instrumenten: "Wow, er is hier veel ruimte, het moet dus een heel complex, dik vel zijn!"
  • De Realiteit: Het is niet complexer geworden; het is alleen uitgezet. Het is alsof je een ballon opblaast. De ballon wordt groter, maar de hoeveelheid rubber (de echte complexiteit) is hetzelfde. De meetlat denkt dat de ballon nu een nieuw, groter object is, terwijl het gewoon een opgeblazen versie van het oude is.

4. De Oplossing: Kijk naar de "Entropie"

In plaats van te kijken naar de "dikte" van het vel papier (wat de oude meetinstrumenten doen), suggereren de auteurs dat we moeten kijken naar Entropie.

  • De Analogie: Stel je voor dat je een pot met gekleurde balletjes hebt.
    • Als alle balletjes in één hoekje zitten, is de "orde" hoog en de entropie laag.
    • Als de balletjes over de hele pot verspreid zijn, is de entropie hoog.
  • De auteurs vinden dat de patronen die we eerder dachten te zien in de "Intrinsieke Dimensie" (eerst dun, dan dik) eigenlijk gewoon laten zien hoe de verdeling van de data verandert. In de vroege lagen spreiden de data zich uit over de ruimte (hoge entropie), en later worden ze weer wat meer geconcentreerd.

Conclusie voor de leek

Deze paper is een "wake-up call" voor de AI-wereld.

  • Het oude verhaal: "AI-netwerken worden steeds complexer en abstracter naarmate ze dieper gaan."
  • Het nieuwe verhaal: "Nee, de AI-netwerken worden niet per se complexer. De meetinstrumenten die we gebruiken zijn verward door het feit dat de data in de diepere lagen verder uit elkaar drijven (expanderen). We moeten stoppen met het interpreteren van deze metingen als 'complexiteit' en ze zien als een maatstaf voor hoe de data zich in de ruimte verspreidt."

Het is een beetje alsof we jarenlang dachten dat een auto sneller reed omdat de wielen sneller draaiden, maar we ontdekten dat de wielen gewoon groter werden. De snelheid (de echte complexiteit) is misschien wel hetzelfde gebleven, maar de schijn was bedrieglijk.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →