← Nieuwste papers
💬 NLP

TokenScope: Token-Level Explainability and Interpretability for Code-Oriented Tasks in Large Language Models

TokenScope is een interactieve tool die is ontworpen om de verklaarbaarheid van code-georiënteerde Large Language Models te verbeteren door token-niveau metrieken, aandachtspatronen en structurele informatie te ontsluiten tijdens de generatie, waardoor systematische investigatie mogelijk wordt via functies zoals interactieve tokenvervanging en contrafactische vertakking.

Oorspronkelijke auteurs: Amirreza Esmaeili, Fatemeh Fard

Gepubliceerd 2026-07-03
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Amirreza Esmaeili, Fatemeh Fard

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een meesterkok (de AI) een complex gerecht (code) ziet bereiden in realtime. Meestal zie je alleen het eindgerecht. Als het gerecht niet lekker smaakt, heb je geen idee waarom de kok bij stap 4 te veel zout heeft toegevoegd of waarom ze bij stap 10 voor een specifieke specerij hebben gekozen. Je weet alleen dat het resultaat fout is.

TokenScope is als een magische bril waarmee je het volledige denkproces van de kok, stap voor stap, kunt volgen terwijl hij aan het koken is. Het laat je niet alleen het eindgerecht zien; het laat je ook de zekerheid van de kok zien, zijn aarzeling, en de andere ingrediënten die hij overwoog maar besloot niet te gebruiken.

Hier is een overzicht van wat het paper beweert dat TokenScope doet, met behulp van eenvoudige analogieën:

1. De "Röntgenvisie" op AI-gedachten

De meeste tools om AI te begrijpen zijn als het bekijken van een foto van het voltooide gerecht of het lezen van een receptenboek dat achteraf is geschreven. Ze vertellen je wat er is gebeurd, maar niet hoe de kok zich voelde tijdens het proces.

TokenScope is anders. Het werkt als een live feed van de hersenen van de kok. Terwijl de AI code schrijft, laat TokenScope je zien:

  • Zekerheid: Hoe zeker de kok is over het volgende woord (token). Als de kok aan het gokken is, markeert het systeem dit in het rood (lage zekerheid). Als hij zeker is, is het groen.
  • De "Wat als"-scenario's: Het laat je de top 5 ingrediënten zien waar de kok aan dacht, maar die hij niet heeft gekozen.
  • Aandacht (Attention): Het laat je zien naar welke vorige woorden de kok terugkijkt om de volgende te bepalen. Het is alsof je ziet hoe de ogen van de kok even snel naar een specif으로 ingrediënt op het aanrecht schieten om een regel te herinneren.

2. Het "Kies je eigen avontuur"-boek

Een van de coolste functies is Interactief Vertakken (Interactive Branching).
Stel je voor dat je een verhaal leest waarin de held een slechte keuze maakt. Met TokenScope kun je het verhaal precies daar stoppen en zeggen: "Wacht even, wat als de held het zwaard had gepakt in plaats van het schild?" en dan het verhaal vanaf dat nieuwe punt verder laten gaan.

In het paper betekent dit:

  • Je kunt een stuk code nemen dat de AI net heeft geschreven.
  • Je kunt een specifiek woord (token) vervangen door een ander woord.
  • Je kunt op "doorgaan" drukken, en de AI zal de rest van de code genereren op basis van jouw wijziging.
  • Dit helpt je te zien hoe één kleine fout (of een kleine correctie) de hele uitkomst verandert.

3. Chaos organiseren met "Lego-blokken"

Code is niet zomaar een willekeurige reeks letters; het heeft een structuur (zoals lussen, functies en instructies). TokenScope gebruikt een tool genaamd Tree-Sitter om als een slimme organisator te fungeren.

Het neemt de stroom van woorden die de AI uitspuugt en klikt deze vast in Lego-blokken (AST's of Abstract Syntax Trees).

  • Token-modus: Kijken naar individuele steentjes.
  • Expressie-modus: Kijken naar een klein cluster van steentjes (zoals een wiskundige vergelijking).
  • Statement-modus: Kijken naar een hele rij steentjes (zoals een volledige zin).
  • Block-modus: Kijken naar een hele muur (zoals een functie of een lus).

Dit stelt je in staat om te zien of de AI in de war is, specifiek binnen een "functie", of gewoon op een enkele "regel". Het helpt je precies te vinden waar de structurele integriteit van de code zwak is.

4. Het "Dashboard" van statistieken

Het paper beschrijft verschillende specifieke meters op dit dashboard:

  • Surprisal (Verrassing): Hoe geschokt de AI is door zijn eigen keuze. Als de AI een woord kiest dat hij niet verwachtte, gaat dit getal omhoog.
  • Entropy (Entropie): Hoe chaotisch de geest van de AI is. Hoge entropie betekent dat de AI verdeeld is tussen veel opties; lage entropie betekent dat de AI zeer besluitvaardig is.
  • Attention Mass (Aandachtsconcentratie): Hoeveel "mentale waarde" een specifiek woord draagt voor de rest van de code. Heeft het woord "return" de volgende 50 regels beïnvloed? TokenScope kan die verbinding laten zien.

Wat TokenScope NIET is (volgens het paper)

De auteurs zijn heel duidelijk over de beperkingen:

  • Het is geen magische oplossing: Het is een tool voor het bestuderen en debuggen, niet voor het draaien van een productie-website. Het is te traag voor realtime gebruik omdat het zoveel extra analyse uitvoert.
  • Het is niet voor elke AI: Het werkt alleen op modellen waarbij je de "interne tandwielen" kunt zien (token-waarschijnlijkheden en aandachtsgewichten). Je kunt het niet gebruiken op gesloten AI-systemen waarbij de interne werking verborgen is.
  • Het is momenteel vooral voor Python: De "Lego-blokken" organisator begrijpt momenteel alleen goed Python-code.

De Kernboodschap

TokenScope is een nieuwe microscoop voor software engineers en onderzoekers. In plaats van te gissen waarom een AI slechte code schreef, laat het je zien hoe de AI denkt, laat het je midden in de stroom van gedachten van gedachten veranderen, en helpt het je precies te zien welk deel van de codestructuur de verwarring veroorzaakt. Het verandert de "black box" van AI-generatie in een transparante, interactieve werkplaats.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →