CANONIC: Governance Is Compilation
Het artikel introduceert CANONIC, een governance-framework dat principes uit de compilerleer toepast om een controleerbaar bewijsregister voor door AI gegenereerde inhoud te creëren, waarbij wordt betoogd dat hoewel structurele toelating "slop" niet algoritmisch kan wegfilteren, het wel waarborgt dat elke bewering verankerd is aan verifieerbare definities en commits voor end-to-end reproduceerbaarheid.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Het Grote Probleem: De "Slop"-vloedgolf
Stel je een fabriek voor die boeken sneller kan drukken dan dat iemand ze kan lezen. In 2025 begon deze fabriek (AI) zoveel tekst uit te spugen dat er een nieuw probleem ontstond: "Slop" (slappe troep).
"Slop" is niet alleen slecht geschreven; het is tekst die perfect oogt, intelligent klinkt en mooi doorstroomt, maar geen enkele connectie heeft met de werkelijkheid. Het is als een chef die in enkele seconden een heerlijk uitziende maaltijd kan bereiden, maar de ingrediënten zijn gemaakt van plastic. Als je het eet, word je ziek, maar je kunt aan het bord niet zien dat het nep is.
Het paper betoogt dat we dit niet kunnen oplossen door meer mensen in te huren om de boeken te lezen (menselijke controle) of door betere leugendetectoren te bouwen (AI-detectie). Waarom niet? Omdat de neppe boeken precies lijken op de echte boeken. De fabriek is te snel, en de "neppe" boeken zijn te overtuigend.
De Oplossing: De "Compiler" Poort
De auteur, Dexter Hadley, stelt een radicale verschuiving voor. In plaats van te proberen te beoordelen of een boek waar is (wat moeilijk is), moeten we beoordelen of het boek structureel geldig is (wat makkelijk is).
Hij noemt dit Governance as Compilation (Bestuur als Compilatie).
Denk aan een computerprogramma. Voordat een programma draait, controleert een "compiler" het. De compiler vraagt niet: "Zal dit programma de problemen van de wereld oplossen?" of "Is deze code briljant?". De compiler stelt drie eenvoudige, mechanische vragen:
- Heb je een woord gebruikt dat in het woordenboek staat?
- Verwijs je naar een bestand dat daadwerkelijk op de computer bestaat?
- Staat dat bestand in de map die je hebt opgegeven?
Als het antwoord op een van deze vragen "Nee" is, zegt de compiler "Error" en stopt het programma met draaien. Het maakt niet uit of de code briljant is; als de structuur gebrekkig is, wordt het afgewezen.
CANONIC past dezezelfde logica toe op AI-teksten. Het fungeert als een "compiler" voor tekst. Voordat er AI-gegenereerde inhoud in een openbare bibliotheek (de "corpus") mag worden opgenomen, moet het door drie poorten gaan.
De Drie Poorten (De "Triad")
Voor een stuk tekst om de CANONIC-poort te passeren, moet het gebouwd zijn als een specifiek type map die drie specifieke bestanden bevat. Als een van deze bestanden ontbreekt, wordt de tekst direct afgewezen.
- Het Regelboek (CANON.md): Dit bestand zegt: "Dit zijn de regels voor dit specifieke onderwerp." Het is de wet.
- Het Woordenboek (VOCAB.md): Dit bestand definieert elk woord dat in het Regelboek wordt gebruikt. Je kunt geen chic woord gebruiken tenzij je het hier hebt gedefinieerd. Dit voorkomt dat de AI jargon verzint.
- De Beschrijving (README.md): Dit bestand legt uit waar het project daadwerkelijk over gaat.
De Analogie: Stel je voor dat je een huis bouwt.
- Het Woordenboek is de lijst met goedgekeurde materialen (bijv. "Baksteen" betekent rode kleistenen baksteen, niet rode plastic baksteen).
- Het Regelboek zegt: "Elke muur moet van Baksteen zijn."
- De Beschrijving zegt: "Dit is een huis."
Als je probeert een muur van "Rode Plastic" te bouwen zonder "Rode Plastic" in je woordenboek te definiëren, stopt de inspecteur (de compiler) je. Je kunt niet gewoon zeggen: "Vertrouw me maar, het is een muur."
De "Evidence Ledger" (Bewijsregister)
Het paper introduceert een tweede laag: De Ledger.
Elke bewering in de tekst moet gekoppeld zijn aan een specifieke "commit" (een opgeslagen versie van een bestand) in een publiek, onveranderlijk record (zoals een Git-repository).
- De Bewering: "De patiënt is verbeterd."
- De Verankering: "Zie commit #12345 in de Ledger."
Als de schrijver niet kan wijzen naar de specifieke commit die de bewering bewijst, wordt de tekst afgewezen. Het is als een rechtszaak waarbij je niet simpelweg kunt zeggen: "Ik zag het gebeuren." Je moet de videobeelden kunnen produceren. Als je de beelden niet hebt, komt de bewering niet in het record terecht.
Wat CANONIC wel doet (En wat het niet doet)
Dit is het belangrijkste deel van het paper. De auteur is zeer eerlijk over de beperkingen.
Wat het WEL doet:
Het garandeert Verantwoordelijkheid (Accountability).
Als een stuk tekst de poort passeert, weet je met zekerheid dat:
- Elk woord is gedefinieerd.
- Elke bewering verwijst naar een specifiek, onveranderlijk stuk bewijs.
- De regels zijn gevolgd.
Het verandert "onverifieerbare proza" in een "controleerbaar record". Zelfs als de tekst onjuist is, is deze nu traceerbaar. Je kunt het bewijs bekijken, zien waar het misging, en het corrigeren.
Wat het NIET doet:
Het garandeert niet de WAARHEID.
Het paper heeft een test (een benchmark) uitgevoerd om te zien of dit systeem "Slop" kon filteren. De resultaten waren verrassend: het kon dat niet.
- De Test: Ze voerden het systeem nepnieuws, echt nieuws en slimme AI-gegenereerde leugens.
- Het Resultaat: De "Compiler"-poort liet het nepnieuws door als het nepnieuws goed gestructureerd was (gedefinieerde woorden, nep-bewijs dat er echt uitzag, en een duidelijke tijdlijn).
- De Les: Een machine kan controleren of een zin grammaticaal geldig en verwijzend is, maar kan niet controleren of de zin waar is.
De Analogie:
Stel je een bewaker bij een bank voor.
- CANONIC is de bewaker die je ID controleert. Als je ID vervalst is maar er perfect uitziet, een foto heeft en voldoet aan het databaseformaat, laat de bewaker je binnen. De bewaker zorgt ervoor dat je een geldig ID hebt, niet dat je een goed mens bent.
- Waarheid wordt bepaald door de bankdirecteur (de menselijke expert). De directeur kijkt naar het ID, ziet de persoon, en besluit: "Wacht even, deze persoon liegt over zijn banksaldo."
Het paper betoogt dat we hebben geprobeerd om het algoritme (de bewaker) te laten beslissen wie er liegt. Het paper zegt: Stop daarmee. De taak van de bewaker is slechts om het ID te controleren. De taak van de directeur is om te beslissen of het verhaal waar is.
De "Human-in-the-Loop"
Het systeem is ontworpen zodat Mensen de Regels schrijven en AI de Inhoud schrijft.
- Mensen stellen de "Grondwet" vast (de regels in het CANON.md bestand).
- AI genereert de tekst.
- De "Compiler" controleert of de AI de regels heeft gevolgd.
- Als de AI probeert de regels te veranderen, wordt deze geblokkeerd. Alleen mensen kunnen de Grondwet wijzigen.
Dit creëert een systeem waarin AI snel en creatief kan zijn, maar niet de wet kan breken of haar sporen kan wissen.
Samenvatting
Het paper concludeert dat we geen algoritme kunnen bouwen dat automatisch "Slop" (nep of ongegrond AI-tekst) herkent, omdat "Slop" zo gemaakt kan worden dat het structureel perfect lijkt.
In plaats daarvan moeten we een systeem bouwen dat Verantwoordelijkheid afdwingt.
- De Oude Manier: "Vertrouw me, deze AI schreef een waarheidsgetrouw artikel." (Moeilijk te verifiëren).
- De Nieuwe Manier (CANONIC): "Hier is het artikel. Hier is het woordenboek van de gebruikte woorden. Hier is het exacte bestand waar het bewijs leeft. Hier is het regelboek dat het volgde. Je kunt het allemaal zelf controleren."
Het systeem stopt de leugens niet; het zorgt er alleen voor dat als er een leugen wordt verteld, deze een duidelijk, onveranderlijk spoor van bewijs achterlaat, zodat menselijke experts deze kunnen vinden en kunnen aanwijzen. Het verandelt de "black box" van AI in een "glass box" waar alles zichtbaar en controleerbaar is.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.