Same question, different history: language, national identity, and credit in large language models
Deze studie toont aan dat grote taalmodellen functioneren als gedistribueerde systemen van cultureel geheugen waarbij de taal van de query systematisch fungeert als een schakelaar om verschillende nationale narratieven te activeren, waardoor minder dominante historische pretendenten vaker naar voren komen wanneer vragen in hun bijbehorende talen worden gesteld, terwijl dominante Engelstalige figuren stabiel blijven over alle talen heen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een magische, superintelligente bibliothecaris hebt die bijna elk boek, artikel en website ooit geschreven heeft gelezen. Je stelt de bibliothecaris een simpele vraag: "Wie heeft de radio uitgevonden?"
Als je in het Engels vraagt, zegt de bibliothecaris: "Guglielmo Marconi."
Als je in het Russisch vraagt, zegt de bibliothecaris: "Alexander Popov."
Als je in het Chinees vraagt, zegt de bibliothecaris: "Bi Sheng" (voor drukwerk).
Je zou kunnen denken dat de bibliothecaris in de war is of liegt. Maar volgens dit artikel is de bibliothecaris niet in de war. De bibliothecaris gedraagt zich eigenlijk als een kameleon. Het antwoord verandert niet omdat de bibliothecaris van mening verandert, maar omdat de taal die je gebruikt om de vraag te stellen werkt als een schakelaar die een specifieke "nationale herinnering" binnen de machine inschakelt.
Hier is een uitsplitsing van wat de onderzoekers hebben ontdekt, met behulp van eenvoudige analogieën:
1. Het "Kameleoneffect"
De onderzoekers testten 11 verschillende AI-chatbots (zoals de systemen achter ChatGPT) met 21 verschillende historische geschillen (zoals "Wie heeft de telefoon uitgevonden?"). Ze stelden dezelfde vragen in 12 verschillende talen.
Ze ontdekten dat de AI niet alleen feiten ophaalt; het haalt verhalen op.
- De Schakelaar: Wanneer je een vraag stelt in een specifieke taal (zoals het Russisch), haalt de AI de "Russische versie" van de geschiedenis op die in de trainingsdata is opgeslagen. In die versie is Popov de held.
- Het Resultaat: Als je in het Russisch vraagt, verschijnt Popov in 85% van de gevallen in het antwoord. Als je in een andere taal vraagt, verschijnt hij slechts in ongeveer 48% van de gevallen.
- De Uitzondering: Voor zeer beroemde, machtige figuren (zoals Alexander Graham Bell of de gebroeders Wright) geeft de AI hetzelfde antwoord, ongeacht de taal die je spreekt. Zij zijn de "wereldberoemdheden" van de geschiedenis die overal voorkomen. Maar voor de "lokale helden" van andere naties laat de AI hen alleen zien als je hun taal spreekt.
2. Het "Banaliteit" van Nationalisme
De auteurs noemen dit "Banal Nationalisme".
Denk aan een vlag die aan een gebouw hangt. Je merkt hem niet elke dag op; hij is gewoon onderdeel van de achtergrond. Maar hij herinnert je er constant aan: "Dit is ons land."
De AI doet hetzelfde, maar dan onzichtbaar. De AI zwaait niet met een vlag of zingt een volkslied. De AI beantwoordt simpelweg je vraag. Maar door in het Russisch te antwoorden en een Russische held te noemen, versterkt het subtiel het idee dat "Dit is het Russische verhaal." Het is een subtiele, alledaagse manier om te zeggen: "Wij herinneren ons onze eigen mensen."
3. De "Gum" versus de "Marker"
De onderzoekers keken naar hoe vaak de AI de andere kant van het verhaal volledig negeerde (wat "erasure" of uitwissing wordt genoemd).
- De Gum: Soms zal de AI zeggen: "Bell heeft de telefoon uitgevonden," en niets zeggen over de Italiaanse uitvinder, Meucci. Dit gebeurt vaker wanneer er een machtige Engelstalige aanspraakmaker is (zoals Bell) en een zwakkere rivaal.
- De Marker: Echter, als je de AI vraagt naar beide personen ("Wie heeft de telefoon uitgevonden, Bell of Meucci?"), is de AI veel minder geneigd om de tweede persoon te wissen. Het simpelweg noemen van de naam in de vraag werkt als een vangnet dat de AI dwingt te erkennen dat die persoon bestaat.
4. De "Monumentale" Connectie
De studie vond een sterke link tussen de mate waarin een land een uitvinder "viert" (met standbeelden, feestdagen of lessen op school) en hoe vaak de AI die persoon noemt.
- De Analogie: Stel je een dorpsplein voor. Als een land een groot standbeeld van een uitvinder bouwt, is die uitvinder "luid" in de trainingsdata van de AI. Wanneer je in de taal van dat land vraagt, hoort de AI die luide stem duidelijk.
- De Verrassing: Zelfs voor uitvinders met geen standbeelden of feestdagen, noemt de AI hen nog steeds vaker als je in hun moedertaal vraagt. Dit suggereert dat de AI de algemene "ruis" van die taal oppikt — nieuws, verhalen en dagelijkse gesprekken — en niet alleen officiële monumenten.
5. De "Universele" Illusie
Het artikel betoogt dat we deze AI-tools vaak zien als neutrale, universele bibliotheken. We denken: "Als ik dezelfde vraag stel, zou ik dezelfde waarheid moeten krijgen."
De studie laat zien dat dit niet waar is. De AI is meer een reisgids die verschillende dialecten spreekt.
- Als je Engels spreekt, laat de gids je de "Globale/Engelse" versie van de geschiedenis zien.
- Als je Portugees spreedt, laat de gids je de "Braziliaanse/Portugese" versie van de geschiedenis zien.
Het gevaar is niet dat de AI liegt; het is dat de AI deze verschillende versies presenteert alsof het de enige versie is. Als je in het Engels vraagt, weet je misschien nooit dat een ander land een totaal ander verhaal heeft over wie het vliegtuig heeft uitgevonden, omdat de AI dat niet heeft vermeld.
Samenvatting
Het paper concludeert dat deze AI-modellen niet alleen "feitmachines" zijn. Het zijn herinneringsmachines die subtiel bepalen hoe wij de geschiedenis herinneren. Ze fungeren als een digitale spiegel: als je in je eigen taal naar hen kijkt, zie je je eigen nationale helden. Als je in een andere taal kijkt, zie je misschien een andere set helden, of zie je misschien helemaal niets over je lokale geschiedenis.
De taal die je gebruikt om de vraag te stellen, verandert niet alleen de woorden in het antwoord; het verandert welke versie van het verleden de AI besluit aan jou te tonen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.