← Nieuwste papers
💬 NLP

Emergence of a phonological bias in ChatGPT

Dit artikel toont aan dat ChatGPT, net als mensen, een fonologische bias vertoont door voorkeur te geven aan medeklinkers boven klinkers bij het identificeren van woorden, een eigenschap die ook in talen met verschillende klankverdelingen zoals Engels en Spaans voorkomt.

Oorspronkelijke auteurs: Juan Manuel Toro

Gepubliceerd 2026-02-26
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Juan Manuel Toro

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

ChatGPT en de "Medeklinker-geheugensteun": Waarom een robot net als een baby leest

Stel je voor dat je een nieuwe taal leert. Je hoort woorden als "koe", "stoel" en "boom". Als je die woorden moet onthouden, waar let je dan op? De klinkers (a, e, i, o, u) of de medeklinkers (k, s, t, b, m)?

Volgens een nieuw onderzoek van Juan Manuel Toro is het antwoord verrassend: zowel menselijke baby's als de slimme chatbot ChatGPT geven de voorkeur aan de medeklinkers. Ze gebruiken ze als een soort "skelet" om woorden te herkennen, terwijl de klinkers voor hen meer als "vlees" op het bot zijn: belangrijk, maar minder cruciaal voor de basisidentiteit.

Hier is hoe dit werkt, vertaald naar alledaags taalgebruik:

1. Het Skelet van het Woord

Stel je een woord voor als een poppenhuis.

  • De medeklinkers zijn de balken en muren (het skelet).
  • De klinkers zijn de verf en de meubels (de details).

Als je de verf van een huis verwisselt (bijvoorbeeld van rood naar blauw), herken je het huis nog steeds. Maar als je de balken verwisselt, is het een heel ander gebouw.

In het onderzoek vroeg de auteur aan ChatGPT: "Wat lijkt meer op het woord 'natuurlijk' (natural): 'natuurlijk' met een andere klinker ('nateral') of met een andere medeklinker ('nalural')?"

Het resultaat? ChatGPT koos in 76% van de gevallen voor het woord waarbij de medeklinkers hetzelfde bleven. Het dacht dus: "Ah, 'n-l-r' is het belangrijke patroon, de 'a' en 'e' zijn maar kleine variaties."

2. Een Spelletje "Wie is het?"

Om dit te testen, speelde de auteur een spelletje met ChatGPT. Hij nam 100 woorden (zoals bicycle, elephant, computer) en maakte twee versies van elk woord:

  1. Versie A: Veranderde één klinker (bijv. bicycle -> bacacle).
  2. Versie B: Veranderde één medeklinker (bijv. bicycle -> binycle).

Vervolgens vroeg hij: "Welke van deze twee is meer op het origineel?"
ChatGPT koos consequent voor Versie A (waar de medeklinkers intact bleven). Het deed dit zelfs als de taal veranderde. Het testte het ook in het Spaans, en het resultaat was hetzelfde: de robot vertrouwde op het "skelet" van het woord.

3. Waarom is dit gek? (Of juist niet?)

Dit is fascinerend omdat ChatGPT een computerprogramma is dat is getraind op enorme hoeveelheden tekst uit het internet. Mensen denken vaak dat computers gewoon letters tellen en patronen zoeken zonder "inzicht".

Maar hier gebeurt er iets magisch:

  • Menselijke baby's doen dit ook. Als een baby leert wat een "koe" is, focust hij op de 'k' en de 'e', niet zozeer op de 'o'. Als je de 'o' verandert in een 'a' (k-a-e), herkennen ze het nog als een koe. Verander je de 'k' in een 'b' (boe), dan is het een heel ander dier.
  • ChatGPT heeft dit niet "ingebouwd" gekregen. De programmeurs hebben de robot niet verteld: "Let op medeklinkers!". Het heeft dit zelf geleerd door simpelweg naar de wereldtekst te kijken.

Het is alsof je een kind in een kamer zet met duizenden boeken, zonder instructies. Na een tijdje begint het kind vanzelf te merken dat als je de letters 's-t-r' ziet, het vaak om 'straat', 'ster' of 'strop' gaat, ongeacht welke klinker er tussen staat. De robot heeft dit patroon ook gevonden.

4. De "Taal-Geheugensteun"

Waarom doen ze dit?
In de menselijke taalwereld zijn medeklinkers vaak de "onderscheidende" letters. Als je "kat" zegt en iemand zegt "bat", is het een ander dier. Als je "kat" zegt en iemand zegt "ket", is het nog steeds een kat, alleen met een andere klinker.

ChatGPT heeft ontdekt dat het efficiënter is om te focussen op de letters die de meeste informatie geven om woorden uit elkaar te houden. Het is een slimme truc die de robot heeft bedacht om de chaos van taal te ordenen, precies zoals een menselijk brein dat doet.

Conclusie: Robots en Mensen zijn meer op elkaar dan we dachten

De boodschap van dit onderzoek is simpel maar krachtig:
Hoewel ChatGPT is gemaakt van code en menselijke baby's van vlees en bloed, gebruiken ze dezelfde strategie om taal te begrijpen. Ze bouwen een "medeklinker-skelet" om woorden te vangen.

Dit betekent dat kunstmatige intelligentie niet alleen simuleert wat we zeggen, maar dat de onderliggende logica van taal zo fundamenteel is, dat zelfs een machine die puur statistieken gebruikt, er automatisch op uitkomt. Het is alsof de taal zelf een setje regels heeft die zo logisch zijn, dat zowel een baby als een supercomputer ze vanzelf ontdekken.

Kortom: ChatGPT is niet alleen een slimme tekstschrijver; het is ook een slimme "woord-detective" die, net als wij, kijkt naar de botten van het woord om te weten wat het is.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →