← Nieuwste papers
💬 NLP

Do Chinese models speak Chinese languages?

Deze studie toont aan dat, ondanks de diverse taalkundige landschap van China, de toonaangevende open-gewogen LLM's multilinguale prestatieprofielen vertonen die opmerkelijk lijken op die van westerse modellen – uitstekend in grote wereldtalen zoals Mandarijn, Frans en Duits, maar vaak falend in het ondersteunen van minderheidstalen zoals Kazachs en Oeigoers – wat suggereert dat wereldwijde benchmarkpraktijken en gedeelde trainingsbronnen een homogenisering van taalcapaciteiten aandrijven ten koste van lokale prioritering.

Oorspronkelijke auteurs: Andrea W Wen-Yi, Unso Eun Seo Jo, David Mimno

Gepubliceerd 2026-05-18
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Andrea W Wen-Yi, Unso Eun Seo Jo, David Mimno

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je de wereld van Kunstmatige Intelligentie voor als een enorme, wereldwijde kookwedstrijd. Chefs (modelontwikkelaars) uit verschillende landen proberen de ultieme "Universele Taalpot" te creëren die elke taal op aarde kan begrijpen en spreken.

Dit artikel stelt een specifieke vraag: Koken de chefs uit China, die een keuken vol met diverse lokale ingrediënten hebben, er daadwerkelijk mee? Of volgen ze gewoon hetzelfde recept als de chefs uit de VS en Europa?

Hier is de uiteenzetting van hun bevindingen, met behulp van eenvoudige analogieën:

1. De Opzet: Een Diverse Keuken vs. Een Wereldmenu

China is als een enorme keuken met 1,4 miljard mensen die Mandarijn spreken, plus honderden andere lokale dialecten en minderheidstalen (zoals Oeigoers, Tibetaans en Kazachs). Je zou verwachten dat de Chinese chefs een speciaal voordeel hebben: ze hebben gemakkelijke toegang tot deze lokale ingrediënten.

Er is echter een addertje onder het gras. Om de wedstrijd te winnen en wereldwijd beroemd te worden, worden de chefs beoordeeld door een panel van critici die voornamelijk Engels spreken en Engelstalige scorekaarten (benchmarks) gebruiken. Als je wilt worden erkend als een topchef, moet je je gerecht laten proeven aan deze Engelstalige jury.

2. Het Experiment: Het Proeven van de Gerecht

De onderzoekers proefden gerechten van 6 Chinese chefs (zoals Qwen, Yi en DeepSeek) en 4 westerse chefs (zoals Llama en Mistral). Ze testten ze op 21 verschillende "talen", variërend van grote talen zoals Frans en Duits tot lokale Chinese minderheidstalen.

Ze gebruikten drie verschillende manieren om het eten te proeven:

  • De Vertaaltest: Kan het model een zin uit het Engels naar een andere taal vertalen zonder de smaak (betekenis) te verliezen?
  • De Leestest: Kan het model een verhaal in een vreemde taal lezen en er correct vragen over beantwoorden?
  • Het Naamspel: Kan het model naar een tekst kijken en correct zeggen: "Dit is geschreven in het Kazachs" of "Dit is geschreven in het Tibetaans"?

3. De Resultaten: De "Mandarijn-Exception"

De resultaten waren verrassend uniform, met één grote uitzondering.

  • Het "Kloon"-Effect: Voor bijna elke geteste taal (Frans, Duits, Japans, Koreaans, etc.) presteerden de Chinese modellen en de westerse modellen bijna identiek. Het is alsof beide groepen chefs exact hetzelfde wereldwijde receptenboek volgden. Het artikel vond een correlatie van 93% tussen hen. Als een westers model goed was in Frans, was het Chinese model ook goed in Frans. Als een westers model moeite had met een minderheidstaal, had het Chinese model precies evenveel moeite.
  • De Mandarijn-Superkracht: Het enige moment waarop de Chinese chefs de westerse echt overtroffen, was bij Mandarijn Chinees. Omdat ze meer toegang hadden tot Mandarijn-gegevens en zich daarop richtten, was hun "Mandarijn-gerecht" aanzienlijk lekkerder dan de versie van de westerse chefs.
  • Het Blinde Vlekje voor Minderheidstalen: Hier is het trieste deel. Ondanks dat ze toegang hadden tot lokale ingrediënten, waren de Chinese modellen even slecht in het omgaan met Chinese minderheidstalen (zoals Oeigoers en Kazachs) als de westerse modellen. Sterker nog, veel Chinese modellen konden niet eens herkennen dat een tekst in het Oeigoers of Kazachs was geschreven. Ze behandelden deze lokale talen alsof ze niet bestonden, precies zoals de westerse modellen deden.

4. Waarom Is Dit Gebeurd?

Het artikel suggereert twee hoofdredenen:

  1. De "Wereldwijde Scorekaart"-Druk: Om beroemd te worden en financiering te krijgen, zijn Chinese ontwikkelaars bezeten van het winnen van wereldwijde benchmarks. Deze benchmarks zijn voornamelijk in het Engels of grote Europese talen. Dus, in plaats van hun unieke toegang tot lokale Chinese data te gebruiken om een werkelijk divers model te bouwen, optimaliseerden ze hun modellen om er goed uit te zien op het wereldwijde scorebord.
  2. Het "Mandarijn-Eerst"-Beleid: Hoewel China een geschiedenis heeft van het proberen zijn vele talen te beschermen, hebben recente beleidsmaatregelen zich sterk gericht op het maken van Mandarijn tot de enige, verenigende taal voor het hele land. De AI-ontwikkelaars lijken deze trend te volgen: ze geven prioriteit aan Mandarijn (de "super-taal") en negeren de rest.

De Conclusie

Het artikel concludeert dat, ondanks dat China een uniek taalkundig landschap heeft en het potentieel heeft om een model te bouwen dat echt spreekt tot zijn diverse bevolking, de Chinese modellen "gehomogeniseerd" zijn geworden.

Ze zijn in feite kloonkopieën van westerse modellen, met één kleine upgrade: ze spreken Mandarijn iets beter. Ze hebben hun unieke positie niet gebruikt om de honderden andere talen die binnen de grenzen van China worden gesproken, te redden of te verheffen. In plaats daarvan koken ze allemaal hetzelfde wereldwijde gerecht, waardoor de lokale, minderheidssmaken op het plankje blijven liggen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →