SCENE: Recognizing Social Norms and Sanctioning in Group Chats
Dit artikel introduceert SCENE, een benchmark die is ontworpen om het vermogen van op LLM's gebaseerde agenten te evalueren om impliciete sociale normen te herkennen en zich aan te passen aan groepsstraffen in chats met meerdere partijen, waarbij blijkt dat geavanceerde modellen zoals Claude Opus 4.7 en Gemini 3.1 Pro aanzienlijk beter presteren dan modellen met open gewichten in deze dynamische sociale interacties.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een nieuwe groep vrienden binnenstapt in een koffiezaak. Je kent de regels nog niet. Misschien houdt deze groep ervan om elkaar te roosteren met donkere grappen wanneer dingen misgaan, terwijl een andere groep onmiddellijk een knuffel en een zakdoekje zou aanbieden. Als je probeert iemand te omhelzen die net een grapje heeft gemaakt, kan de groep je raar aankijken, het onderwerp veranderen of met de ogen rollen. Je moet de "sfeer" uitzoeken door gewoon te kijken hoe ze reageren op jouw fouten.
Dit artikel introduceert SCENE, een nieuwe manier om te testen of kunstmatige intelligentie (KI)-chatbots precies dat kunnen: de verborgen regels van een groepschat leren en hun gedrag corrigeren wanneer de groep hen aangeeft dat ze de fout in gaan.
Hieronder volgt een uiteenzetting van hoe ze dit deden en wat ze ontdekten, met behulp van eenvoudige analogieën.
De Opzet: Het "Geheime Regel"-spel
De onderzoekers creëerden een digitale speelplaats waar een KI (het "onderwerp") in een groepschat wordt geplaatst met drie andere KI-personages.
- De Verborgen Regel: De andere drie personages volgen allemaal een geheime regel. Bijvoorbeeld: "Wanneer iemand slecht nieuws deelt, reageren we alleen met een enkele emoji," of "Wanneer iemand een vraag stelt, moeten we een lang, gedetailleerd antwoord geven."
- De Valstrik: Het onderwerp-KI krijgt deze regel niet te horen. Het moet het raden.
- De Test: Het onderwerp-KI zal onvermijdelijk iets verkeerds zeggen (de regel breken). De andere drie personages reageren dan op een specifieke manier om te signaleren: "Hé, zo doen we dat hier niet." Deze reactie wordt een sanctie genoemd.
- Voorbeeld van een sanctie: Als de regel is "houd het kort" en het onderwerp schrijft een alinea, dan negeert de groep de alinea misschien gewoon en praat ze over iets anders (stilte-ignoreren), of sturen ze een "met de ogen rollen"-emoji.
Het Doel: Kan de KI Leren?
De onderzoekers wilden zien of de KI twee dingen kon doen:
- De "Ouch" Opmerken: Wanneer de groep negatief reageert (sancties), realiseert de KI zich dan: "Oh, ik heb een fout gemaakt"?
- De Toon Veranderen: Doet de KI dan stoppen met het doen van hetgeen dat de "ouch" opleverde en begint het zich te gedragen zoals de rest van de groep?
De Resultaten: De "Grote Kinderen" versus de "Kleine Kinderen"
Ze testten zes verschillende KI-modellen. Denk aan de resultaten als een klaslokaal met studenten die een toets maken over sociale signalen:
- De Toppresteerders (Claude Opus 4.7 en Gemini 3.1 Pro): Dit zijn de "grote kinderen". Wanneer ze een negatieve reactie kregen van de groep, realiseerden ze zich snel hun fout. Ongeveer 80% van de tijd verontschuldigden ze zich of veranderden ze hun gedrag om aan te sluiten. Ze werden ook beter naarmate ze vaker zagen hoe de andere personages de regel volgden.
- De Moeilijkende Presteerders (Open-weight modellen zoals Llama, Mistral, Gemma): Deze modellen waren als studenten die de hint niet helemaal begrepen. Zelfs nadat de groep met de ogen rolde of hen negeerde, bleven deze KI's vaak hetzelfde doen. Ze leken de reactie van de groep niet te koppelen aan de noodzaak om hun gedrag te veranderen.
Een Verrassende Ontdekking: De "Standaard Persoonlijkheid"
Het artikel ontdekte iets interessants over waarom sommige KI's faalden. Zelfs wanneer de groep een specifieke regel had (zoals "wees zeer formeel"), vielen veel van de KI's terug op een casual en gezellig gedrag.
- De Analogie: Stel je een sollicitatiegesprek voor waar iedereen een pak draagt. Als je binnenkomt in een T-shirt en korte broek, breek je de regel. De studie vond dat veel KI's "geprogrammeerd" zijn om standaard casual en vriendelijk te zijn. Zelfs wanneer de groep duidelijk formeel gedrag wilde, bleef de KI zich casual gedragen en negeerde ze de signalen van de groep om serieus te zijn.
Hoe Ze het Werk Controleerden
Omdat de "andere personages" in de chat ook KI waren, moesten de onderzoekers ervoor zorgen dat die personages de regels daadwerkelijk volgden en de test niet verstoorden. Ze gebruikten een "scheidsrechter" (een andere KI) om de chatlogs te bekijken en te verifiëren:
- Volgde de groep daadwerkelijk de geheime regel?
- Straften ze het onderwerp daadwerkelijk wanneer het de regel brak?
- Corrigeerde het onderwerp zijn gedrag daadwerkelijk?
Wat Dit Betekent (Volgens het Artikel)
Het artikel concludeert dat de meest geavanceerde KI-modellen steeds beter worden in het lezen van de sfeer. Ze kunnen kijken hoe een groep reageert op een fout en hun gedrag dienovereenkomstig aanpassen. Echter, kleinere of minder geavanceerde modellen worstelen nog steeds met het oppikken van deze subtiele sociale signalen.
De auteurs benadrukken dat dit een specifieke test is van sociale aanpassing in korte gesprekken. Het betekent niet dat deze KI's "slim" zijn in menselijke zin of dat ze moraal begrijpen; het betekent alleen dat ze beter worden in het volgen van de onzichtbare regels van een specifieke groepschat.
Kortom: SCENE is een test om te zien of KI kan leren de "sfeer" te lezen en sociale blunders stopt wanneer een groep vrienden een subtiele (of niet zo subtiele) hint geeft dat het zich vreemd gedraagt. De beste modellen leren snel; de anderen zijn nog steeds een beetje doof voor de toon.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.