← Nieuwste papers
🤖 AI

Steerable Chatbots: Exploring Personalization Control Interfaces via LLM Activation Steering

Dit artikel introduceert "steerable chatbots" als een nieuw personalisatieparadigma dat gebruikers in staat stelt om de output van LLM's direct te controleren via activation steering in plaats van via prompting, en evalueert drie interface-ontwerpen via een gebruikersstudie om hun potentieel voor betere voorkeursafstemming aan te tonen, terwijl het diverse gebruikerswaarden met betrekking tot controle en transparantie benadrukt.

Oorspronkelijke auteurs: Jessica Y. Bo, Tianyu Xu, Ishan Chatterjee, Katrina Passarella-Ward, Achin Kulshrestha, D Shin

Gepubliceerd 2026-07-28
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Jessica Y. Bo, Tianyu Xu, Ishan Chatterjee, Katrina Passarella-Ward, Achin Kulshrestha, D Shin

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je praat met een superintelligente robot die alles in de wereld weet. Normaal gesproken, als je wilt dat de robot op een bepaalde manier handelt—zoals super chic of juist heel goedkoop te zijn—moet je dat met woorden uitleggen. Je zou kunnen zeggen: "Ik wil een chique diner," of "Ik heb een krap budget." Maar soms is het moeilijk om de juiste woorden te vinden, of begrijpt de robot niet helemaal wat je bedoelt, vooral wanneer je het gesprek voor het eerst begint. Dit artikel gaat over een nieuwe manier om met deze robots te praten, niet alleen met woorden, maar met een "volumeknop" voor hun persoonlijkheid.

De wetenschappers achter dit onderzoek werken in een vakgebied dat "Human-Computer Interaction" wordt genoemd, wat in feite de studie is naar hoe mensen en machines met elkaar omgaan. Ze gebruiken een techniek genaamd "activation steering". Denk aan een groot taalmodel (het brein van de chatbot) als een enorme, complexe radio. Normaal gesproken verander je van zender door een verzoek te typen. Maar "activation steering" is als een draaiknop die direct specifieke "frequenties" in het brein van de robot harder of zachter zet. Als je de "Luxe"-draaiknop omhoog draait, begint de robot over dure dingen na te denken. Als je de "Budget"-draaiknop omhoog draait, denkt hij aan geld besparen. De grote vraag die de onderzoekers stelden was: Als we gewone mensen deze speciale draaiknop geven, hoe zou die er dan uit moeten zien? Moeten ze hem heen en weer schuiven? Moeten ze hem één keer instellen en vergeten? Of moet de robot het zelf uitzoeken?

Dit artikel introduceert een nieuw idee genaamd "Steerable Chatbots". In plaats van je te vragen een perfecte paragraaf te schrijven om de robot te vertellen wat je leuk vindt, hebben de onderzoekers interfaces gebouwd waarmee je de persoonlijkheid van de robot direct kunt controleren met een simpel getal of een schuifregelaar. Ze testten drie verschillende manieren om dit te doen. De eerste, genaamd SELECT, is als een volumeregelaar op je telefoon; je kunt hem omhoog of omlaag slepen terwijl je chat om de "vibe" van de robot direct te veranderen. De tweede, CALIBRATE, is als het instellen van een nieuwe bril; voordat je begint met praten, laat de robot je twee verschillende antwoorden zien en kies jij degene die je het leukst vindt, wat de robot helpt de perfecte instelling te vinden voordat het gesprek überhaupt begint. De derde, LEARN, is als een gedachtenlezende vriend; de robot luistert naar wat je zegt en raadt je voorkeuren, waarbij hij zijn instellingen automatisch op de achtergrond aanpast zonder dat jij iets hoeft aan te raken.

De onderzoekers voerden eerst computertests uit om te controleren of de "draaiknoppen" daadwerkelijk werkten. Ze ontdekten dat het draaien aan de knop de antwoorden van de robot inderdaad veranderde, waardoor hij over budgetrestaurants begon te praten als hij de ene kant op werd gedraaid en over chique restaurants als hij de andere kant op werd gedraaid. Daarna nodigden ze 14 echte mensen uit om een van deze drie nieuwe chatbots uit te proberen. De resultaten waren interessant: alle drie de manieren om de draaiknop te gebruiken, hielpen de robot om de gebruikers beter te begrijpen dan wanneer de robot alleen op basis van woorden zou moeten raden. Mensen vonden echter niet allemaal dezelfde manier van besturen prettig. Sommige mensen hielden van de schuifregelaar (SELECT) omdat zij zich totaal in controle voelden. Anderen gaven de voorkeur aan de robot die het zelf uitzoekt (LEARN) omdat dit natuurlijker aanvoelde en minder werk vereiste. Een enkeling hield van de voorbereidingsstap (CALIBRATE) omdat het precies aanvoelde, zoals een oogtest.

De studie suggereert dat het geven van een directe "knop" aan mensen om de persoonlijkheid van een chatbot te controleren een krachtig hulpmiddel is, vooral wanneer je de chatbot voor het eerst gebruikt en nog geen lange geschiedenis van chats hebt om de robot mee te leren kennen. Maar er is niet één perfect ontwerp voor iedereen. Sommige mensen willen de kapitein van het schip zijn, terwijl anderen willen dat het schip zichzelf stuurt. Het artikel concludeert dat de toekomst van het praten met AI niet alleen zal gaan over beter typen, maar over het geven van verschillende soorten controles aan ons—schuifregelaars, installatie-assistenten of automatische piloten—zodat we kunnen kiezen hoeveel we het gesprek zelf willen sturen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →