← Nieuwste papers
🤖 machine learning

LEMUR: Latent Entropy-aware Multimodal Unlearning via Visual-anchored Reasoning Redirection

Dit artikel introduceert LEMUR, een training-vrij, inference-tijd framework dat door RL-geïnduceerde token-niveau entropie-dynamiek gebruikmaakt om gevoelige redeneersporen in multimodale grote redeneermodellen te detecteren en om te leiden via visueel verankerde latente injectie, waardoor privacylekken effectief worden onderdrukt terwijl de bruikbaarheid van het model behouden blijft.

Oorspronkelijke auteurs: Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen

Gepubliceerd 2026-08-13
📖 3 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een superintelligente robotvriend hebt die naar een foto kan kijken en er een verhaal over kan vertellen. Onlangs hebben wetenschappers deze robots een nieuwe truc geleerd: voordat ze hun definitieve antwoord geven, mogen ze "hardop nadenken". Ze schrijven een lang, stapsgewijs dagboek van hun gedachten, waarbij ze aanwijzingen controleren en mogelijkheden raden, net als een detective die een mysterie oplost. Dit "denken" maakt hen veel beter in het beantwoorden van lastige vragen.

Maar hier zit de crux: soms lekt dit gedachtendagboek geheimen. Stel je voor dat je de robot hebt gevraagd om een specifiek feit over een persoon te vergeten — zoals hun woonadres. De robot kan er succesvol in slagen om dat adres te verbergen in zijn laatste zin, door te zeggen: "Ik weet niet waar hij woont." Echter, als je in het "gedachtendagboek" kijkt, zie je misschien staan: "Hm, hij woont in Vancouver," voordat de robot besluit dit door te strepen. Het geheim is nog steeds aanwezig, verborgen in het proces, en niet alleen in het resultaat. Dit is een groot probleem voor de privacy. Als we willen dat deze robots bepaalde gevoelige informatie vergeten, moeten we het dagboek schoonvegen, niet alleen het definitieve antwoord.

Hier komt een nieuwe methode genaamd LEMUR om de hoek kijken. Denk aan LEMUR als een zeer scherpe redacteur voor het dagboek van de robot. De onderzoekers ontdekten dat wanneer de robot op het punt staat een geheim te schrijven dat hij zou moeten vergeten, zijn "denkstijl" op een heel specifieke manier verandert. Hij wordt zenuwachtig en besluiteloos voor een fractie van een seconde (zoals een stamper), om vervolgens plotseling superzelfverzekerd en robotachtig te worden terwijl hij het geheim typt.

LEMUR let op dit nerveuze gestotter. Op het moment dat LEMUR ziet dat de robot zich klaarmaakt om een geheim te verklappen, grijpt LEMUR zachtjes de hand van de robot vast en stuurt de gedachten bij. In plaats van de robot "Vancouver" te laten schrijven, fluistert LEMUR: "Hé, kijk nog eens goed naar de foto!" en begeleidt de robot om iets veiligs te schrijven, zoals "Dat kan ik niet zien op de foto."

Het beste eraan? LEMUR heeft geen nieuwe training nodig voor de robot of een verandering in de hersenen van de robot. Het werkt in realtime, zoals een spellingscontrole die alleen wordt geactiveerd wanneer een verboden woord wordt gehoord. De onderzoekers hebben dit getest op verschillende slimme robots en ontdekten dat LEMUR veel beter is in het wegpoetsen van geheimen uit het gedachtendagboek dan eerdere methoden, terwijl de robot nog steeds slim en vriendelijk blijft voor alles wat daarmee te maken heeft. Het is een slimme manier om de privacy te beschermen zonder het vermogen van de robot om na te denken te breken.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →