← Nieuwste papers
💬 NLP

Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign

Het artikel introduceert RoSeMary, een nieuw ML/Crypto-codesign-framework dat gebruikmaakt van end-to-end training met CodeT5 en zero-knowledge proofs om robuuste, functionele en privacy-bewarende watermerken in door LLM's gegenereerde code in te bedden, waarmee de uitdagingen van lage entropie en veilige verificatie effectief worden aangepakt.

Oorspronkelijke auteurs: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

Gepubliceerd 2026-08-12
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je een wereld voor waarin computers niet alleen met ons chatten, maar ook de blauwdrukken voor ons digitale leven schrijven. Dit is het domein van Large Language Models (LLM's) voor code, de superintelligente AI-assistenten die softwarefuncties kunnen generen, bugs kunnen oplossen en complete programma's kunnen bouwen door simpelweg een opdracht te lezen. Maar hier zit de crux: wanneer deze AI's code schrijven, is het vaak moeilijk te zeggen wie er werkelijk de eigenaar van is. Heeft een menselijke ingenieur het geschreven, of een AI? En als het een AI was, welke AI van welk bedrijf? Dit is een groot probleem omdat code waardevol intellectueel eigendom is, zoals een geheim recept of een gepatenteerde uitvinding.

Om dit op te lossen, hebben wetenschappers geprobeerd AI-code te "watermerken". Denk aan dit als een digitale onzichtbare inkt of een verborgen watermerk op een bankbiljet. Je wilt kunnen bewijzen: "Hé, deze code is gemaakt door mijn AI," zonder dat de werking van de code verandert. Maar er is een lastig probleem: code is erg rigide. In tegen tegenstelling tot een verhaal waarbij je woorden kunt vervangen door synoniemen, moet code strikte regels volgen om te kunnen draaien. Als je te veel verandert om een geheime boodschap te verbergen, breekt het programma. Bovormelijk moet je om eigendom aan te tonen in de rechtszaal, meestal de geheime sleutel (het watermerk) aan een rechter laten zien. Maar als je de sleutel laat zien, kunnen kwaadwillenden deze stelen en later hun eigen watermerken vervalsen. Het is een frustrerend spel van "verstoppertje spelen" waarbij de regels van het spel het bijna onmogelijk maken om te winnen zonder iets anders te verliezen.

Hier komt een nieuw framework genaamd RoSeMary in beeld, dat optreedt als een slimme goochelaar die een geheime boodschap in een gesloten doos kan verbergen zonder ooit de sleutel te tonen. De onderzoekers, een team van de University of California, San Diego en San Diego State University, hebben een systeem ontworpen dat machine learning (het AI-gedeelte) combineert met cryptografie (het geheime wiskundige gedeelte). Ze hebben ontdekt hoe ze een verborgen handtekening in AI-gegenereerde code kunnen inbedden die moeilijk te verwijderen is, de code perfect laat werken en — het belangrijkste nog — de eigenaar in staat stelt om eigendom te verifiëren zonder dat de rechter de eigenlijke geheime handtekening ooit ziet.

Zo voert RoSeMary deze goocheltruc uit. Eerst gebruikt het een vooraf getraind AI-model genaamd CodeT5, wat een soort meesterkok is die miljoenen recepten heeft geproefd. In plaats van de code willekeurig aan te passen, begrijpt deze chef de "smaak" van de code. Het neemt de originele code en een geheime boodschap (het watermerk) en bepaalt de beste manier om de code lichtjes aan te passen — zoals het hernoemen van een variabele van x naar item of het veranderen van een while-loop in een for-loop — zodat de geheime boodschap binnen deze kleine wijzigingen verborgen wordt. Omdat de chef de regels van het koken (programmeren) kent, smaakt de code nog precies hetzelfde (werkt perfect), zelfs met het geheime ingrediënt toegevoegd.

Maar de echte magie gebeurt wanneer het tijd is om te controleren of de code authentiek is. Normaal gesproken zou je het geheime recept aan een rechter moeten overhandigen. RoSeMary gebruikt een cryptografisch hulpmiddel genaamd een Zero-Knowledge Proof (ZKP). Stel je voor dat je aan een vriend wilt bewijzen dat je de combinatie van een kluis weet, maar je wilt hem niet de cijfers vertellen. Je zou de kluis voor hem kunnen openen, de schat erin kunnen laten zien en hem vervolgens weer sluiten. Hij weet dat jij de combinatie kent, maar hij heeft de cijfers nooit gezien. RoSeMary doet iets dergelijks. De AI-eigenaar voert een complex wiskundig circuit uit dat controleert of de verborgen handtekening aanwezig is. Het genereert een klein, digitaal "bewijs" dat zegt: "Ja, de handtekening is geldig," zonder de eigenlijke handtekening te onthullen.

Het team heeft dit systeem getest op duizenden codevoorbeelden in talen zoals Python, Java en C++. Ze ontdekten dat RoSeMary extreem goed is in zijn werk. Het slaagde erin het watermerk te verbergen in 97,64% van de gevallen (wat betekent dat de code nog steeds werkte), en het kon het watermerk detecteren met een nauwkeurigheidsscore van 0,97 (waarbij 1,0 perfect is). Zelfs toen kwaadwillenden probeerden het watermerk te breken door variabelen te hernoemen of door een andere AI te gebruiken om de code te herschrijven, vond RoSeMary de verborgen boodschap nog steeds in 98% van de gevallen.

Misschien wel het meest indrukwekkende deel is de snelheid en privacy. Het systeem kan een eigendomsbewijs genereren in ongeveer 7,15 seconden, en een rechter kan dat bewijs verifiëren in slechts 118,6 milliseconden (minder dan een oogwenk). Cruciaal is dat de rechter tijdens dit hele proces het eigenlijke geheime watermerk nooit ziet. Dit betekent dat de eigenaar hetzelfde watermerk keer op keer kan hergebruiken zonder zich zorgen te hoeven maken dat iemand het steelt en een valse claim van eigendom vervalst.

Kortom, RoSeMary lost een drievoudige touwtrekkerij op die onderzoekers al een tijdje in de greep houdt. Het zorgt ervoor dat de code blijft werken (getrouwheid), het watermerk gemakkelijk te vinden is (detecteerbaarheid) en moeilijk te breken is (robuustheid), terwijl de geheime sleutel veilig blijft voor nieuwsgierige ogen. Het is een belangrijke stap voorwaarts in het beschermen van het intellectuele eigendom van de AI-revolutie, waardoor het wordt gewaarborgd dat wanneer een AI een meesterwerk schrijft, de kunstenaar de eer en de bescherming krijgt die hij verdient.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →