← Nieuwste papers
💻 computer science

SPFM-Net: Semantic-Prior-Guided Frequency-Constrained Mamba for Invisible Watermark Attack

Dit artikel stelt SPFM-Net voor, een semantisch-prior-gestuurd en frequentie-beperkt Mamba-framework dat effectief onzichtbare watermerken aanvalt door een hoog-ratio maskering, een gefinetuned Masked Autoencoder en een globale state-space modelleringsunit te combineren om een superieure afweging tussen verwijderingseffectiviteit en visuele getrouwheid te bereiken.

Oorspronkelijke auteurs: Chunpeng Wang, Yanan Shi, Zhiqiu Xia, Jidong Yang, Suo Gao, Qi Li

Gepubliceerd 2026-07-31
📖 6 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Chunpeng Wang, Yanan Shi, Zhiqiu Xia, Jidong Yang, Suo Gao, Qi Li

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je het internet voor als een enorme, bruisende bibliotheek waar iedereen constant foto's deelt. Om hun werk te beschermen, verbergen kunstenaars en bedrijven vaak geheime "onzichtbare watermerken" in deze afbeeldingen. Denk aan deze watermerken niet als een zichtbare stempel, maar als een kleine, onzichtbare fluistering van code die in het weefsel van de afbeelding zelf is geweven. Het is een digitale vingerafdruk die zegt: "Dit is van mij!", zonder dat dit het uiterlijk van de foto voor het menselijk oog verandert.

Echter, net zoals een bibliotheek moet weten of er een boek wordt gestolen, moeten onderzoekers testen of deze watermerken sterk genoeg zijn om te overleven. Hier komen "watermerk-aanvallen" om de hoek kijken. In plaats van de afbeelding te proberen te stelen, proberen deze aanvallen de onzichtbare fluistering te smoren. Het doel is om de geheime code uit de foto te schrappen zonder de afbeelding zelf te verpesten. Het is een delicaat evenwicht: als je te hard schrobt, wis je het watermerk maar verander je de foto in een wazige bende; als je te voorzichtig schrobt, blijft het watermerk verborgen en blijft de foto veilig. Jarenlang hebben wetenschappers geprobeerd de perfecte "gum" te vinden die de geheime boodschap verwijdert terwijl de afbeelding scherp en echt blijft.

Maak kennis met SPFM-Net, een nieuwe digitale tool die ontworft is om dit lastige puzzelstukje op te lossen. De onderzoekers achter dit project realiseerden zich dat eerdere pogingen om watermerken te verwijderen leken op het repareren van een kapot klokje door slechts naar één tandwiel tegelijk te kijken. Ze focusten te veel op kleine, lokale details en misten het grote plaatje. SPFM-Net verandert het spel door de foto te behandelen als een gigantische legpuzzel waarbij sommige stukjes ontbreken.

Hier is hoe het werkt, stap voor stap:

1. De "Blinddoek"-strategie
Eerst legt SPFM-Net een digitale blinddoek over de watermerk-afbeelding die 90% ervan bedekt. Het verbergt willekeurig het grootste deel van de foto, waardoor slechts een paar verspreide fragmenten zichtbaar blijven. Dit klinkt misschien tegenstrijdig — waarom meer van de afbeelding verbergen? De truc is dat onzichtbare watermerken vaak vertrouwen op een continu patroon om zich te verbergen. Door de afbeelding op te delen in kleine, losgekoppelde stukjes, dwingt het netwerk zichzelf om te stoppen met kijken naar de "fluistering" van het watermerk en te beginnen met focussen op de "stem" van de eigenlijke afbeelding. Het is alsof je probeert het plot van een film te raden wanneer je slechts een paar willekeurige frames ziet; je brein moet dan vertrouwen op het verhaal (de semantische betekenis) in plaats van op de specifieke details van de gezichten van de acteurs.

2. De "Slimme Raad"-motor
Vervolgens gebruikt het systeem een vooraf getraind "brein" (een Masked Autoencoder) dat al heeft geleerd hoe echte, natuurlijke afbeeldingen eruitzien. Omdat het netwerk miljoenen foto's heeft gezien, weet het dat een lucht blauw moet zijn en een gezicht twee ogen moet hebben. Wanneer het de enkele resterende fragmenten van de watermerk-afbeelding ziet, gebruikt het deze kennis om de ontbrekende delen te "hallucineren" of te reconstrueren. Cruciaal is dat het een natuurlijke afbeelding reconstrueert, waardoor het de vreemde, kunstmatige patronen van het watermerk effectief negeert. Het is als een meesterkok die, gegeven een paar ingrediënten, een heel gerecht kan recreëren zonder per ongeluk de geheime specerij toe te voegen die de vijand probeerde te verbergen.

3. De "Frequentie-detective"
Zodra de afbeelding ruwweg is gereconstrueerd, wordt SPFM-Net nog specifieker. Het heeft een speciale module genaamd MRFFI die fungeert als een frequentie-detective. Het kijkt naar de afbeelding op verschillende "zoomniveaus" (van kleine texturen tot grote vormen) om de overgebleven sporen van het watermerk te vinden. Omdat watermerken zich vaak in specifieke frequentiepatronen verstoppen (zoals een specifieke muzikale noot), spoort deze module die noten op en dempt ze, terwijl de rest van de muziek (de details van de afbeelding) ongemoeid blijft.

4. De "Afstands-scanner"
Ten slotte gebruikt het systeem een geavanceerd component genaamd Mamba (onderdeel van de GSFM-module). Beschouw dit als een scanner die de hele afbeelding in één keer kan scannen, van de ene hoek naar de andere. Watermerken zijn vaak verspreid over de hele afbeelding, als een net. Oudere tools konden alleen naar kleine buurten kijken, waardoor ze het grote net misten. Mamba verbindt de punten over de hele afbeelding, waardoor ervoor wordt gezorgd dat zelfs de zwakste, meest verre signalen van het watermerk worden opgevangen en verwijderd.

De Resultaten
De onderzoekers hebben SPFM-Net getest tegen een verscheidenheid aan moderne watermerk-trucs, inclusief enkele die geavanceerde kunstmatige intelligentie gebruiken om de code te verbergen. De resultaten waren indrukwekkend. In veel gevallen slaagde het systeem erin het watermerk zo grondig te verstoren dat het onmogelijk te lezen was (het bereikte een "Bit Error Rate" die dicht bij 0,5 ligt, wat in feite gelijk staat aan willekeurig gokken).

Maar de echte magie zit in de kwaliteit van de foto's. Terwijl andere methoden afbeeldingen vaak veranderden in wazige, gepixelde nachtmerries, hield SPFM-Net de beelden scherp en natuurlijk. In tests behaalde het een PSNR (een score voor beeldkwaliteit) van tot wel 42,76 voor bepaalde typen watermerken, wat aanzienlijk hoger is dan voorgaande methoden. Het slaagde erin het watermerk te vernietigen terwijl de visuele getrouwheid zo hoog bleef dat het menselijk oog nauwelijks een verschil merkte.

Wat het niet doet
Het is belangrijk om op te merken dat SPFM-Net geen toverstaf is die perfect werkt op elk type watermerk in elke situatie. Voor sommige specifieke, eenvoudige watermerken die diep verbonden zijn met de textuur van de afbeelding, was het systeem iets minder agressief om te voorkomen dat de afbeelding zou worden verpest. In deze gevallen koos het ervoor om de afbeelding perfect te houden in plaats van het risico te lopen dat een klein beetje van het watermerk zou blijven zitten. De auteurs suggereren dat deze afweging eigenlijk een kenmerk is en geen fout, omdat in de echte wereld het behoud van de visuele kwaliteit van de foto vaak even belangrijk is als het verwijderen van het watermerk.

Kortom, SPFM-Net suggereert dat door watermerkverwijdering te behandelen als een "reconstructieprobleem"—het van de grond af aan herbouwen van de natuurlijke afbeelding in plaats van alleen te proberen de slechte delen te wissen—we de onzichtbare fluisteringen kunnen smoren zonder het lied te breken. Het is een slimme, nieuwe manier om naar een oud probleem te kijken, die bewijst dat je soms, om de waarheid te zien, het grootste deel van wat recht voor je ogen ligt, moet negeren.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →