Regional Style Recognition of Chinese Paper-Cutting Based on Deep Learning and Explainability Analysis
Dit artikel introduceert de CRPC-6 dataset en demonstreert door middel van deep learning en uitlegbaarheidsanalyse dat de regionale stijlen van Chinees papier snijden primair worden gedefinieerd door onderscheidende ambachtelijke technieken in plaats van thematische semantiek, waarbij een classificatienauwkeurigheid van 95% wordt bereikt met een ConvNeXt-Tiny model.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Eeuwenlang hing het voortbestaan van een ambacht af van de handen die het uitoefenden. Wanneer een meester-ambachtsman overlijdt, verdwijnt vaak de specifieke manier waarop hij zijn schaar vasthield of zijn kleurstoffen mengde met hem mee, waardoor alleen de voltooide objecten achterblijven. In de wereld van het immaterieel cultureel erfgoed, zoals de eeuwenoude kunst van de Chinese papiersnijkunst, is dit verlies een stille crisis. Hoewel musea decennia lang deze delicate kunstwerken hebben gedigitaliseerd en daarmee enorme bibliotheken aan afbeeldingen hebben gecreëerd, missen de digitale verslagen vaak de cruciale details van hoe het werk is gemaakt. Een foto toont een rood silhouet van een draak, maar vertelt een computer niet of die draak met een schaar is gesneden, met een mes is uitgesneden of met levendige kleuren is geverfd. Zonder deze kennis is het digitale archief een verzameling plaatjes zonder verhaal, niet in staat om onderscheid te maken tussen de verschillende regionale stijlen die de traditie definiëren.
Onderzoekers vroegen zich al lang af of een computer regionale stijlen uit elkaar kon houden, niet alleen door het onderwerp te herkennen, maar door de onzichtbare vingerafdrukken van het ambacht zelf te begrijpen. De vraag is of een machine naar een papiersnijwerk kan kijken en de herkomst ervan kan identificeren op basis van de textuur van de snede of de kwaliteit van de kleur, net zoals een menselijke expert dat doet. Dit is niet louter een oefening in het sorteren van afbeeldingen; het is een poging om de belichaamde vaardigheid van een levende traditie te vertalen naar een taal die een computer kan lezen. Indien succesvol, zou deze technologie kunnen helpen bij het behoud van de specifieke technieken van verschillende regio's, waardoor wordt gewaarborgd dat de unieke methoden van snijden, uitsnijden en verven niet verloren gaan aan de tijd, zelfs als de meesters zelf niet meer aanwezig zijn.
Een team van onderzoekers zette zich ten doelde dit probleem op te lossen door een gespecialiseerde digitale bibliotheek op te bouwen en een computer te leren kijken als een meester-ambachtsman. Ze creëerden een dataset genaamd CRPC-6, die 2.411 hoogwaardige afbeeldingen bevat van papiersnijwerken uit zes verschillende nationale tradities. Deze regio's variëren van het noorden, waar kunstenaars doorgaans een schaar gebruiken om enkelkleurig rood papier te snijden, tot het zuiden, waar complexe technieken waarbij gebruik wordt gemaakt van uitsnijwerk, verven en zelfs goudfolie, gebruikelijk zijn. De onderzoekers selecteerden deze afbeeldingen zorgvuldig uit museumarchieven, gepubliceerde boeken en hun eigen veldwerk, waarbij ze ervoor zorgden dat elke foto door menselijke experts werd geverifieerd als een authentiek voorbeeld van de specifieke regionale stijl. Vervolgens trainden ze veertien verschillende computermodellen op deze dataset, met de opdracht om te identificeren uit welke van de zes regio's elk papiersnijwerk afkomstig was.
De resultaten waren opmerkelijk. De computermodellen gokten niet alleen; ze leerden de subtiele verschillen in techniek te herkennen die de ene regio van de andere onderscheiden. Eén specifiek model, ontworpen om extra aandacht te besteden aan lokale texturen en patronen, behaalde een succespercentage van 95 procent. Dit was aanzienlijk superieur aan oudere methoden, die nauwelijks de 50 procent nauwkeurigheid haalden. De studie toonde aan dat de computer niet slaagde door simpelweg de afbeeldingen van bloemen, dieren of mensen in de snijwerken te herkennen. In plaats daarvan slaagde het model door de fysieke kenmerken van het kunstwerk zelf te analysen. Het model leerde dat een papiersnijwerk uit één regio een specifieke helderheid of een bepaalde manier van randvorming kon hebben, terwijl een snijwerk uit een andere regio een andere kleurintensiteit of een ander patroon van lijnen zou hebben.
Om precies te begrijpen hoe de computer deze beslissingen nam, gebruikten de onderzoekers een hulpmiddel dat de delen van de afbeelding benadrukt waar het model het nauwst naar keek. Ze vertaalden deze visuele accenten naar meetbare gegevens, waarbij ze zaken controleerden zoals hoe helder de geaccentueerde gebieden waren, hoe verzadigd de kleuren verschenen en hoe dicht de randen waren. De analyse onthulde een duidelijk patroon: de computer maakte onderscheid tussen de regio's op basis van de ambachtelijke technieken die werden gebruikt om ze te maken. Zo merkte het op dat papiersnijwerken uit één noordelijke regio consequent donkerder en minder kleurrijk waren, wat de traditie weerspiegelde van het gebruik van enkel rood papier en een schaar. In contrast hiermee vertoonden snijwerken uit een zuidelijke regio een hoge kleurverzadiging, wat overeenkomt met de traditie van het verven van het papier. Het model keek niet naar het verhaal dat de afbeelding vertelde; het keek naar het verhaal van hoe de afbeelding was gemaakt.
De onderzoekers testten dit idee verder door de computer papiersnijwerken te tonen met hetzelfde onderwerp maar uit verschillende regio's, en verschillende onderwerpen uit dezelfde regio. Wanneer het onderwerp veranderde maar de regio gelijk bleef, bleef de "vingerafdruk" van de computer voor die afbeelding consistent. Wanneer de regio veranderde maar het onderwerp gelijk bleef, verschoof de vingerafdruk drastisch. Dit bewees dat de computer inderdaad de regionale stijl identificeerde via de ambachtelijke techniek, en niet via het thema. Zo kon het model bijvoorbeeld het verschil zien tussen twee papiersnijwerken van bloemen, simpelweg omdat de een met een mes was uitgesneden en de ander met een schaar, ook al zagen de bloemen er identiek uit.
Deze ontdekking biedt een nieuwe manier om cultureel erfgoed te bewaren en te bestuderen. Door computers te leren de specifieke "handschrift" van verschillende regionale stijlen te herkennen, kunnen onderzoekers nu enorme collecties artefacten sorteren met een precisie die voorheen onmogelijk was. Het systeem kan items signaleren die niet overeenkomen met hun geregistreerde geschiedenis, wat musea helpt hun archieven te corrigeren. Het kan ook een meetbare manier bieden om de unieke kenmerken van een stervend ambacht te beschrijven, waardoor de essentie van een techniek wordt vastgelegd voordat deze verdwijnt. De studie concludeert dat deep learning, wanneer het wordt gestuurd door de juiste vragen en wordt getoetst aan de werkelijkheid, meer kan doen dan alleen afbeeldingen classificeren; het kan ons helpen de onzichtbare vaardigheden te begrijpen die onze gedeelde menselijke geschiedenis definiëren. De computer heeft geleerd de snede, de kleur en het ambacht te zien, en daarmee de herinnering aan de handen die hen maakten te bewaren.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.