← Nieuwste papers
💻 computer science

LumiTokens: 3D Relighting via Token-Space Lighting Transformation

LumiTokens is een nieuw 3D-relightingframework dat expliciete materiaalscheiding en rendervergelijkingen omzeilt door compacte latente scène-tokens direct te transformeren naar herbelichte afbeeldingen via een op zelf-aandacht gebaseerde editor, wat verenigde, progressieve en composabele belichtingsbewerkingen voor diverse lichtbronnen mogelijk maakt.

Oorspronkelijke auteurs: Yiwen Chen, Matheus Gadelha, Huaizu Jiang

Gepubliceerd 2026-08-20
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Yiwen Chen, Matheus Gadelha, Huaizu Jiang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een foto maakt van een personage in een filmstudio of een product in een laboratorium en deze in een totaal andere wereld wilt plaatsen. Je wilt dat personage misschien laten staan onder de warme gloed van een zonsondergang, of dat product op een aanrecht willen plaatsen, verlicht door een ochtendvenster. Decennialang heeft computergraphics gestreden met deze taak. Om een 3D-object er in een nieuw licht echt uit te laten zien, vereisten traditionele methoden een moeizaam proces van het reverse-engineeren van het object. Kunstenaars en algoritmen moesten de lagen van de afbeelding afpellen om de vorm van het object, de textuur en hoe glanzend of ruw het oppervlak was, te achterhalen. Pas nadat dit complexe puzzelstukje was opgelost, konden ze de afbeelding weer samenstellen onder een nieuw licht. Deze aanpak was traag, vereiste vaak honderden foto's om correct te werken, en werd beperkt door hoe goed de computer de fysieke eigenschappen van het materiaal kon raden.

Een nieuwere golf van technologie heeft geprobeerd dit op te lossen door kunstmatige intelligentie te gebruiken om simpelweg te raden hoe de nieuwe afbeelding eruit zou moeten zien, vergelijkbaar met hoe een schilder een scène improviseert. Hoewel deze methoden prachtige resultaten kunnen opleveren, hebben ze vaak moeite om het object consistent te houden wanneer het vanuit verschillende hoeken wordt bekeken. Als je de camera rondom het object beweegt, kan de verlichting aan de ene kant goed lijken, maar aan de andere kant fout, wat de illusie van een solide 3D-wereld doorbreekt. Bov�of bovendien betekende het veranderen van het licht meestal dat het hele schilderproces vanaf nul opnieuw moest worden gestart. Er was geen manier om de staat van het object op te slaan en simpelweg een nieuwe lamp toe te voegen of de zon te verplaatsen zonder alles opnieuw te genereren.

Onderzoekers aan de Northeastern University en Adobe Research hebben een nieuwe aanpak geïntroduceerd genaamd LumiTokens die de manier waarop we over dit probleem denken, verandert. In plaats van te proberen de fysieke vorm van een object te achterhalen of de uiteindelijke afbeelding pixel voor pixel te raden, behandelt hun systeem de gehele 3D-scène als een compacte set digitale tokens. Zie deze tokens als een zeer efficiënte, gecomprimeerde samenvatting van het object die alle geometrie en verschijning bevat, maar niet gebonden is aan een specifieke fysieke beschrijving zoals een 3D-model of een raster van punten. De onderzoekers ontdekten dat ze deze samenvatting direct konden manipuleren. Door het systeem een beschrijving van een nieuwe lichtbron te voeren, konden ze deze tokens transformeren om de nieuwe lichtomstandigheden te reflecteren, en vervolgens het resultaat decoderen naar een verse, hoogwaardige afbeelding.

De kern van deze methode is een hulpmiddel dat ze een Scene Token Editor noemen. Deze component neemt de gecomprimeerde samenvatting van de scène en de beschrijving van het nieuwe licht, en mengt deze met elkaar via een mechanisme dat vergelijkbaar is met hoe een zoekmachine gerelateerde ideeën met elkaar verbindt. Het systeem hoeft niet de exacte 3D-coördinaten van het object te weten of de fysica van hoe licht van een oppervlak afkaatst. In plaats daarvan leert het de tokens aan te passen zodat, wanneer ze worden terugveranderd in een afbeelding, de schaduwen correct vallen, de highlights op de juiste plaatsen schitteren en de reflecties natuurlijk verschijnen. Cruciaal is dat dit proces werkt voor veel verschillende soorten licht, of het nu gaat om een brede hemel, een enkele puntlamp of een groot gloeiend paneel. Het systeem zet al deze verschillende lichtbronnen om in een gemeenschappelijke taal van lichtstralen, waardoor het ze uniform kan afhandelen.

Een van de meest significante mogelijkheden van dit nieuwe systeem is dat het progressief editen mogelijk maakt. Omdat het systeem werkt op de gecomprimeerde samenvatting in plaats van de uiteindelijke afbeelding, kan een gebruiker een verlichtingsscène stap voor stap op te bouwen. Ze kunnen beginnen met een basisomgeving, een hoofdlicht toevoegen en dan een invullicht toevoegen, waarbij elke stap dezelfde onderliggende samenvatting wijzigt. Het systeem onthoudt de wijzigingen die in de vorige stap zijn aangebracht, zodat de gebruiker niet opnieuw hoeft te beginnen of de hele scène opnieuw hoeft te berekenen voor elke nieuwe toevoeging. Dit creëert een vloeiende workflow waarbij verlichting stapsgewijs kan worden ontworpen, vergelijkbaar met het toevoegen van ingrediënten aan een gerecht, terwijl een consistente look vanuit elke hoek behouden blijft.

De onderzoekers testten hun systeem op duizenden 3D-objecten, variërend van eenvoudige vormen tot complexe modellen met glanzende en transparante oppervlakken. Ze ontdekten dat hun methode afbeeldingen produceerde die even scherp en accuraat waren als de beste bestaande technieken, en in veel gevallen zelfs superieur. Wanneer ze hun resultaten vergeleken met andere methoden die vertrouwen op het raden van de uiteindelijke afbeelding of die proberen de fysica te reverse-engineeren, vertoonde LumiTokens minder fouten in de manier waarop het licht met het object interageerde. Het vermeed veelvoorkomende fouten zoals inconsistente schaduwen of verlichting die er anders uitzag afhankelijk van de camerahoek. Het systeem was in staat om slechts een handvol foto's van een object te nemen en dit opnieuw te verlichten onder omstandigheden die het nog nooit eerder had gezien, waarbij resultaten werden geproduceerd die fysiek plausibel oogden.

Dit werk suggereert een nieuwe weg vooruit voor het creëren van 3D-assets voor films, videogames en virtual reality. Door af te stappen van de noodzaak om fysieke materialen expliciet te definiëren of zware fysica-simulaties uit te voeren, hebben de onderzoekers aangetoond dat verlichting kan worden behandeld als een directe transformatie van de digitale essentie van een scène. Het systeem beweert niet de fysica van het licht te begrijpen zoals een menselijke fysicus dat doet, maar het heeft geleerd de visuele uitkomst zo effectief na te bootsen dat het verschil onzichtbaar is voor het oog. Deze aanpak biedt een snellere, flexibelere manier om digitale objecten in nieuwe werelden te brengen, waardoor makers de stemming en atmosfeer van een scène kunnen aanpassen met een niveau van controle dat voorheen moeilijk te bereiken was.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →