A Generalized Parallelogram Rule for Proportional Analogies on Riemannian Manifolds
Dit artikel introduceert een gegeneraliseerde proportionele analogierelatie voor Riemanniaanse variëteiten door de Euclidische parallellogramregel uit te breiden naar niet-Euclidische ruimten, waarbij de toepasbaarheid ervan op diverse domeinen zoals sferen, vormruimten en waarschijnlijkheidsverdelingsvariëteiten wordt aangetoond.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een raadsel probeert op te lossen dat er zo uitziet: "Appel is voor Fruit als Wortel is voor...?" Je brein weet instinctief dat het antwoord "Groente" is. Je had geen rekenmachine nodig; je begreep simpelweg de relatie tussen de eerste twee items en paste die toe op het derde. In de wereld van computers wordt dit een "analogie" genoemd, en het is een superkracht voor kunstmatige intelligentie. Een tijdlang leerden wetenschappers computers deze raadsels oplossen met behulp van platte, rasterachtige kaarten (genaamd Euclidische ruimtes), waar je simpelweg een rechte lijn of een perfecte parallellogram kunt tekenen om het ontbrekende stukje te vinden. Het werkt geweldig voor eenvoudige lijsten met woorden of getallen.
Maar de echte wereld is niet plat. Denk aan de aarde: het is een bol. Als je een rechte lijn op een wereldbol probeert te tekenen, buigt die. Of denk aan een vormveranderende robot of een wolk van waarschijnlijkheden; deze bestaan op complexe, gebogen oppervlakken die "manifolds" worden genoemd. Wanneer computers proberen analogieën op deze gebogen oppervlakken op te lossen met oude, platte regels, gaat het mis. De rechte lijnen sluiten niet aan en de antwoorden worden een rommeltje. Dit artikel stelt een grote vraag: Hoe kunnen we computers leren om "A is voor B als C is voor D" raadsels op te lossen wanneer de wereld waarin ze leven gebogen, gedraaid en vol bobbels is?
De auteurs, Pierre-Alexandre Murena en Marcelo Hartmann, hebben een slimme nieuwe manier bedacht om dit te doen. In plaats van te proberen een gebogen wereld in een platte doos te dwingen, besloten ze de krommingen zelf te gebruiken om het antwoord te vinden. Ze realiseerden zich dat in een platte wereld een parallellogram wordt gedefinieerd door zijn zijden die parallel zijn. Maar op een gebogen oppervlak is "parallel" lastig. Daarom hebben ze de definitie veranderd. Ze keken naar het centrum van de vorm. In een plat vierkant kruisen de diagonalen precies in het midden. De auteurs bewezen dat als je het "geodetische middelpunt" (het exacte middelpunt langs het kortste gebogen pad) tussen twee items vindt, je dat kunt gebruiken om de analogie op te lossen, zelfs op een bol, een vormveranderend mesh of een wolk van data.
Hier is hoe hun nieuwe regel werkt in gewone mensentaal. Stel je hebt vier punten op een gebogen oppervlak: A, B, C en D. In de oude platte wereld zou je zeggen: "De afstand van A naar B is hetzelfde als C naar D." Op een gebogen wereld is dat moeilijk te meten. De auteurs zeggen: "Vergeet de zijden. Kijk naar het midden." Als je halverwege van A naar D loopt, en je loopt halverwege van B naar C, dan zou je op exact dezelfde plek moeten landen. Als deze twee "middelpunt"-ontmoetingen op dezelfde plek plaatsvinden, dan vormen A, B, C en D een perfecte analogie. Het is alsof je zegt: "Het halverwege punt van de start en de finish van de eerste reis is hetzelfde als het halverwege punt van de tweede reis."
Dit mag klinken als een kleine aanpassing, maar het is een enorme zaak omdat het overal werkt. De auteurs testten hun idee op allerlei vreemde, gebogen plekken. Ze probeerden het op een bol (zoals de aarde), op 3D-vormen (zojals een hond die verandert in een koe) en zelfs op wolken van waarschijnlijkheid (zoals het voorspellen van filmbeoordelingen). In elk geval vond hun "middelpunt-regel" het ontbrekende puzzelstukje correct. Ze lieten zien dat deze methode "robuust" is, wat betekent dat als je de startpunten een klein beetje verschuift, het antwoord niet instort; het blijft dicht bij het juiste antwoord. Dit is cruciaal voor real-world AI, waar data vaak ruis bevat of imperfect is.
Een van de coolste onderdelen van hun werk is hoe het omgaat met verschillende soorten "gebogen" data. Bijvoorbeeld, wanneer men te maken heeft met vormen (zoals 3D-modellen van dieren), lieten ze zien dat je een deformatie (een rek of draaiing) van het ene dier op een ander kunt toepassen met deze regel. Als je een hond hebt in een zittende houding en een hond in een staande houding, kun je uitzoeken hoe je een koe van zittend naar staand transformeert, ook al zijn koeien en honden verschillend. Ze testten dit ook op filmbeoordelingen. Als je weet hoe "tieners" actiefilms beoordelen versus horrorfilms, en je weet hoe "volwassenen" actiefilms beoordelen, kun je deze nieuwe regel gebruiken om te voorspellen hoe "volwassenen" horrorfilms zullen beoordelen. In hun tests was deze geometrische aanpak vaak beter dan oudere methoden bij het voorspellen van deze voorkeuren.
Het artikel maakt ook een duidelijk onderscheid over waar dit wel en waar het mogelijk lastig wordt. Ze bewezen dat op bepaalde gladde, symmetrische oppervlakken (zoals sferen of hyperbolische ruimtes), het antwoord uniek en gemakkelijk te berekenen is. Echter, op sommige oppervlakken, zoals de bol, als twee punten precies tegenover elkaar liggen (antipodaal), kan er meer dan één "middelpunt" zijn, wat betekent dat er ook meer dan één geldig antwoord kan zijn aan het raadsel. Ze gokten dit niet alleen; ze leverden de wiskundige formules om het exacte antwoord te berekenen voor sferen, hyperbolische ruimtes en zelfs complexe matrices die worden gebruikt in machine learning.
Wat ze niet deden, was beweren dat dit elk probleem in AI oplost. Ze merkten expliciet op dat hun methode steunt op de aanwezigheid van data op een specif kind type gebogen oppervlak genaamd een "Riemanniaanse manifold". Als de data op een vreemd, niet-glad oppervlak leeft dat niet aan deze regels voldoet, kan hun methode niet direct worden toegepast. Ze wezen er ook op dat hoewel hun methode prachtig werkt voor vormen en waarschijnlijkheden, het een nieuw instrument is dat nog meer getest moet worden in real-world toepassingen zoals transfer learning (een computer een taak leren om hem met een andere taak te helpen) of meta-learning.
Uiteindelijk gaat dit artikel over het geven van een betere kaart aan AI. Jarenlang probeerden computers de complexe, gebogen wereld van data te navigeren met een platte, 2D-kaart, wat ertoe leidde dat ze verdwaalden. Murena en Hartmann hebben een nieuwe kaart getekend die de krommingen respecteert. Door de focus te leggen op het "midden" van de reis in plaats van op de rechte lijnen, hebben ze laten zien dat computers eindelijk analogieën kunnen oplossen in de echte, gedraaide, prachtige wereld waarin we daadwerkelijk leven. Het is een stap naar AI die niet alleen feiten onthoudt, maar ook echt de relaties tussen dingen begrijpt, of het nu gaat om woorden, vormen of filmvoorkeuren.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.