← Nieuwste papers
🤖 AI

AutoVSR: Automatic Visual-to-Symbolic Reasoning for Symbolic Expression Generation from Circuit Schematic

AutoVSR is een geautomatiseerd framework dat Vision Language Models gebruikt om schakelschema's om te zetten naar een uitvoerbare intermediaire representatie en een symbolische solver-agent inzet om nauwkeurige symbolische expressies te genereren, waarbij het bestaande end-to-end en gespecialiseerde methoden aanzienlijk overtreft in zowel nauwkeurigheid als efficiëntie.

Oorspronkelijke auteurs: Zhe Xiao, Longfei Li, Xu He, Haoying Wu, Zixing Zhang, Mingyu Liu

Gepubliceerd 2026-07-14
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Zhe Xiao, Longfei Li, Xu He, Haoying Wu, Zixing Zhang, Mingyu Liu

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een slordige, handgetekende kaart van een schattenjacht in handen krijgt. De kaart zit vol met kronkelige lijnen, vreemde symbolen voor rotsen en bomen, en pijlen die in verwarrende richtingen wijzen. Je doel? Het opschrijven van de exacte wiskundige formule die voorspelt waar de schat precies verborgen ligt.

Dit is de dagelijkse strijd voor ingenieurs die werken met elektronische schema's. Dit zijn de "kaarten" van elektronische apparaten. Decennialang was het omzetten van deze plaatjes naar heldere, werkende wiskundige formules een traag, handmatig en foutgevoelig proces.

Maak kennis met AutoVSR, een nieuwe digitale assistent die fungeert als een super slimme, hypergeorganiseerde detective. In plaats van te proberen het antwoord direct uit de slordige tekening te raden, gebruikt AutoVSR een slimme tweestapsstrategie om het puzzelstukje op te lossen.

Het probleem met "raden"

Voordat AutoVSR bestond, probeerden de beste tools naar de afbeelding van het circuit te kijken en direct de uiteindelijke wiskundige formule uit te spugen. Denk hierbij aan het vragen aan een genie om een complexe algebraïsche som op te lossen door alleen maar naar een wazige foto van de vraag te staren. Dat is te veel gevraagd. Het artikel stelt dat deze "end-to-end" gokbenadering gebrekkig is omdat het het zien van de afbeelding en het uitvoeren van de wiskunde door elkaar haalt. Als de AI een kleine weerstand aanziet voor een condensator, wordt de hele wiskundige formule foutief, en verspreidt de fout zich als een virus door de rest van de berekening.

Het artikel sluit expliciet de mogelijkheid uit dat huidige AI-modellen deze complexe wiskunde betrouwbaar kunnen uitvoeren door simpelweg naar een afbeelding te kijken en "hard na te denken". Ze ontdekten dat zonder een strikte tussenstap, de AI in de war raakt en antwoorden hallucineert.

De AutoVSR-oplossing: De "Vertaler" en de "Calculator"

AutoVSR verandert het spel door de taak op te splitsen in twee duidelijke rollen, zoals een team bestaande uit een vertaler en een wiskundige.

Stap 1: De Vertaler (Het bouwen van de "Executable IR")
Eerst springt AutoVSR niet direct naar de wiskunde. In plaats daarvan fungeert het als een strikte vertaler. Het kijkt naar de afbeelding van het circuit en zet dit om in een superheldere, machineleesbare lijst met instructies die een Executable IR (Intermediate Representation) wordt genoemd.

  • De Analogie: Stel je voor dat de afbeelding van het circuit een slordig handgeschreven recept is. AutoVSR probeert nog niet het gerecht te bereiden. In plaats daarvan schrijft het het recept opnieuw naar een perfect, gestandaardiseerd digitaal formaat dat een robotkok zonder enige verwarring kan lezen. Het somt elk ingrediënt op (weerstanden, condensatoren) en precies hoe ze verbonden zijn.
  • Het Veiligheidsnet: Deze vertaler is paranoïde over fouten. Het heeft een ingebouwd "dubbelcheck"-systeem. Het vraagt zichzelf af: "Is deze lijst fysiek logisch? Is er een aardingsdraad? Zijn de verbindingen geldig?" Als het een fout vindt (zoals een zwevende draad), raadt het niet zomaar wat; het schrijft de lijst opnieuw tot deze perfect is. Het artikel laat zien dat deze stap cruciaal is, omdat het fouten opvangt die anders de uiteindelijke berekening zouden ruïneren.

Stap 2: De Calculator (De Symbolische Solver)
Zodra het "recept" (de Executable IR) perfect is, draagt AutoVSR het over aan een gespecialiseerde wiskundige motor. Dit is geen gokkende AI; het is een precieze rekenmachine.

  • De Analogie: Nu de robotkok over het perfecte digitale recept beschikt, gebruikt hij een strikte set kookregels (symbolische tools) om de exacte chemische veranderingen te berekenen. Hij "gokt" niet de smaak; hij volgt de wetten van de natuurkunde en algebra stap voor stap.
  • Het Resultaat: Omdat de input perfect was en de calculator precies is, is de uiteindelijke wiskundige formule correct.

Hoe goed werkt het?

De auteurs testten dit systeem op duizenden circuits, variërend van eenvoudige weerstandsnetwerken tot complexe systeemniveau blokdiagrammen. De resultaten waren verrassend sterk:

  • De "Gokkers" verslaan: Wanneer vergeleken met standaard AI-modellen die proberen het antwoord direct te raden, verbeterde AutoVSR de nauwkeurigheid met een enorme 30,01% tot 59,45%. Bijvoorbeeld, bij sommige moeilijke circuittypen had de standaard AI slechts ongeveer 10% van de tijd gelijk, terwijl AutoVSR in meer dan 80% van de gevallen correct was.
  • Specialistische Experts verslaan: Het versloeg zelfs andere gespecialiseerde methoden die specifiek voor circuits zijn ontworpen, met een verbetering in nauwkeurigheid van 41,96% tot 51,84%.
  • Snelheid en Kosten: Hier komt de echte klapper: AutoVSR werd niet alleen beter, het werd ook sneller en goedkoper. Het gebruikte een lichtgewicht AI-model (wat vergelijkbaar is met een compacte, efficiënte auto) en presteerde nog steeds beter dan de gigantische, dure "supercomputer"-AI-modellen. Terwijl de grote modellen tot wel 148,4 seconden nodig hadden en meer dan 13.000 tokens (eenheden voor tekstverwerking) gebruikten om een matig antwoord te geven, loste AutoVSR met een klein model dezelfde problemen op in slechts 17,0 seconden met slechts 4.563 tokens.

De Kern van het Verhaal

Het artikel suggereert dat het geheim van het oplossen van deze moeilijke visuele-naar-wiskunde problemen niet simpelweg is om de AI "slimmer" te maken in het raden. In plaats daarvan is de sleutel: structuur. Door de AI te dwingen eerst een geverifieerd, foutloos blauwdruk (de Executable IR) te bouwen en vervolgens strikte wiskundige tools te gebruiken om het op te lossen, kunnen we een chaotische visuele puzzel omzetten in een betrouwbare, oplosbare vergelijking.

De auteurs concluderen dat deze aanpak circuitanalyse betrouwbaarder en efficiënter maakt, waarmee ze bewijzen dat de beste manier om een complex probleem op te lossen soms niet is om te raden, maar om eerst een solide fundament te bouwen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →