Definitional alignment before capability alignment: a Design-Science framework for adjudicating claims about AGI
Dit artikel stelt DAF-AGI voor, een Design-Science-raamwerk dat prioritering geeft aan definitionele afstemming boven capaciteitsafstemming om conflicterende claims over de komst van AGI te beoordelen door ordinale criteria en governance-audits vast te stellen voor het evalueren van concurrerende operationalisaties.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Het Kernprobleem: Het "Aankomst"-argument
Stel je een groep mensen voor die discussiëren over de vraag of een nieuwe auto een "superauto" is.
- Persoon A zegt: "Ja, het is een superauto omdat hij 320 km/u kan."
- Persoon B zegt: "Nee, dat is het niet. Hij kan niet driften en zijn motor is geen V12."
- Persoon C zegt: "Het maakt niet uit wat het is; als hij zichzelf naar de winkel kan rijden, is het een superauto."
Ze kijken allemaal naar dezelfde auto. Ze zijn het allemaal eens over de feiten (de snelheid, de motor, de functies). Maar ze kunnen het niet eens worden over het oordeel omdat ze verschillende regelboeken gebruiken om te definiëren wat een "superauto" eigenlijk is.
Dit artikel stelt dat het vakgebied van Kunstmatige Algemene Intelligentie (AGI) precies in deze discussie vastzit. Sommige bedrijven zeggen: "We zijn gearriveerd!" omdat hun AI goed code schrijft. Anderen zeggen: "We zijn decennia verwijderd!" omdat hun AI dingen niet op de lange termijn kan onthouden of nieuwe puzzels kan oplossen. De onenigheid gaat niet over de technologie; het gaat over wie het regelboek mag schrijven en wat de regels precies inhouden.
De Oplossing: Een "Regelboek-auditor" (DAF-AGI)
In plaats van te proberen het één ware definitie van AGI te schrijven (wat de auteur volgens hem onmogelijk is omdat iedereen andere doelen heeft), heeft de auteur een hulpmiddel gebouwd genaamd DAF-AGI.
Zie DAF-AGI niet als een rechter die bepaalt wie er wint, maar als een transparantie-auditor. Het is als een "voedingswaardetabel" voor definities. Wanneer iemand beweert: "Deze AI is AGI," zegt de auditor niet simpelweg "Ja" of "Nee." Het vraagt:
- Wat meet je? (Is het snelheid? Geheugen? Hoeveel geld het bespaart?)
- Wie heeft de regels geschreven? (Heeft het bedrijf dat de AI maakt de regels zelf geschreven?)
- Kunnen de regels worden aangepast? (Als de AI faalt, kunnen ze dan gewoon de regels aanpassen zodat hij toch slaagt?)
De Vijf "Regelboeken" (Meetfamilies)
Het artikel kijdt naar de vijf meest voorkomende manieren waarop mensen proberen AGI te definiëren en auditeert deze:
De "Snelheidsmeter" (Prestatie-superioriteit):
- De Regel: "Als de AI sneller/beter is dan een mens bij bepaalde taken, is het AGI."
- De Fout: Het is makkelijk om te bedriegen. Je kunt alleen de taken kiezen waar de AI goed in is (zoals e-mails schrijven) en de taken waar hij slecht in is (zoals langetermijnplanning) negeren. Het is also[f] een hardloper een Olympiër noemen omdat hij een race won op een baan waar hij specifiek voor heeft geoefend, terwijl hij niet kan hardlopen op zand.
- Oordeel: Lage betrouwbaarheid.
De "Portemonnee" (Economische Substitutie):
- De Regel: "Als de AI een menselijke baan goedkoper kan uitvoeren, is het AGI."
- De Fout: Dit verwart "intelligentie" met "economie". Een robotarm kan een fabrieksarbeider vervangen omdat hij goedkoper is, niet omdat hij "slimmer" is.
- Oordeel: Gemengd. Goed voor economie, slecht voor het meten van intelligentie.
De "Kaart" (Capabiliteits-ontologie):
- De Regel: "We hebben een kaart van verschillende vaardigheden (geheugen, redeneren, creativiteit). Waar bevindt de AI zich op de kaart?"
- De Fout: Het is een geweldige kaart, maar de kaartmaker (het lab) bepaalt waar de "finishlijn" ligt.
- Oordeel: Goede structuur, maar de kaartmaker controleert de finishlijn.
Het "Rapport" (Psychometrische Pariteit):
- De Regel: "De AI moet overeenkomen met het volledige cognitieve profiel van een hoogopgeleide volwassen mens."
- De Fout: Dit is de moeilijkste test. Huidige AI's zijn als genieën in wiskunde, maar hebben het geheugen van een goudvis. Ze falen voor deze test omdat ze "gekarteld" zijn (geweldig in sommige dingen, verschrikkelijk in andere).
- Oordeel: Hoge betrouwbaarheid, maar huidige AI's falen hierin.
De "Leersnelheid" (Vaardigheidsverwerving):
- De Regel: "Intelligentie is hoe snel je een nieuwe puzzel leert die je nog nooit eerder hebt gezien."
- De Fout: Huidige AI's zijn geweldig in het onthouden van oude puzzels, maar slecht in het oplossen van nieuwe puzzels.
- Oordeel: Hoge betrouwbaarheid, maar huidige AI's falen hierin.
De Grote Onthulling: De "Gestileerde Claim"
Het artikel test een populaire bewering: "Huidige AI is AGI omdat het een hoogopgeleide volwassene verslaat bij veel taken."
Wanneer de auditor (DAF-AGI) dit controleert, vindt het een trucje.
- De claim gebruikt de regel van de Snelheidsmeter (het verslaan van de volwassene bij sommige taken).
- Maar het leent de label van het Rapport ("Hoogopgeleide volwassene").
- Als je de regels van het Rapport werkelijk toepast, faalt de AI omdat hij geheugenproblemen heeft.
- Als je de regels van de Snelheidsmeter toepast, slaagt de AI, maar alleen omdat het bedrijf de makkelijke taken heeft uitgekozen.
De Conclusie: De claim is "ondergespecificeerd". Het mengt een losse regel met een strikt label om de AI slimmer te laten lijken dan hij is. Het artikel stelt dat we niet kunnen verklaren dat "AGI is gearriveerd" totdat we het eens zijn over welk regelboek we gebruiken en wie de regels mag veranderen.
Het Concept van "Definitionele Soevereiniteit"
Dit is het belangrijkste politieke idee uit het artikel.
Stel je een land voor dat al zijn voedsel importeert.
- Scenario A: Ze kopen voedsel van een buurland. De buurland bepaalt wat "vers" betekent. Als de buurland morgen de definitie van "vers" verandert, moet het land dat accepteren of verhongeren.
- Scenario B: Het land koopt het voedsel, maar ze hebben hun eigen inspecteurs. Ze kunnen zeggen: "Wij accepteren jouw definitie van 'vers' vandaag, maar als je het morgen verandert, zullen wij het controleren en misschien afkeuren."
De auteur noemt dit Definitionele Soevereiniteit.
Veel landen (en het publiek) bevinden zich momenteel in Scenario A. Ze zijn "Definitie-nemers". Ze accepteren definities van AGI, "Hoog-risico AI" of "Volwassenheid" die zijn geschreven door een paar machtige tech-labs in de VS of China.
- Als een lab zegt: "Dit is AGI," en dat triggert een wet of een beurscrash, dan moet de wereld dat accepteren.
- Het artikel beargumenteert dat landen de capaciteit moeten hebben om deze definities te auditeren, aan te vechten en te herzien. Ze hoeven niet hun eigen definities vanaf nul te schrijven; ze moeten alleen de macht hebben om te zeggen: "Die definitie werkt niet voor ons," of "We moeten die claim verifiëren."
Samenvatting: Wat dit artikel eigenlijk zegt
- We kunnen het niet eens worden over wat AGI is, omdat verschillende groepen verschillende doelen hebben (marketing, veiligheid, investeringen).
- Meer data zal dit niet oplossen. Zelfs als AI slimmer wordt, zullen we nog steeds discussiëren over de vraag of het wel "Algemene" intelligentie is, tenzij we eerst de definitie vastleggen.
- Huidige "Aankomst"-claims zijn wankel. Ze mixen vaak makkelijke regels met harde labels om een systeem slimmer te laten lijken dan het is.
- Governance is de sleutel. We moeten stoppen met vragen "Is dit AGI?" en beginnen met vragen: "Wie heeft de regel geschreven die zegt dat dit AGI is, en kunnen we hen controleren?"
- Soevereiniteit is belangrijk. Landen en het publiek moeten de macht hebben om geïmporteerde definities van technologie aan te vechten, anders worden ze bestuurd door regels die ze niet zelf hebben geschreven en die ze niet kunnen veranderen.
Kortom: Voordat we discussiëren over de vraag of de robot "levend" of "slim" is, moeten we eerst afspreken wie het woordenboek vasthoudt en er zeker van zijn dat zij de definities niet aanpassen om hun eigen portemonnee te spekken.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.