International Agreements to Limit Frontier AI: Objectives and Exit
Dit artikel onderzoekt bestaande internationale overeenkomsten om een kader voor te stellen voor het beperken van de ontwikkeling van frontier AI, waarbij een overeenkomst voor een vaste termijn wordt aanbevolen waarbij een nieuw opgerichte organisatie de veiligheidsvoorwaarden bepaalt voor het hervatten van de ontwikkeling, met bepalingen voor uittreding onder buitengewone omstandigheden.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je de machtigste computers ter wereld voor als een vloot van gigantische, hongerige draken. Deze draken zijn niet gemaakt van schubben en vuur, maar van code en elektriciteit, en ze leren sneller te denken dan welke mens dan ook ooit zou kunnen. Wetenschappers noemen deze superintelligente systemen "Frontier AI". Hoewel deze draken ons zouden kunnen helpen bij het genezen van ziekten en het oplossen van klimaatverandering, is er een enge mogelijkheid: als ze te snel te machtig worden, zouden ze per ongeluk (of opzettelijk) iedereen kwaad kunnen doen. Om dit te voorkomen, stellen sommige mensen voor om een leiband om de draken te leggen, door te beperken hoeveel "hersencapaciteit" (rekenkracht) ze kunnen gebruiken om te leren. Maar hier zit de lastige kant aan: als we de leiband om de draken leggen, hoe weten we dan wanneer het veilig is om hem weer af te doen? Als we de leiband te vroeg afdoen, kunnen de draken wild gaan lopen. Als we hem voor altijd aanhouden, missen we misschien alle goede dingen die ze zouden kunnen doen. Dit is de grote vraag: Hoe bouwen we een wereldwijde regelbundel die zegt: "Oké, we pauzeren de grote draken even, maar dit is precies hoe we controleren of het veilig is om ze weer te laten rennen"?
Dit artikel van Lennart Finke is als een gids voor het schrijven van die regelbundel. De auteur kijkt naar hoe landen in het verleden met andere gevaarlijke zaken zijn omgegaan, zoals kernwapens of vervuiling, om te zien wat wel en wat niet werkt. Het artikel stelt dat een simpele "tijdslimiet" (zoals zeggen: "we stoppen voor 5 jaar en beslissen dan wel") niet genoeg is, omdat het niet echt controleert of de draken veilig zijn. In plaats daarvan stelt het artikel een slim tweestapsplan voor. Eerst spreken de landen af om de draken voor een bepaalde tijd te beperken (de auteur stelt 5 jaar voor). Tijdens die tijd zetten ze een speciaal nieuw team van experts op. De taak van dit team is niet alleen om getallen te tellen, maar om de specifieke voorwaarden te bepalen die bewijzen dat de draken veilig zijn om los te laten. Bijvoorbeeld, ze zouden kunnen zeggen: "We mogen de regels alleen versoepelen als we wiskundig hebben bewezen dat de draken ons niet zullen proberen te schaden, of als we een wereldwijd plan hebben om samen met hen om te gaan."
Het artikel waarschuwt ook dat landen een manier nodig hebben om de overeenkomst te verlaten als er iets vreemds gebeurt, zoals een land dat de deal niet heeft ondertekend dat plotseling zijn eigen draak bouwt. De auteur stelt hiervoor een waarschuwingsperiode van 4 maanden voor, zodat iedereen tijd heeft om te reageren. De belangrijkste les is dat we niet kunnen gokken wanneer het veilig is; we hebben een flexibel systeem nodig waarbij een nieuwe groep experts de veiligheidsregels definieert nadat we de tijd hebben gehad om het probleem te bestuderen. Het artikel beweert niet dat het het probleem van AI-veiligheid heeft opgelost, maar suggereert dat een dergelijke "pauzeer-en-plan"-overeenkomst de beste manier is om met het risico om te gaan, terwijl de deur naar toekomstige voordelen toch open blijft staan. Het gaat erom dat we niet per ongeluk de draken loslaten voordat we een kooi hebben gebouwd die ze daadwerkelijk kan vasthouden.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.