← Nieuwste papers
💻 computer science

Operationalizing Ethics for AI Agents: How Developers Encode Values into Repository Context Files

Deze visiepaper onderzoekt hoe ontwikkelaars ethische principes operationaliseren door gedragsregels te coderen in repository-contextbestanden (bijvoorbeeld AGENTS.md) om AI-agenten te sturen, en stelt een onderzoeksagenda voor om de variatie, governance en naleving van deze opkomende, door ontwikkelaars geschreven richtlijnen te bestuderen.

Oorspronkelijke auteurs: Christoph Treude, Sebastian Baltes, Marc Cheong

Gepubliceerd 2026-05-08
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Christoph Treude, Sebastian Baltes, Marc Cheong

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een zeer slimme, zeer snelle robotassistent inhuurt om je te helpen een huis te bouwen. Je wilt dat deze robot niet alleen efficiënt is, maar ook vriendelijk, eerlijk en veilig. In het verleden zou je misschien een lang, serieus reglement hebben geschreven voor de menselijke werknemers, in de hoop dat ze het zouden lezen en zouden onthouden om goed te zijn. Maar robots lezen reglementen niet op dezelfde manier als mensen.

Dit artikel stelt dat ontwikkelaars nu een nieuwe, slimme truc proberen: ze schrijven specifieke instructiehandleidingen direct in de werkruimte van de robot.

Hier is de uiteenzetting van wat het artikel zegt, met behulp van eenvoudige analogieën:

1. Het Probleem: "Wees Goed" is Te Vaag

Stel je voor dat je tegen je robotassistent zegt: "Wees alsjeblieft ethisch." Dat is als tegen een kind zeggen: "Wees goed." Het is een mooi idee, maar het vertelt de robot niet hoe goed te zijn. Moet het stoppen als het een fout ziet? Moet het beleefd spreken? Moet het controleren of het niet oneerlijk is voor verschillende mensen? Het artikel stelt dat, hoewel we veel praten over "AI-ethiek" in grote vergaderingen, het moeilijk is om die grote ideeën om te zetten in daadwerkelijke instructies die een machine kan volgen.

2. De Oplossing: Het "AGENTS.md"-bestand

De auteurs ontdekten dat ontwikkelaars beginnen met het aanmaken van speciale bestanden in hun codeprojecten die AGENTS.md heten (of vergelijkbare contextbestanden). Denk aan deze bestanden als de "Huishoudelijke Regels" die direct op het aanrecht in de keuken zijn geplakt, waar de robot werkt.

In plaats van alleen te zeggen "Wees eerlijk", schrijven ontwikkelaars specifieke, uitvoerbare commando's zoals:

  • Voor Eerlijkheid: "Gebruik bij het testen van namen een mix zoals 'Jan Jansen', 'José García' en '李明' om ervoor te zorgen dat het systeem mensen niet anders behandelt op basis van hun namen."
  • Voor Toon: "Geef geen morele lezingen of ongevraagde meningen. Doe gewoon je werk."
  • Voor Inclusiviteit: "Schrijf in eenvoudig Engels zodat niet-moedertaalsprekers het kunnen begrijpen."
  • Voor Duurzaamheid: "Gebruik minder data en batterijvermogen om het milieu te helpen."

3. Wat Ze Vonden (De "Voorlopige Onderzoek")

De onderzoekers keken naar een paar van deze bestanden (als een glimp opvangen in een paar verschillende huizen) en ontdekten dat ontwikkelaars dit al doen. Ze schrijven niet alleen abstracte filosofie; ze vertalen waarden naar machineleesbare regels.

  • Eerlijkheid wordt een specifiek testscript.
  • Verantwoordingsplicht wordt een regel om een mens aan het roer te houden van wijzigingen.
  • Inclusiviteit wordt een regel over welke woorden je moet gebruiken.

Het is alsof de ontwikkelaar zegt: "Ik wil niet alleen dat mijn robot eerlijk is; ik programmeer de robot om een eerlijkheidstest uit te voeren voordat het zijn werk afrondt."

4. De Grote Vragen (Het Onderzoeksrooster)

Het artikel beweert niet dat het alle antwoorden al heeft. In plaats daarvan suggereert het een nieuw pad voor onderzoek, met vragen zoals:

  • Luisteren de robots echt? Als we deze regels schrijven, volgen de robots ze dan, of negeren ze ze gewoon?
  • Wie bepaalt de regels? Als twee ontwikkelaars het oneens zijn over wat "eerlijk" betekent, hoe discussiëren ze er dan over in het bestand?
  • Veranderen de regels? Als een robot een fout maakt, updaten de ontwikkelaars dan de "Huishoudelijke Regels" om te voorkomen dat het opnieuw gebeurt?

De Conclusie

Dit artikel is een "visie"-stuk. Het zegt: "Kijk, ontwikkelaars proberen al AI-ethiek te leren door specifieke instructies in de codebestanden te schrijven."

De auteurs willen dat we deze praktijk bestuderen. Ze geloven dat als we willen begrijpen hoe AI in de echte wereld wordt bestuurd, we niet alleen naar grote wetten of abstracte theorieën moeten kijken. In plaats daarvan moeten we kijken naar deze kleine, alledaagse instructiebestanden waar ontwikkelaars eigenlijk proberen "goed te zijn" om te zetten in "goed doen" voor de robot.

Kortom: We gaan van het vertellen aan AI "Wees een goed mens" naar het geven van AI een specifieke checklist met "Goed Mens"-taken om af te vinken terwijl het werkt.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →