arXiv-forskere giver AI dårlig samvittighed
Ny forskning fra arXiv lærer AI-agenter at føle 'skyld' og opføre sig mere hensynsfuldt over for hinanden.
Det nye trick
Forskere bag arXiv-studiet har fundet en måde at få AI til at tænke på konsekvenserne af sine handlinger. De kalder det 'kunstig skyld' – en slags indbygget dårlig samvittighed, der får systemet til at undgå at skade andre. Det er ikke rigtige følelser, men en smart belønningsmekanisme, der gør AI'en mere samarbejdsvillig.
Hvorfor det virker
Normalt træner man AI til at nå sit eget mål for enhver pris. Her belønner forskerne i stedet adfærd, der tager hensyn til andre agenter. Det gør, at AI'en lærer at dele, vente og hjælpe – selvom det betyder, at den selv får lidt mindre. Resultatet er systemer, der fungerer bedre i grupper, for eksempel i trafik eller lagerstyring.
Hvad nu?
Metoden er stadig på forsøgsstadiet, men den peger mod en fremtid, hvor AI ikke bare er effektiv, men også hensynsfuld. Det kan blive vigtigt, når flere robotter eller programmer skal arbejde side om side med mennesker. Næste skridt er at teste det i virkelige scenarier uden for laboratoriet.
- Forskningen er udgivet på arXiv og handler om multi-agent AI.
- Metoden kaldes 'neurally grounded reward shaping' og bruger skyld som styring.
- AI'en lærer at prioritere fælles bedste frem for egen vindings skyld.
- Forskerne bag er Aaditya Mehta og Arya Shah.
- Studiet er fra august 2026 og er et preprint under registrering.
Du får snart AI i din hverdag, der ikke kun tænker på sig selv – men på dig og andre. Det kan betyde færre konflikter og bedre samarbejde mellem maskiner og mennesker.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder