Forskere vil styre AI med usynlige grænser
Nyt forskningssystem holder AI-agenter i skak med klare regler og fuld kontrol. Det kan forhindre dyre fejl.
Det nye system
Forskere har bygget et system, der løbende overvåger AI-agenter, mens de arbejder. Det sætter grænser for, hvilke handlinger AI'en må tage, og registrerer alt, hvad den laver. Hvis en handling er forbudt, bliver den standset med det samme – systemet lukker ned i stedet for at lade fejlen ske.
Sikkerheden bag
Systemet bruger to vigtige teknikker. Først gemmer det dokumentation for alle handlinger, så man kan se, hvad AI'en har lavet. Dernæst lukker det helt ned, hvis noget ser forkert ud. Det kaldes fail-closed. På den måde kan systemet ikke bare overse en fejl – den bliver aktivt stoppet.
Hvorfor det rager dig
AI-agenter bruges allerede i kundeservice, netbutikker og bankverdenen. Når de handler på egne vegne, kan de lave fejl – for eksempel sende forkerte mails eller ændre ordrer. Dette system skal forhindre den slags uheld, så du ikke rammes af AI-fejl, der koster tid eller penge.
- Systemet holder øje med AI-agenter i realtid og sætter klare grænser.
- Alle handlinger gemmes som dokumentation for, hvad AI'en har lavet.
- Ved forbudte handlinger lukker systemet helt ned – ingen risiko for fejl.
- Teknikken kaldes fail-closed, fordi den altid stopper ved usikkerhed.
- Arbejdet er beskrevet af forsker Adam Mazzocchetti på arXiv.
- Systemet kan bruges i kundeservice, netbutikker og banksektoren.
Du får beskyttelse mod, at AI-agenter i fx kundeservice eller netbutikker begår fejl med økonomiske konsekvenser for dig – de bliver stoppet i tide.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder