Forskere lærer AI at holde øje med sig selv
AI-agenter, der selv browser på nettet, kan begå fejl. Nu har forskere fundet en metode til at opdage dem uden at kigge ind i systemet.
Det nye trick
Forskere har udviklet en metode, der kan overvåge AI-agenter, mens de arbejder på internettet. I stedet for at skulle have adgang til skjulte signaler inde i AI'en, kigger de på de synlige handlinger, agenten udfører. Det gør det muligt at opdage fejl og mærkelig adfærd, uden at man skal kunne se hele AI'ens indre.
Sådan virker det
Metoden bruger nøglepunkter i AI'ens opgaveløsning. Ved at holde øje med, om den laver de rigtige mellemtrin, kan systemet se, om noget går galt. Testene viser, at metoderne kan opdage fejl med stor sikkerhed.
Hvad betyder det
Metoden kan gøre det lettere at bruge AI-agenter i virkeligheden, fordi man kan se, om de opfører sig ordentligt. Det kan hjælpe med at undgå fejl, når AI'en for eksempel booker rejser eller handler online.
- Forskerne foreslår at overvåge AI-agenter via observerbar adfærd.
- Metoden kræver ikke adgang til interne signaler.
- Nøgletrin bruges til at identificere fejl undervejs.
- Det testede system kunne finde fejl, selvom noget gik skjult.
- AI-agenter bruges blandt andet til automatiske webopgaver.
Du får mere tryghed, når AI-agenter udfører opgaver for dig online, fordi forskerne nu kan fange fejl tidligere.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder