Jan Kulveit: AI-test skal tænke på mennesker
Ny forskning fra Jan Kulveit viser, at AI-evalueringer glemmer menneskets rolle. Det gør dem mindre brugbare i praksis.
Problemet
Forskerne bag studiet, anført af Jan Kulveit fra arXiv, peger på, at AI-evalueringer ofte kun måler, hvor godt modellen klarer sig i isolerede tests. De glemmer, at AI i virkeligheden altid arbejder sammen med mennesker. Det giver skæve resultater, når man skal vurdere, om en AI faktisk hjælper i hverdagen.
Den nye vinkel
I stedet for kun at se på AI'ens egne præstationer vil forskerne inddrage mennesket i selve evalueringen. Det betyder, at tests skal foregå i samarbejde med rigtige brugere, så man fanger, hvordan teknologien fungerer, når den skal bruges af mennesker med forskellige behov og forventninger.
Hvad nu?
Studiet er et oplæg til at ændre måden, man udvikler og tester AI på. Hvis det bliver standard, kan vi få AI-systemer, der er bedre tilpasset virkelige situationer – eksempelvis i sundhedssektoren eller kundeservice. Det kan betyde færre fejl og mere brugervenlige løsninger.
- Forskere foreslår at inkludere mennesker i AI-evalueringer.
- Traditionelle tests måler kun AI'ens isolerede evner.
- Målet er at få AI til at fungere bedre sammen med brugere.
- Studiet er offentliggjort på arXiv.
Når du bruger AI i hverdagen, bliver den vurderet på, hvordan den klarer opgaven alene. Med den nye tilgang kan du forvente AI, der er testet og forbedret til faktisk at hjælpe dig bedre.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder