Ny metode får AI til at indrømme usikkerhed
Forskere har fundet en måde at få sprogmodeller til at svare mere ærligt ved testtid – uden ekstra træning. Metoden fjerner dele af spørgsmålet for at afsløre usikkerhed.
Det nye trick
Når du stiller et spørgsmål til en AI-chatbot, svarer den ofte med selvsikkerhed, selv når den gætter. Et forskerhold har udviklet en metode, der får modellen til at vise sin usikkerhed ved at fjerne dele af spørgsmålet og se, om svaret ændrer sig markant. Hvis ja, er modellen ikke sikker.
Hvad kan det bruges til?
Metoden kan bruges i praksis, hvor AI skal være pålidelig – for eksempel i sundhedsrådgivning eller juridisk hjælp. I stedet for at give et forkert svar med høj selvtillid, kan systemet sige 'jeg er ikke sikker' eller bede om flere oplysninger. Det gør teknologien mere troværdig i hverdagen.
Forskellen fra tidligere
Tidligere løsninger krævede, at modellen blev trænet om eller havde adgang til intern logik. Den nye tilgang arbejder udelukkende ved testtid, hvilket betyder, at den kan anvendes på eksisterende modeller uden at ændre deres grundtræning. Det gør den billigere og hurtigere at implementere.
- Forskere viser, at fjernelse af spørgsmålsdele afslører usikkerhed.
- Metoden kræver ingen ekstra træning af AI-modellen.
- Den kan bruges på alle eksisterende sprogmodeller ved testtid.
- Teknikken vurderer svarændringer for at måle pålidelighed.
- Relevante for områder som sundhed og jura, hvor fejl er dyre.
Fremover kan AI-chatbots blive bedre til at sige 'ved ikke' i stedet for at lyve selvsikkert – især når du søger svar om helbred eller rettigheder.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder