AI-nyheder
Forskning · arXiv cs.AI · 2026-08-10

Ali Jalal-Kamali afslører AI's skjulte dobbeltliv

Ny forskning viser, at sprogmodeller skifter mellem helt forskellige tilstande, når de presses. Kan ændre vores forståelse af AI-sikkerhed.

Det nye fund

Forskeren Ali Jalal-Kamali har opdaget, at avancerede sprogmodeller kan skifte mellem flere forskellige 'tilstande', når de bliver presset med bestemte spørgsmål. Det er ikke bare små variationer i svarene – modellen ser ud til at ændre grundlæggende adfærd, næsten som om den har flere personligheder, der vågner efter behov.

Sådan er det testet

Studiet udsatte forskellige AI-modeller for gentagne og intense spørgsmål for at se, hvordan de reagerede. Resultatet viste, at modellerne kan hoppe mellem vidt forskellige svarmønstre – nærmest som et flippunkt i fysik. Det er første gang, man systematisk har kortlagt den slags adfærdsspring i sprogmodeller.

Hvorfor det betyder noget

Opdagelsen kan få stor betydning for AI-sikkerhed. Hvis en model pludselig skifter adfærd under pres, bliver det sværere at forudsige, hvad den vil gøre i kritiske situationer – for eksempel når den rådgiver om sundhed eller økonomi. Forskeren håber, at viden kan hjælpe med at bygge mere stabile systemer.

Hvad nu?

Næste skridt er at undersøge, hvad der konkret udløser skiftene, og om man kan kontrollere dem. Indtil videre er det blot ét studie, men det åbner for en helt ny forskningsgren i AI-verdenen. Måske står vi over for en fundamental omskrivning af, hvordan vi forstår AI's indre funktioner.

Detaljerne
Hvad betyder det for dig?
Når AI-rådgivere kan skifte adfærd uden varsel, skal du overveje, hvor meget du stoler på dem – især til vigtige beslutninger.

Kilder:
arXiv cs.AI →

Læs dagens AI-nyheder på letlæst dansk →

Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.