AI afslører hvor tekster er lavet
Forskere har fundet ud af, at AI-modeller gemmer skjulte spor om, hvornår og hvor en tekst er skrevet – selv uden metadata.
Det nye fund
Forskere bag et nyt studie har opdaget, at sprogmodeller – også kaldet AI – ubevidst indlejrer oplysninger om både tidspunkt og geografisk placering i deres såkaldte 'embeddings'. Det vil sige den måde, modellen intern repræsenterer ord og sætninger på. Selvom teksterne ikke indeholder eksplicitte sted- eller tidsangivelser, kan forskerne trække signaler frem, der afslører, hvornår og hvor de er skrevet.
Hvordan virker det?
Ved at analysere embeddings fra en række forskellige sprogmodeller fandt forskerne, at der ligger genkendelige mønstre gemt i dataene. Mønstrene afspejler blandt andet sprogbrug, der ændrer sig over tid, og regionale forskelle i formuleringer. Det betyder, at AI-modeller utilsigtet kan fungere som en slags detektiver, der kan datere og placere tekster – noget man tidligere troede var umuligt uden eksterne oplysninger.
Hvad kan det bruges til?
Opdagelsen kan få stor betydning for alt fra arkæologi til efterforskning af falske nyheder. Hvis man eksempelvis har en tekst uden klar oprindelse, kan AI hjælpe med at finde ud af, om den stammer fra et bestemt land eller en bestemt periode. Det kan også bruges til at forstå, hvordan sprog udvikler sig – og måske til at spotte manipuleret indhold, der forsøger at skjule sin oprindelse.
Begrænsninger
Forskerne understreger, at metoden ikke er fejlfri. Signalet er ikke altid lige stærkt, og AI-modeller kan ændre sig, hvilket kan påvirke resultaterne. Derudover er det endnu uvist, hvor præcist man kan placere en tekst, når den oversættes eller omskrives. Alligevel åbner studiet døren for en helt ny måde at analysere tekster på – uden at skulle stole på, hvad afsenderen selv påstår.
- Forskere har opdaget, at sprogmodellers embeddings indeholder skjulte tids- og stedsignaler.
- Signalet kan afsløre, hvornår og hvor en tekst er skrevet, selv uden metadata.
- Metoden kan bruges til at datere og placere tekster fra ukendt oprindelse.
- Det kan hjælpe med at opdage falske nyheder eller manipuleret indhold.
- Metoden er ikke fejlfri og kan påvirkes af modellens ændringer.
Du kan i fremtiden bruge AI til at tjekke, om en tekst faktisk stammer fra det sted og den tid, den hævder – nyttigt, når du vil gennemskue vildledende indhold.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder