AI-nyheder
Forskning · arXiv cs.AI · 2026-07-29

LivingArena lader AI-modeller grille hinanden

Ny metode, LivingArena, lader AI-modeller quizze hinanden for at finde fejl og huller i viden.

To åbne laptops står ansigt til ansigt på et bord, skærmene viser spørgsmål og svar, mens en kaffekop står mellem dem.

Kolleger tester

Forskere har udviklet en ny måde at teste AI på: i stedet for at give modellen færdige spørgsmål, lader de to forskellige AI-systemer quizze hinanden. Den ene stiller spørgsmål om emner, den anden måske ikke kender. Det afslører blinde vinkler, som almindelige tests overser.

Ny svagheder fundet

Metoden, der kaldes peer-probing, fandt markant flere fejl end standardmetoder. Når én AI skulle udspørge en anden, kom der eksempler frem, hvor modeller var helt på vildspor – især i smalle fagområder. Det viser, at de store AI-systemer har flere huller end hidtil antaget.

Hvad betyder det for DIG?

Du får mere pålidelige AI-værktøjer uden at vente på dyre laboratorietests, fordi fremtidens modeller testes grundigere og billigere allerede i udviklingsfasen.

Detaljerne
Hvad betyder det for dig?
Du får mere pålidelige AI-værktøjer uden at vente på dyre laboratorietests.

Kilder:
arXiv cs.AI →

Læs dagens AI-nyheder på letlæst dansk →

Genfortalt i egne ord af AI-nyheder.com · AI-genereret illustration · Tjek altid originalkilden, før du handler på vigtige oplysninger.