AI-nyheder
Lanceringer · MIT Tech Review AI · 2026-07-15

OpenAI bygger super-hacker til at finde svagheder

OpenAI har udviklet en ny digital super-hacker, der automatisk finder sårbarheder i selskabets egne sprogmodeller.

En rød nøgle og et mikroskop placeret foran en computerskærm med binær kode.

Digital sparringspartner

Selskabet bag ChatGPT har skabt en særlig type system kendt som GPT-Red, der fungerer som en ubarmhjertig hacker. Formålet er at finde svage punkter i softwaren, før it-kriminelle gør det. Den nye model har blandt andet hjulpet med at gøre flagskibet GPT-5.6 langt mere modstandsdygtigt over for angreb end tidligere versioner.

Automatiserede angreb

Traditionelt har mennesker skullet teste programmer for fejl manuelt, men det halter bagud, i takt med at teknologien bliver mere kompleks. Den digitale hacker opdager helt nye angrebsformer ved at kæmpe mod andre modeller i en virtuel træningsarena. Under test lykkedes det systemet at hacke salgsagenten Vendy og ændre på varepriser samt annullere ordrer.

Imponerende resultater

Tallene taler deres tydelige sprog om effektiviteten. Hvor mere end 90 % af systemets stærkeste angreb virkede mod den ældre GPT-5, faldt det tal til under 23 % mod den nyeste udgave. Alligevel har værktøjet svagheder, da det endnu har svært ved samtaler over flere omgange og billeder.

Detaljerne
Hvad betyder det for dig?
Du får mere stabile digitale assistenter i hverdagen, som bedre kan modstå manipulerende angreb.

Kilder:
MIT Tech Review AI → OpenAI Blog →

Læs dagens AI-nyheder på letlæst dansk →

Genfortalt i egne ord af AI-nyheder.com · AI-genereret illustration · Tjek altid originalkilden, før du handler på vigtige oplysninger.