Internal Information Decomposition splitter data
Forskeres metode Internal Information Decomposition deler AI's data op for at forhindre hackere i at udnytte modeller.
Problemet med blandede data
Mange moderne AI-modeller kan både forstå tekst, billeder og lyd. Men den evne gør dem også sårbare: Hackere kan snyde systemet ved at ændre et enkelt element, som et billede, og få modellen til at opføre sig uhensigtsmæssigt. Det kaldes et 'multimodalt angreb'.
Sådan virker metoden
Forskerne bag den nye metode deler AI'ens interne data op i lag, så information fra tekst og billeder holdes adskilt. Hvis et angreb rammer billeddelen, kan systemet isolere skaden og alarmerer. Dermed kan AI'en fortsætte med at arbejde sikkert på den uramte del.
Hvad betyder det for dig?
Metoden kan gøre fremtidens AI mere robust i hverdagen. Tænk på selvkørende biler, der både skal aflæse skilte og vejbaner, eller på chatrobotter, der også analyserer uploadede billeder. Med den nye teknik bliver det sværere for ondsindede aktører at manipulere systemerne.
- Metoden hedder 'Internal Information Decomposition' og er udviklet af forskere tilknyttet arXiv.
- Den beskytter AI-modeller mod angreb, der udnytter flere datatyper på én gang.
- Ved at adskille information internt kan systemet opdage og isolere et angreb.
- Teknikken kræver ikke ændringer af den underliggende AI-model, kun af hvordan data behandles.
- Test viser, at metoden reducerer succesraten for angreb markant.
Du kan fremover stole mere på AI-systemer, der håndterer både billeder og tekst, fordi angreb kan fanges og stoppes, før de gør skade.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.