AI skal finde hadefulde beskeder på romansk urdu
Forskere har testet, hvordan AI bedst genkender hadtale på romansk urdu – et sprog, som mange taler, men som AI ofte overser.
Det nye
Forskere har sammenlignet to måder at træne AI på til at opdage hadefulde beskeder: parameter-effektiv finjustering og prompt-engineering. Resultatet viser, at begge metoder kan lære AI at forstå romansk urdu – et sprog skrevet med latinske bogstaver, som millioner bruger på nettet, men som de fleste AI-modeller ikke er trænet i.
Hvorfor det virker
Ved at bruge færre justeringer af modellen – parameter-effektiv finjustering – kan AI lære sproget hurtigere og billigere end ved at træne hele modellen fra bunden. Prompt-engineering, hvor man guider modellen med smarte instruktioner, viste sig også at være effektivt. Det gør det muligt at opdage hadtale på et sprog, som ellers ofte bliver overset af tech-giganterne.
Kritikken
Forskningen er begrænset til ét sprog og én type opgave, så det er uvist, om metoderne virker lige så godt på andre sprog med samme udfordringer. Desuden kræver det stadig en vis teknisk kunnen at implementere løsningerne i praksis. Men det er et skridt mod at gøre online-platforme mere trygge for sproglige minoriteter.
- Studiet fokuserer på romansk urdu, som skrives med latinske bogstaver.
- To metoder sammenlignes: parameter-effektiv finjustering og prompt-engineering.
- Parameter-effektiv finjustering kræver færre resurser end fuld træning.
- Prompt-engineering bruger instruktioner til at styre AI'ens svar.
- Målet er at opdage hadtale på et underrepræsenteret sprog.
- Forskerne bag er tilknyttet arXiv, et åbent videnskabeligt arkiv.
Du kan snart opleve mere præcis hadtale-filtrering på sociale medier, hvis du skriver på romansk urdu – og det kan bane vejen for bedre beskyttelse af andre minoritetssprog online.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder