XAI-Arena: LLM'er bedømmer AI-forklaringer
Forskere har offentliggjort XAI-Arena på arXiv, hvor sprogmodeller skal vurdere kvaliteten af AI-forklaringer.
Det nye spørgsmål
Forskere bag en ny videnskabelig artikel spørger, om store sprogmodeller – de såkaldte LLM'er – kan vurdere, hvor gode AI-forklaringer egentlig er. Det er et helt nyt spørgsmål, for hidtil har det typisk været mennesker, der skulle bedømme den slags. Artiklen undersøger altså, om LLM'er kan bruges som dommere i stedet for mennesker. Det kan potentielt gøre det lettere at teste og sammenligne forklaringer i stor skala.
Sådan virker arenaen
XAI-Arena er en slags konkurrenceplatform, hvor LLM'er skal vurdere kvaliteten af forklaringer, som andre AI-modeller giver. Det svarer til at lade AI'er dyste om at forklare sig bedst muligt, mens en anden AI bedømmer dem. På den måde kan man hurtigt sammenligne mange forklaringer uden at skulle trække masser af mennesker ind. Arenaen er dog kun lige blevet præsenteret i artikeln, så resultaterne er endnu ikke offentliggjort.
Hvorfor det er vigtigt
Når AI'er bruges til at vurdere andre AI'er, kan det måske spare både tid og penge på at teste forklaringer. Men det rejser også et kritisk spørgsmål: Kan vi stole på, at en AI er en retfærdig dommer over for en anden AI? Artiklen er et første skridt mod at finde ud af, om den tilgang holder i praksis. For almindelige mennesker kan det på sigt betyde mere gennemsigtige AI-systemer, hvis metoden viser sig at virke.
- Forskere har offentliggjort en artikel om XAI-Arena på arXiv.
- Arenaen skal lade store sprogmodeller vurdere kvaliteten af AI-forklaringer.
- Det er endnu uvist, hvor godt LLM'er klarer den opgave.
- Metoden kan potentielt gøre det billigere at teste AI-forklaringer.
- Artiklen er skrevet af Yanfei Hu Fleischhauer, Alona Zharova, Nadja Klein og Stefan Feuerriegel.
Hvis forskerne lykkes, kan det på sigt give dig mere gennemsigtige AI-systemer uden at skulle trække masser af menneskelige bedømmere ind.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder