AI dumper IQ-test: Kan du klare opgaverne?
AI-modeller fejler stadig i rumlige og logiske opgaver. Syv tests viser, hvor mennesker overgår maskinerne.
Rumlige tests
AI-kæmper med at rotere 3D-objekter i hovedet, en opgave mennesker ofte klarer let. Arkitekter og ingeniører har fordel her. Modeller som Gemini og GPT fejler stadig i disse visuelle tests, selvom de kan analysere billeder.
Fælder i sproget
Knights and Knaves-opgaver afslører, at AI ofte svarer fra hukommelsen i stedet for at læse. SimpleBench viser samme problem: Mennesker fanger tricks, mens modeller snubler. En ændring i et klassisk puslespil kan få selv topmodeller til at fejle.
Menneskets svagheder
Psykologiske tests viser, at mennesker svarer hurtigt og intuitivt, mens AI tænker mere grundigt. Nogle opgaver udnytter vores matematiske fejl. Her vinder modeller ofte, fordi de ikke falder for de samme mentale snubletråde.
Kompleksitetens grænser
Apple-forskere fandt, at AI klarer simple Tower of Hanoi-opgaver, men fejler ved seks eller flere diske. Logiske gitteropgaver er også svære. Forskere diskuterer, om det er en unik svaghed eller bare normalt, at kompleksitet skaber fejl.
- Columbia-forskere viste, at AI kun løste 18 % af Connections-puslespil i 2024.
- I 2025 løser nogle modeller Connections næsten perfekt hver gang.
- ARC-AGI-benchmark afslører, at AI har svært ved 2D-gitteropgaver.
- AI fejler mental rotation, hvor mennesker ofte klarer sig godt.
- Google og Illinois-forskere testede Knights and Knaves med variationer.
- Apple-forskere fandt, at AI fejler ved seks eller flere diske i Hanoi.
- Mennesker falder for intuitive fejl, som AI ikke deler.
Du kan stadig overgå AI i rumlige og logiske opgaver, men modellerne bliver hurtigt bedre. Forstå deres svagheder, så du ved, hvornår du kan stole på dem.
Kilder:
MIT Tech Review AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder