AI-nyheder
Forskning · Hacker News: AI · 2026-09-04

Claude Opus 5 topper design-test

Testen EEBench V1 måler AI-modellers evne til at designe elektronik. Claude Opus 5 klarer sig bedst med 61,6 procent.

Det er sket

OpenAI viste for nylig GPT-6 Astra arbejde i et kredsløbsprogram, men hvor gode er AI-modeller egentlig til elektronik? Et nyt benchmark kaldet EEBench sætter dem på prøve. I stedet for at tegne i grafiske værktøjer skal modellerne løse opgaver i kode, hvilket minder mere om rigtigt ingeniørarbejde.

Resultaterne

Testen viser, at Claude Opus 5 scorer 61,6 % over 13 opgaver. Grok 4.6 kommer tæt efter med 57,1 %, og Claude Fable 5.1 opnår 56,4 %. GPT-5.5 klarer sig noget dårligere med 42,3 %. Ifølge skaberne ville de ikke have troet, at modellerne ville klare sig så godt for få måneder siden.

Hvad måler testen?

EEBench tester ikke kun, om modellen kan finde de rigtige komponenter. Den simulerer også strømsvigt og måler, om kredsløbet holder sig inden for grænserne. Eksempelvis skal en elforsyning holde processoren kørende i 20 millisekunder, hvis strømmen forsvinder. Kun designs der overholder specifikationerne og er økonomiske, får point.

Hvad nu?

OpenAI's GPT-6 Astra er endnu ikke testet, men forskerne er nysgerrige efter at se, hvordan den klarer sig. Testen kan også bruges til at træne AI-modeller bedre, da fejl i designs kan bruges som læringssignal. Det kan gøre fremtidige modeller bedre til elektronikdesign.

Detaljerne
Hvad betyder det for dig?
Du kan snart få AI til at designe elektronik, der faktisk virker i virkeligheden - med de rette komponenter og strømforbrug. Det kan gøre udvikling af alt fra hjemmeelektronik til elbiler hurtigere og billigere.

Kilder:
Hacker News: AI →

Læs dagens AI-nyheder på letlæst dansk →

Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.