Forskere skaber test til at måle overmenneskelig AI
Forskere har udviklet en ny benchmark, der skal teste om AI kan overgå mennesker på næsten alle områder.
Det nye værktøj
Med titlen ASI-Bench har et stort forskerhold bag et nyt værktøj, der skal måle, hvor tæt AI er på det, de kalder kunstig superintelligens. Det er en slags avanceret test, der afprøver AI-systemernes evner på mange forskellige områder – fra matematik og logik til kreativ problemløsning og planlægning. Ideen er at rykke grænsen for, hvad vi hidtil har kunnet teste.
Sådan virker den
I stedet for at stille simple spørgsmål med rigtige eller forkerte svar, giver ASI-Bench opgaver, der ligner virkelige udfordringer. Den kræver, at AI både forstår komplekse sammenhænge, tænker flere skridt frem og kommer med brugbare løsninger. Testen er designet til at udfordre selv de bedste nuværende AI-systemer og bliver løbende opdateret, efterhånden som teknologien udvikler sig.
Forskernes håb
Forskerne håber, at værktøjet kan give os en tidlig advarsel, hvis AI bliver så dygtig, at den reelt overgår os på vigtige områder. Det giver os bedre mulighed for at få styr på sikkerheden, før det bliver nødvendigt. Benchmarken kan også hjælpe udviklere med at se, hvor deres egne modeller fejler og hvad de skal forbedre, lyder det fra forskerne bag.
- Forskergruppen bag har lanceret en benchmark kaldet ASI-Bench.
- Den tester AI inden for blandt andet matematik, logik og kreativitet.
- Opgaverne er komplekse og ligner virkelige udfordringer.
- Værktøjet skal tage temperaturen på AI-udviklingen.
- Forskerne håber, den kan styrke sikkerheden omkring kommende AI-systemer.
Du får dermed i fremtiden mulighed for at stole på, at AI-teknologier er blevet grundigt testet, før de bliver en del af din hverdag og letter dit arbejde.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder