Ny AI-metode vurderer forskningsideer bedre end ChatGPT
Forskere har fundet en ny måde at få AI til at rangere videnskabelige hypoteser. Metoden er mere præcis end at spørge ChatGPT direkte.
Det nye trick
Forskere fra universitetet bag artiklen har opdaget, at AI-modeller kan vurdere videnskabelige hypoteser bedre, hvis man kigger på modellens indre usikkerhed frem for at få et direkte svar. De kalder metoden 'logit-baseret energiscoring'. I stedet for at spørge AI'en 'er denne hypotese god?', måler de, hvor overrasket modellen er over hypotesen. Det giver et mere pålideligt billede af kvaliteten.
Sådan virker det
Når en AI læser en hypotese, beregner den en 'energi'-score baseret på, hvor sandsynlige ordene er. En god hypotese får en lavere energi, fordi modellen genkender den som velformuleret og logisk. Metoden kræver ikke ekstra træning eller store computerressourcer. Forskerne testede den på flere videnskabelige datasæt og sammenlignede med den klassiske metode, hvor man beder AI'en om at bedømme hypotesen direkte.
Hvad kan det bruges til?
For forskere betyder det, at de kan få hjælp til at prioritere, hvilke hypoteser der er værd at undersøge nærmere. Især når man har mange idéer og begrænset tid. Metoden kan også bruges i andre sammenhænge, hvor AI skal sortere i store mængder tekst. Det er et skridt mod mere pålidelig AI-assisteret forskning.
- Forskerne foreslår en ny metode kaldet logit-baseret energiscoring.
- Metoden måler AI-modellens indre usikkerhed i stedet for at spørge direkte.
- Den nye metode klarer sig bedre end den klassiske 'prompted LLM-as-judge'-tilgang.
- Testene blev udført på videnskabelige hypoteser fra flere forskellige datasæt.
- Metoden kræver ingen ekstra træning eller tunge computerressourcer.
- Forskerne bag artiklen kommer fra miljøet omkring arXiv og offentliggjorde resultaterne i 2026.
Du kan snart opleve, at AI-værktøjer til forskning og idéudvikling bliver markant bedre til at sortere gode fra dårlige forslag – uden at du behøver at stole blindt på modellens egne vurderinger.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder