Ny AI-teknik: ChatGPT får styr på flertrins-opgaver
Forskere træner AI i at lægge planer for lange opgaver – det giver færre fejl og bedre resultater i samtaler med flere trin.
Det nye
Forskere bag forskningspapiret PlanPO har fundet en måde at lære AI-modeller at tænke i planer, før de svarer. I stedet for at gætte sig frem opdeler modellen opgaven i delmål. Det gør en kæmpe forskel, når opgaven kræver flere skridt – som at booke en rejse eller planlægge en uge.
Sådan virker det
Metoden hedder PlanPO og træner AI'en i at lave en gruppe-plan for hver opgave. Modellen lærer at overveje flere handlemuligheder og vælge den bedste. Det minder om, hvordan mennesker laver en huskeliste, før de går i gang. Teknikken forbedrer modellens evne til at holde styr på komplekse samtaler.
Hvad betyder det
For almindelige brugere kan det betyde, at AI-assistenter bliver bedre til at hjælpe med opgaver, der kræver flere trin. Forestil dig at skulle planlægge en fødselsdagsfest med invitationer, mad og aktiviteter – i dag kan AI nemt glemme noget undervejs. Med PlanPO holder den styr på hele planen.
Fremtiden
Forskerne håber, at metoden kan bruges i de AI-modeller, vi allerede bruger. Det kan give mere pålidelige assistenter, der ikke mister tråden midt i en lang samtale. Næste skridt er at teste metoden på endnu større og mere komplekse opgaver.
- PlanPO står for Group Planning-Aware Policy Optimization.
- Metoden træner AI i at lave planer for flertrins-opgaver.
- Forskningen kommer fra arXiv og er skrevet af Dayang Liang og kolleger.
- Den forbedrer AI'ens evne til at håndtere lange samtaler uden at miste fokus.
- Metoden kan gøre AI-assistenter mere pålidelige i hverdagsopgaver.
Du får mere pålidelige AI-assistenter, der kan klare lange opgaver uden at rode rundt – det sparer dig tid og frustration.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder