Dual-Flow Transformers: Ny metode deler arbejdet i to spor
Forskere har fundet en måde at gøre store sprogmodeller hurtigere ved at adskille to arbejdsgange i AI'en. Det kan mærkes i hverdagen.
Opdagelsen
Forskere har opdaget, at AI-modeller kan deles i to separate spor: ét til at forstå din prompt og ét til at generere svar. Ved at adskille dem kan modellen arbejde mere effektivt og hurtigere. Det lyder teknisk, men betyder i praksis, at din AI-assistent kan svare dig uden at skulle vente på al forberedelsen.
Sådan virker det
Normalt laver AI'en to opgaver på samme tid: Den læser og behandler din tekst, og den genererer svaret, mens den læser. Det er som at lave mad og opvask samtidig i samme håndvask. Den nye metode giver hver opgave sin egen vej, så forberedelsen ikke blander sig med selve svaret.
Hvad det betyder for dig
Du kender måske irritationen ved at vente på et svar fra en AI-chat. Med denne teknik kan svarene komme hurtigere, især når du skriver lange beskeder eller stiller komplekse spørgsmål. For virksomheder betyder det også lavere omkostninger, fordi AI'en ikke skal bruge ekstra krudt på at lave tingene dobbelt.
- Forskere har præsenteret en ny metode kaldet 'Dual-Flow Transformers' på arXiv.
- Metoden adskiller forberedelsen af input fra genereringen af output.
- Det kan gøre AI-svar hurtigere, især for lange og komplekse forespørgsler.
- Virksomheder kan spare ressourcer, fordi AI'en ikke længere gentager arbejde.
- Teknikken er relevant for alle typer store sprogmodeller, ikke kun én.
- Forskerne bag er Liming Liu, Mingze Wang og Tuo Zhao.
Du får hurtigere og billigere AI-svar, når du chatter med en bot eller bruger værktøjer, der bygger på store sprogmodeller. Dit næste svar kan komme øjeblikkeligt, selv på lange beskeder.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder