Forskere lærer AI at pege på det, den taler om
Ny metode får AI til at forbinde tekst med præcise områder i billeder. Det gør dialog om billeder mere præcis.
Det nye trick
Forskere har udviklet en metode, der hedder Prompt-Region Grounding. Den gør, at AI ikke bare fortæller, hvad den ser – den kan også markere helt præcise områder i et billede, når den får et spørgsmål. Det er som om, AI'en pludselig får en laserpointer.
Hvorfor det virker
De fleste AI-modeller er gode til at beskrive billeder, men de kan ikke vise, præcis hvilke pixels de taler om. Den nye metode træner AI'en til at lave den forbindelse. Det betyder, at den kan svare mere nøjagtigt, når du eksempelvis spørger: 'Hvad er der i hjørnet?'
Hvad betyder det for dig
Forestil dig, at du bruger en AI til at finde en bestemt ting på et foto – eller hjælpe med at læse et diagram. Med denne metode kan AI'en pege på det, den mener. Du kan stole mere på svaret, fordi du kan se, hvor det kommer fra. Det gør AI mere brugbar i hverdagen.
- Ny metode: Prompt-Region Grounding for multimodal ræsonnering.
- Får AI til at koble tekst med områder i billeder.
- Testet på billeder med spørgsmål om indhold.
- Metoden kan bruges til at forbedre AI-svar i praksis.
- Forskningen er uploadet til arXiv, et åbent forskningsnetværk.
Når du spørger en AI om ting i billeder, kan du nu få svar, hvor den viser dig, hvad den mener – det gør dialogen mere sikker og brugbar i din hverdag.
Kilder:
arXiv cs.AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder