Matematiker kræver svar fra OpenAI
Endnu en matematiker beskylder OpenAI for uærlighed og manglende åbenhed om, hvorvidt hans arbejde er brugt til at træne selskabets AI-modeller.
Beskyldningen
Matematikeren Andreas Thom mener, at OpenAI har været uærlig og utydelig om, hvordan virksomheden bruger data fra brugere. Det skriver han i en række opslag på Mastodon. Ifølge Thom har OpenAI ikke svaret klart på, om samtaler, som han og kolleger har haft med ChatGPT, kan være endt i træningsdata. Det får ham til at beskylde selskabet for direkte at mangle vilje til at lægge kortene på bordet.
Det konkrete bevis
Sagen blussede op, efter at OpenAI sidste måned præsenterede 10 resultater, hvoraf ét handlede om såkaldte non-sofic groups – Thoms eget speciale. OpenAI indrømmede selv, at resultatet byggede tungt på forarbejde fra Thom og Gábor Kun, og virksomheden rettede i al stilhed sin tekst. Thom undrer sig over, at OpenAI kendte til netop deres metoder, som ikke var de mest oplagte. Efter hans henvendelse til OpenAI-forskerne Sébastien Bubeck og Mark Sellke fik han ifølge sig selv ikke svar på, om hans data var brugt.
Uklarheden fortsætter
OpenAI afviser blankt at have brugt specifikke brugerdata i forbindelse med et andet stort gennembrud, Millennium Prize-problemet om Navier-Stokes. Men selskabet vil ikke helt udelukke, at anonymiserede data fra brugerne kan have forbedret modellerne indirekte. Ifølge Thom er det en finurlig skelnen, der ikke ændrer det faktum, at anonymisering ikke fjerner den matematiske idé. Han kalder Sellkes svar for direkte uærligt.
Tilliden smuldrer
Flere matematikere frygter nu, at episoden vil gøre feltet mere hemmelighedsfuldt. Hvis et rygte om et gennembrud kan sætte en velresurseret techgigant som OpenAI i gang, vil forskere måske holde deres arbejde tæt til kroppen. Det kan gå ud over den åbenhed, der ellers kendetegner matematisk forskning. OpenAI har ikke svaret på The Verges henvendelse om sagen.
- Andreas Thom anklager OpenAI for at være uærlig om brugen af træningsdata.
- OpenAI præsenterede 10 matematiske resultater, herunder et om non-sofic groups.
- Resultatet byggede ifølge OpenAI tungt på arbejde fra Thom og Gábor Kun.
- OpenAI afviser at have brugt specifikke brugerdata til Millennium-problemet.
- Thom kalder anonymisering for utlistrækkelig, fordi den ikke fjerner matematisk indhold.
- Flere matematikere frygter øget hemmelighedskræmmeri i forskningsmiljøet.
Du kan ikke vide, om dine samtaler med ChatGPT ender i træningsdata – og det kan ifølge kritikere gøre det sværere for forskere at dele åbent med dig og omverdenen.
Kilder:
The Verge AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.
AI-nyheder