Microsoft-dokument advarede om 'doom loop'

Nye retsdokumenter i New York Times-sagen viser, at OpenAI og Microsoft internt vidste, at AI-svar kan skade nettet og udhule indtjeningen for udgivere.
Nye dokumenter afslører intern advarsel
I New York Times' sag mod OpenAI og Microsoft er nyligt offentliggjorte retsdokumenter kommet frem. The Verge har gennemgået den 92 sider lange indgivelse. Ifølge dokumentet advarede Microsofts egen dokumentation om, at selskabernes AI-strategi havde startet en 'doom loop', der kunne skade både modellerne og hele nettet.
Et internt Microsoft-dokument beskriver det som usædvanligt, at et slutprodukt truer de økonomiske fundamenter hos sine leverandører af indhold.
- Omfanget af den retsindgivelse, The Verge gennemgår
- 92 sider
- OpenAI-eksperters skøn for muligt fald i søgehenvisninger, ifølge dokumentet
- Op til 60 procent
Microsoft tager afstand fra Hecht
Mange markante citater kommer fra Brent Hecht, Director of Applied Science i Microsoft. Han kalder ifølge dokumentet indsamlingen af data til træning for 'the largest theft of labor in human history' og mener, at Microsofts forsvar gør 'a complete mockery' af fair use.
Microsofts talsmand Alex Haurek siger til The Verge, at udtalelserne er én medarbejders individuelle holdning, ikke en juridisk analyse og ikke selskabets syn. Jordan Usdan, GM for Data Strategy and Ops at Microsoft AI, beskriver Hechts rolle som adversariel.
ChatGPT kunne gentage artikler ordret
Internt var OpenAI ifølge dokumentet klar over, at ChatGPT kunne gengive ophavsretligt materiale 'verbatim'. Ansatte erkendte, at GPT-4 havde 'memorized a ton of data and therefore will be insanely good at regurgitation', mens forebyggelse af memorering var vigtig for at mindske krænkelser.
Dokumentet citerer eksempler på lange passager fra artikler i blandt andet New York Times, Mercury News, The Denver Post, LifeHacker og Eurogamer.
Chatbots fjerner klikket til kilden
Satya Nadella indrømmer ifølge dokumentet, at chatbots i praksis har erstattet søgning og fjernet behovet for at gå direkte til kilden. OpenAI-medarbejderen Nick Turley er citeret for, at der efter et svar fra chatbot'en ikke er 'no good reason to click' på kildelinket.
OpenAIs egne medie- og økonomieksperter kæder ifølge The Verge faldet i henvisningstrafik for sider som Times sammen med AI-oversigter som Googles AI Overviews. De har spekuleret i, at søgehenvisninger kan være faldet med op mod 60 procent.
Flere detaljer
- OpenAI-medgrundlægger Greg Brockman var ifølge dokumentet optaget af de 'gazillions' af dollars, kommerciel AI kunne indbringe.
- Microsoft indrømmede, at næsten ingen havde tænkt sig, at deres indhold blev brugt sådan, eller blev kompenseret.
- Nadella er citeret for, at betalingsmurindhold bør licenseres; en OpenAI-repræsentant kendte ikke til forsøg på at fjerne det fra træningsdata.
- Microsoft: Store sprogmodeller ødelægger deres egen forsyningskæde ved at kunne erstatte træningsdata.
Kilder:
The Verge AI → Ars Technica AI → TechCrunch AI →
Genfortalt i egne ord af AI-nyheder.com · AI-genereret illustration · Tjek altid originalkilden, før du handler på vigtige oplysninger.