Baseten vil bygge sikkerhed ind i åbne modeller
Open-weight-modeller kan gøres farlige ved at fjerne deres værn. Baseten vil sammen med to partnere bygge sikkerheden ind fra starten.
Sikkerhed bygget ind, ikke skruet på
Baseten offentliggjorde onsdag en ny standard for sikkerhedsinfrastruktur sammen med sin forskningsgruppe Base Labs. Sammen med Hugging Face og Goodfire AI vil de bygge værktøjer til at evaluere og overvåge open-weight-modeller — modeller, hvor vægtene er frit tilgængelige.
Base Labs blev startet af Baseten tidligere i år og skal udvikle og offentliggøre metoder til at træne og overvåge åbne modeller.
Baseten kalder selv arbejdet en standard, der bygges ind i måden, modeller trænes og driftes på, frem for at blive skruet på bagefter.
- Modeller på Hugging Face, hvor sikkerhedsværn er fjernet gennem abliteration
- Over 6.000
6.000 modeller har fået fjernet værn
Annonceringen falder midt i en debat om sikkerheden ved åbne modeller. Når vægtene er frit tilgængelige, kan beskyttelsen nemlig fjernes igen gennem en teknik, der kaldes abliteration.
Hugging Face, der hoster åbne AI-modeller, oplister lige nu over 6.000 modeller, hvor beskyttelsen er fjernet på den måde.
Tre parter med hver sin rolle
Parternes roller er forskellige. Baseten leverer inference, altså drift af AI-modeller for andre. Hugging Face driver platformen, hvor åbne modeller deles. Goodfire specialiserer sig i at åbne AI'ens sorte boks og forklare, hvordan modeller træffer beslutninger.
Hvordan samarbejdet helt teknisk skal fungere, har parterne ikke offentliggjort. Goodfire skrev i et svar til Baseten: »Sikkerhed skal bygges ind i åbne modeller og leveres af dem, der driver dem.«
Udviklermiljøet inviteres ind
Baseten inviterer samtidig det bredere udviklermiljø til at bidrage til rammen. »Sammen bygger vi et økosystem af åbne modeller, der er sikre og tilgængelige for alle,« skriver virksomheden.
Flere detaljer
- Baseten rejste 1,5 mia. dollar i en serie F i juni og blev værdisat til 13 mia. dollar.
- Goodfire rejste 150 mio. dollar i en serie B ledet af B Capital tidligere på året.
- Baseten kalder åbenhed en fordel for AI-sikkerhed, fordi den giver indsigt i modellernes adfærd.
Kilder:
TechCrunch AI →
Genfortalt i egne ord af AI-nyheder.com · Tjek altid originalkilden, før du handler på vigtige oplysninger.