System AI jest uznawany za open-source, gdy jest dostarczany na warunkach spelniajacych cztery wolnosci OSAID oraz gdy udostepniona jest preferowana forma do modyfikacji: (a) informacje o danych treningowych wystarczajace, by kompetentna osoba mogla odtworzyc podobny system, (b) pelny kod zrodlowy uzyty do trenowania i uruchamiania modelu na licencji zatwierdzonej przez OSI, (c) parametry modelu (wagi) na otwartych warunkach. Licencje musza zezwalac na komercyjne i niekomercyjne uzycie, tworzenie i dystrybucje pochodnych oraz nie moga dyskryminowac osob, grup ani zastosowan. Zgodnosc ocenia sie wzgledem tych kryteriow, a nie wylacznie faktu opublikowania wag.
Wiele modeli reklamowanych jako 'otwarte' udostepnia tylko wagi, bez kodu i danych, co uniemozliwia pelne badanie, audyt i odtworzenie systemu ('open-washing'). Open-source AI definiuje jasne kryteria, kiedy system AI jest naprawde otwarty, i chroni wolnosci uzytkownikow.
Opis pochodzenia, zbierania i etykietowania danych treningowych, w tym charakterystyka danych niemozliwych do udostepnienia.
Kompletny kod przetwarzania danych, treningu, walidacji i inferencji na licencji zatwierdzonej przez OSI.
Wagi modelu i ustawienia konfiguracyjne udostepnione na otwartych warunkach.
Warunki prawne gwarantujace cztery wolnosci: uzywanie, badanie, modyfikowanie i dzielenie sie, bez dyskryminacji zastosowan.
Oficjalna
Reklamowanie modelu jako 'open source' przy udostepnieniu wylacznie wag (open-weight), bez kodu i informacji o danych.
Dane treningowe czesto podlegaja prawom autorskim lub prywatnosci i nie moga byc w pelni udostepnione.
Open Source Initiative sformalizowala definicje open source dla oprogramowania - fundament pozniej rozszerzony na AI.
OSI opublikowala w pazdzierniku 2024 pierwsza formalna definicje open-source AI, ustanawiajac cztery wolnosci i wymog udostepnienia wag, kodu oraz informacji o danych.