Du har sikkert hørt kunstig intelligens-modeller beskrevet som «åpne» eller «lukkede». Dette er ikke beskrivelser av modellens personlighet. Store språkmodeller av kunstig intelligens, som den under panseret til ChatGPT, har ikke faktiske personligheter, til tross for utseendet.
Etikettene refererer til om all informasjon om hvordan en AI-modell fungerer er offentlig tilgjengelig og modellen kan endres, eller om modellens utvikler holder dens indre virkemåte hemmelig og selve modellen privat eiendom.
Programvare med åpen kildekode
Konseptet med åpen kildekode-programvare oppsto i fri programvare-bevegelsen på 1980- og 90-tallet. Bevegelsens grunnleggere mente at programvareskapere og -brukere hadde rett til «fire friheter» – å kjøre programmet, å studere og modifisere det, å distribuere kopier av originalen og å distribuere kopier av senere modifiserte versjoner. Det grunnleggende kravet var at kildekoden – de grunnleggende instruksjonene – for et program skulle gjøres tilgjengelig.
På slutten av 1990-tallet skapte og promoterte programvareutviklere tilknyttet prosjekter som Netscape-nettleseren og Linux-operativsystemet begrepet «åpen kildekode» for å referere til disse idealene.
Som en del av den utviklende bevegelsen utviklet visse organisasjoner åpen kildekode-lisenser som spesifiserte hvordan en bestemt kildekode kunne brukes og distribueres, inkludert Gnu General Public License, Apache License, MIT License og Berkeley Software Distribution. Hver lisenstype spesifiserte også eventuelle begrensninger på hvordan programvarepatenter gjaldt kildekoden.
Åpen kildekode eller åpen vekt?
Ideen om åpen kildekode har blitt mer fremtredende de siste årene ettersom store språkmodeller for kunstig intelligens har økt kraftig, særlig OpenAIs ChatGPT, som ble utgitt i 2022. Utviklere trener først nye modeller på store datasett, og distribuerer deretter modellene for bruk av andre.
Åpen kildekode for kunstig intelligens forklares på to minutter.
Meta var et av de første store selskapene som lanserte en åpen kildekode-språkmodell for store selskaper, kalt LLaMa. Selskapet lanserte LLaMa 24. februar 2023 og gjorde kildekoden for «inferens» tilgjengelig – instruksjonene som kjører modellen. Og de lanserte de såkalte vektene, den kodede kunnskapen modellen lærte under trening. Åpen kildekode-organisasjoner som Open Source Initiative har imidlertid uttalt at retningslinjene for LLaMa-lisenser forbyr kommersiell gjenbruk, noe initiativet hevder ikke er virkelig åpen kildekode.
Andre selskaper har gitt ut «åpne vektmodeller», som DeepSeek fra DeepSeek AI og Qwen fra Alibaba. Modellene har mindre restriktive vilkår for gjenbruk, og AI-miljøet har tatt dem i bruk raskt. Likevel mener mange utviklere at en ekte åpen kildekode-AI-modell ikke bare må inkludere kildekoden og vektene, men også dataene som brukes til å trene modellen.
Mye å åpne opp
Open Source Initiatives definisjon av en fullstendig åpen kildekode-AI-modell inkluderer treningsdata som et nøkkelelement. Noen utviklere lurer imidlertid på hvor gjennomførbart det er å distribuere de enorme datasettene som kreves.
Jeffrey Young, ledende forsker, Partnership for an Advanced Computing Environment, Georgia Institute of Technology
Denne artikkelen er publisert på nytt fra The Conversation under en Creative Commons-lisens. Les den opprinnelige artikkelen.





