SODP logo

    Ano ang open-source AI? Paliwanag ng isang mananaliksik sa software engineering

    Malamang ay narinig mo na ang mga modelo ng artificial intelligence na inilarawan bilang "bukas" o "sarado." Hindi ito mga paglalarawan ng personalidad ng modelo. Ang mga AI ng malalaking modelo ng wika tulad ng nasa ilalim ng hood ng…
    Na-update Noong: Hulyo 28, 2026
    Jeffrey Young

    Nilikha Ni

    Jeffrey Young

    Ang Usapan

    Sinuri ang Katotohanan Ni

    Ang Usapan

    Jeffrey Young

    Inedit Ni

    Jeffrey Young

    Malamang ay narinig mo na ang mga modelo ng artificial intelligence na inilarawan bilang "bukas" o "sarado." Hindi ito mga paglalarawan ng personalidad ng modelo. Ang mga AI ng malalaking modelo ng wika tulad ng nasa ilalim ng hood ng ChatGPT ay walang aktwal na personalidad, sa kabila ng hitsura.

    Ang mga label ay tumutukoy kung ang lahat ng impormasyon tungkol sa kung paano gumagana ang isang modelo ng AI ay pampublikong makukuha at maaaring baguhin ang modelo, o kung pinapanatiling lihim ng developer ng modelo ang panloob na paggana nito at kung ang modelo mismo ay pribadong pag-aari.

    Open-source na software

    Ang konsepto ng open-source software ay nagmula sa kilusang malayang software noong dekada 1980 at 1990. Naniniwala ang mga tagapagtatag ng kilusan na ang mga tagalikha at gumagamit ng software ay may karapatan sa "apat na kalayaan" – ang patakbuhin ang programa, pag-aralan at baguhin ito, mamahagi ng mga kopya ng orihinal, at mamahagi ng mga kopya ng mga kasunod na binagong bersyon. Ang pangunahing kinakailangan ay ang source code – ang mga pangunahing tagubilin – para sa isang programa ay dapat na maging available.

    Noong huling bahagi ng dekada 1990, ang mga developer ng software na nauugnay sa mga proyektong tulad ng Netscape web browser at Linux operating system ay lumikha at nagtaguyod ng terminong "open source" upang tumukoy sa mga mithiing ito.

    Bilang bahagi ng umuusbong na kilusan, ang ilang organisasyon ay bumuo ng mga open-source na lisensya na tumutukoy kung paano maaaring gamitin at ipamahagi ang isang partikular na piraso ng source code, kabilang ang Gnu General Public License, Apache License, MIT License at ang Berkeley Software Distribution. Tinukoy din ng bawat uri ng lisensya ang anumang potensyal na mga paghihigpit sa kung paano inilalapat ang mga patent ng software sa source code.

    Open source o open weight?

    Ang ideya ng open-source ay muling sumikat sa mga nakaraang taon dahil sa pag-usbong ng mga modelo ng malalaking wika ng artificial intelligence, partikular na ang ChatGPT ng OpenAI, na inilabas noong 2022. Sinasanay muna ng mga developer ang mga bagong modelo sa malalaking dataset, pagkatapos ay inilalatag ang mga modelo para magamit ng ibang tao.

    Ang open-source artificial intelligence ay ipinaliwanag sa loob ng dalawang minuto.

    Ang Meta ay isa sa mga unang malalaking kumpanya na naglabas ng isang open-source na modelo ng malaking wika, na tinatawag na LLaMa. Inilabas ng kumpanya ang LLaMa noong Pebrero 24, 2023, at inilabas ang "inference" source code – ang mga tagubilin na nagpapatakbo sa modelo. At inilabas nito ang tinatawag na mga weight, ang naka-encode na kaalaman na natutunan ng modelo sa panahon ng pagsasanay. Gayunpaman, ipinahayag ng mga open-source na organisasyon tulad ng Open Source Initiative na ipinagbabawal ng mga alituntunin sa paglilisensya ng LLaMa ang komersyal na muling paggamit, na pinaninindigan ng inisyatibo na hindi tunay na open source.

    Naglabas na ang ibang mga kumpanyang mga modelong "open weight", tulad ng DeepSeek mula sa DeepSeek AI at Qwen mula sa Alibaba. Ang mga modelo ay may mga hindi gaanong mahigpit na termino para sa muling paggamit, at mabilis itong tinanggap ng komunidad ng AI. Gayunpaman, naniniwala ang maraming developer na ang isang tunay na open-source na modelo ng AI ay hindi lamang dapat kasama ang source code at mga timbang kundi pati na rin ang data na ginagamit upang sanayin ang modelo.

    Maraming dapat buksan

    Ang kahulugan ng Open Source Initiative sa isang ganap na open-source na modelo ng AI ay kinabibilangan ng data ng pagsasanay bilang isang mahalagang elemento. Gayunpaman, nagtataka ang ilang developer kung gaano ka-posibleng ipamahagi ang napakalaking dataset na kinakailangan.

    Jeffrey Young, Punong Siyentipiko ng Pananaliksik, Pakikipagtulungan para sa isang Maunlad na Kapaligiran sa Pag-compute, Georgia Institute of Technology.

    Ang artikulong ito ay muling inilathala mula sa The Conversation sa ilalim ng lisensyang Creative Commons. Basahin ang orihinal na artikulo.

    0
    Gusto ko sana ng mga saloobin ninyo, magkomento po kayo.x
    ()
    x