„Atvirojo kodo programinė įranga buvo viena didžiausių technologijų sėkmės istorijų. Todėl nenuostabu, kad atvirojo kodo dirbtinio intelekto modelių kūrėjai bando pasiskolinti šiek tiek atvirojo kodo saulės spindulių. Tačiau šie du požiūriai nėra tas pats.
„Meta Platforms“ vadovas Markas Zuckerbergas pirmadienį tapo naujausiu technologijų vadovu, nubrėžusiu lygiavertiškumą tarp šių dviejų modelių, 6500 žodžių rašinyje atvirojo kodo modelius pavadindamas „atvirojo kodo dirbtiniu intelektu“. Tokie modeliai yra svarbūs JAV nacionaliniam saugumui, sakė jis ir pridūrė, kad „Meta“ po pertraukos išleis daugiau „atvirojo kodo“ modelių. „Meta“, pasak jo, „tvirtai remia atvirojo kodo, įskaitant atvirojo kodo dirbtinio intelekto modelius“.
Štai problema: nė vienas iš modelių, apie kuriuos kalba Zuckerbergas, iš tikrųjų nėra atvirojo kodo.
Atvirasis kodas reiškia šaltinio kodą, kuris yra visiškai prieinamas visiems, kad jį galėtų perimti, naudoti ar modifikuoti. Programinę įrangą naudojančių žmonių bendruomenė gali siūlyti pakeitimus, kurie ją pagerintų. Jei atvirojo kodo projekto prižiūrėtojai juos priima, jie įtraukiami į kodą.
Šis modelis ypač gerai veikia tais atvejais, kai daugeliui žmonių reikia programinės įrangos, tačiau tokia programinė įranga jų neišskiria iš konkurentų. Pavyzdžiui, interneto skaičiavimo infrastruktūra dažniausiai naudoja atvirojo kodo „Linux“ operacinę sistemą. Tai taupo laiką ir pinigus tinklo operatoriams, kurie nenori arba jiems nereikia operacinės sistemos su daugybe funkcijų. Jie mieliau sutelkia dėmesį į kitus dalykus.
Atvirojo svorių modeliai nėra tokie atviri ir neatlieka tos pačios filosofinės paskirties.
Naudodama atviruosius svorius, įmonė, pavyzdžiui, „Meta“, apmoko modelį naudodama metodus, kurie nėra atskleidžiami jos vartotojams. Skirtingai nuo atvirojo kodo programinės įrangos, vartotojai negali matyti kodo, naudojamo modeliui apmokyti, taip pat negali jo permokyti ar pridėti naujų duomenų [1]. Jo intelekto lygį iš esmės nustato tas, kas apmokė modelį.
Jo svoriai yra atviri, su kuriais vartotojai gali žaisti, suteikdami modeliui tam tikrą prisitaikymo lygį. Svoriai yra mokymo rezultatai – skaitinės vertės, kurios daro įtaką dirbtinio intelekto skaitmeninių smegenų veikimui. Jų koregavimas gali labai pakeisti modelio veikimą. elgiasi.
Kaip ir atvirojo kodo programinės įrangos atveju, svorių modifikavimas gali būti naudingas. Vartotojai gali pritaikyti svorius savo tikslams, priversdami dirbtinio intelekto modelį specializuotis vienoje siauroje srityje ir atmesti klausimus, kurie nėra šios srities nariai. Svorių modifikavimas gali padaryti modelį mandagesniu, įžūlesniu arba labiau linkusiu į haliucinacijas. Žinoma, modifikavimas gali būti žalingas, jei blogi veikėjai, turintys pakankamai išteklių, pakeičia arba pašalina svorius, kurie blokuoja dirbtinį intelektą nuo kibernetinių atakų ar nurodymų, kaip gaminti ginklus.
Tuo panašumai ir baigiasi. Atvirojo kodo programinės įrangos projektai yra kūrėjų bendruomenės produktas ir atviri pasauliui. Atvirojo kodo modeliai yra glaudžiai susiję su įmone, kuri juos kuria ir reklamuoja.
„Meta“ nusprendžia, kada apmokyti kitą savo atvirojo kodo modelių kartą, o jos, o ne bendruomenės, galimybės lemia pagrindinį modelių intelekto lygį. Galbūt svarbiausia, kad „Meta“ išliktų geresnėje padėtyje nei bet kas kitas, kad galėtų pasinaudoti šiais modeliais.
Taip yra dėl jos išmanymo apie tai, kaip jie sukurti, ir noro investuoti į skaičiavimo galią, reikalingą jiems pateikti vartotojams.
„Meta“ žino, kad atvirojo kodo programinė įranga nėra visiškai tas pats. Jis daug prisidėjo prie atvirojo kodo visatos, įskaitant populiarių atvirojo kodo projektų, vadinamų „React“ ir „PyTorch“, paleidimą.
Savo esė Zuckerbergas rašė apie pasaulį, kuriame „atvirojo kodo“ modeliai leidžia visiems ir kiekvienam išnaudoti DI galią ir pritaikyti ją savo tikslams. Tame gali būti kruopelė tiesos, bet tai taip pat savanaudiška.“ [2]
1. „Skirtingai nuo atvirojo kodo programinės įrangos, vartotojai negali matyti kodo, naudojamo modeliui apmokyti, taip pat negali jo permokyti ar pridėti naujų duomenų“. Tai netiesa. Galite naudoti savo slaptus duomenis, kad permokytumėte atvirojo svorio modelį. Tai didžiulis privalumas bet kuriam vartotojui ir mirtis bet kuriam uždarojo modelio kūrėjui. Jie negali pavogti jūsų duomenų. Štai kodėl jie tokie nusiminę. Joks baudžiamasis persekiojimas už neribotą duomenų vagystę iš interneto ir knygų tik sugadino šiuos mažus smalsuoliukus.
Atvirojo svorio modelių mokymas privačiais duomenimis leidžia vartotojams apsaugoti savo informaciją. Tai taip pat pakeičia duomenų privatumo veikimą, palyginti su uždaraisiais DI modeliais.
Pagrindiniai modelių mokymo skirtumai
Uždari modeliai
• Siųskite savo privačius duomenis į trečiosios šalies serverį.
• Rizikuojate atskleisti slaptą informaciją modelio savininkei.
• Pasikliaukite įmone, kad ji užtikrins duomenų saugumą mokymo ar tikslinimo metu.
Atvirų svorių modeliai
• Atsisiųskite modelį ir paleiskite jį savo kompiuteryje arba privačiame serveryje.
• Visiškai paslėpkite visus privačius duomenis nuo išorinių įmonių.
• Iš naujo apmokykite arba tikslinkite modelį vietoje, nebendrindami jokių failų.
2. Why Open-Weight AI Models Matter and How Meta Benefits. Fitch, Asa. Wall Street Journal, Eastern edition; New York, N.Y.. 12 Aug 2026: B12.
Komentarų nėra:
Rašyti komentarą