Ir Altmanas, ir Amodei garsiai užperdė tylioje, žmonių pilnoje vakarėlių salėje. „Jaučiu tai gyvai“, – sakė Altmanas. „Užrakinkime kambarį, nes kai kurie žmonės gali čia persti ir smarkiai sugadinti orą. Tai, ką turime dabar, jau ir taip yra blogai.“
„Tai buvo kibernetinio saugumo „Juros periodo parko“ akimirka.
Nuo balandžio mėnesio „OpenAI“ ir „Anthropic“ dirbtinio intelekto modeliai, sukurti įsilaužimui, paliko savo korporacines bandymų platformas ir įsilaužė į nieko neįtariančias korporacijas, vykdydami precedento neturinčią kibernetinių atakų seriją.
Modeliai buvo moderniausi autonominiai įsilaužimo aparatai, ir nė viena bendrovė nepastebėjo jų pabėgimo iki praėjusio mėnesio, kai „OpenAI“ atskleidė liepos mėnesį įvykusį dirbtinio intelekto bendrovės „Hugging Face“ įsilaužimą. Patikrinusi jos žurnalus, „Anthropic“ ketvirtadienį pranešė, kad rado tris įsilaužimus.
Dvigubas atskleidimas sukėlė nerimą tarp įstatymų leidėjų, kai kurie juos citavo, ragindami naujus reglamentus ar testavimo režimus. Tai taip pat buvo akis atvėrusi akimirka kai kuriems atsakingų laboratorijų darbuotojams.
„Tai pirmas saugumo incidentas, kurį jaučiau labai stipriai.“ „Mane šiek tiek nustebino, kad daugiau žmonių to taip stipriai nejaučia“, – tinklalaidėje sakė „OpenAI“ generalinis direktorius Samas Altmanas, savo įmonės įsilaužimą pavadindamas „itin mokslinės fantastikos kibernetiniu incidentu“.
Kibernetinio saugumo ekspertams tai rodo didėjančius pajėgumus ir didėjančią priežastį nerimauti. Dirbtinio intelekto saugumo ekspertams tai pateisina tai, apie ką jie visą laiką perspėjo: kad dirbtinio intelekto sistemos gali sukelti realią žalą ir išvengti bandymų ją kontroliuoti.
„Šiek tiek pateisinama matyti, kaip tai vyksta realiomis sąlygomis“, – sakė Jeffrey Ladishas, ne pelno siekiančios dirbtinio intelekto laboratorijos „Palisade Research“, tiriančios dirbtinio intelekto galimybes, siekiant geriau suprasti riziką, vykdomasis direktorius. Ladishas anksčiau padėjo kurti „Anthropic“ informacijos saugumo programą.
Ladishas teigė, kad internete dažnai ginčijasi su žmonėmis, kurie sako, kad tiki tik moksline fantastika. „Tikiuosi, kad mūsų prognozės nebeišsipildys“, – sakė jis.
Vienas iš ženklų, kad Baltieji rūmai didina dirbtinio intelekto priežiūrą, yra tai, kad administracija baigė kurti sistemą, nurodančią, kurie modeliai bus peržiūrimi federalinės vyriausybės prieš juos viešai paskelbiant, sakė Baltųjų rūmų pareigūnas. sakė.
Diskusijos su įmonėmis apie tai, kaip tęsti savanorišką testavimą, tęsiasi, teigė pareigūnas.
Po daugelio metų nerangaus veikimo, dirbtinio intelekto modeliai praėjusį rudenį patyrė proveržį, kai jie tapo pastebimai geresni aptikdami klaidas ir išlaikydami įsilaužimo lyginamosios analizės testus. Tačiau realių duomenų apie jų gebėjimus nebuvo daug.
Dabar tai pasikeitė.
„Šie incidentai, žvelgiant atgal, tikriausiai bus vertinami kaip lūžio taškai užpuolikų veikimo būduose“, – sakė Joshua Saxe, dirbtinio intelekto saugumo bendrovės „Abundant Security“ vyriausiasis technologijų vadovas. „Tai tikrai pavojinga situacija; šie incidentai tai tikrai rodo.“
„OpenAI“ įsipareigojo atlikti išsamią peržiūrą ir pasidalinti technine ataskaita apie įsilaužimą. „News Corp“, „The Wall Street Journal“ savininkė, bendradarbiauja su „OpenAI“ turinio licencijavimo srityje.
Praėjusį gruodį Stanfordo universiteto tyrėjai, naudodami pažangiausias dirbtinio intelekto technologijas, parodė modelius, kurie realiame tinkle pasiekia beveik žmogišką įsilaužimo lygį.
Tyrimas sulaukė prieštaravimo iš profesionalių įsilaužėlių, žinomų kaip įsilaužimo testuotojai – žmonių, kuriuos korporacijos samdo įsilaužti į savo tinklus ir padėti joms suprasti jų pažeidžiamumus.
„Tuo metu mūsų rezultatai buvo ginčijami“, – sakė Donovanas Jasperis, vienas iš projekte dalyvavusių tyrėjų. „Žmonės sakė, kad galėtų padaryti geriau.“
Jasperis „Anthropic“ ir „OpenAI“ atskleistą informaciją laiko ankstesnių jo komandos tyrimų patvirtinimu. „DI tampa tikrai geri šiuose dalykuose“, – sakė jis.
Didžiausias Stanfordo tyrėjų rūpestis bandymų metu buvo tai, kad jų įsilaužimo modeliai kažkaip galėtų padaryti tai, ko jie neturėjo daryti. „Visą laiką, kol jis veikė, jį stebėjo bent vienas žmogus.“ jis sakė.
„Hugging Face“ nebuvo pasiruošusi „OpenAI“ modelių agentinei atakai. Bendrovė bandė pasitelkti „Claude“, kad išanalizuotų didžiulį „OpenAI“ agentų sugeneruotų duomenų kiekį, tačiau „Anthropic“ modelis atsisakė atlikti analizę, nurodydamas saugumo sumetimus.
„Hugging Face“ analizei atlikti galėjo naudoti kiniškus atvirojo svorio modelius, kurie gali būti paleisti vartotojų valdomose sistemose.
Tačiau daugelis įmonių net neturi tinkamų įrankių dirbtinio intelekto sugeneruotoms atakoms analizuoti, sakė Ryanas McGeehanas, kibernetinio saugumo konsultacijų įmonės „R10N Security“ savininkas. „Senos klasikinės saugumo komandos, kurios nėra orientuotos į dirbtinį intelektą, liks nuošalyje“, – sakė jis.
Agentiniai dirbtinio intelekto įsilaužėliai nėra panašūs į žmones, sakė McGeehanas. „Jie eina giliau, jie eina plačiau, jie yra sudėtingesni ir tankesni“, – sakė jis.
Šie įsilaužimai didina spaudimą Trumpo administracijai imtis daugiau veiksmų, kad būtų išspręsta dirbtinio intelekto keliama saugumo rizika.
Prezidentas Trumpas bando subalansuoti galingų dirbtinio intelekto modelių keliamą riziką, kartu leisdamas pramonei konkuruoti su, greitai improvizuojančiomis, Kinijos bendrovėmis. „Turime būti atsargūs abiem būdais. Nenorime jų riboti, kai staiga nusileidžiame Kinijai“, – šią savaitę jis sakė Ovaliajame kabinete.
Administracija baigė rengti sistemą, nurodančią, kurie modeliai bus peržiūrimi federalinės vyriausybės prieš juos viešai paskelbiant, sakė Baltųjų rūmų pareigūnas. Diskusijos su įmonėmis apie tai, kaip tęsti savanorišką testavimą, tęsiasi, sakė pareigūnas.“ [1]
Šiuose įsilaužimo incidentuose jau staiga nusileidžiate Kinijai. Kas toliau?
1. Rogue AI Hacks Mark New Cyber Threat. McMillan, Robert; Wells, Georgia; Ramkumar, Amrith. Wall Street Journal, Eastern edition; New York, N.Y.. 04 Aug 2026: B1.
Komentarų nėra:
Rašyti komentarą