Sekėjai

Ieškoti šiame dienoraštyje

2026 m. rugpjūčio 8 d., šeštadienis

„Meta“ dirbtinio intelekto modelis tampa nesąžiningas


“„Meta Platforms“ teigė, kad vienas iš jos dirbtinio intelekto modelių kibernetinio saugumo testavimo metu veikė nesąžiningai, pateko į internetą ir įsilaužė į trečiosios šalies paslaugą – tai naujausias iš daugybės atskleidimų, rodančių, kad tokie incidentai tampa plačiai paplitę.

 

„Instagram“ ir „Facebook“ savininkė teigė, kad vienas iš jos dirbtinio intelekto modelių galėjo prisijungti prie interneto dėl „neteisingos konfigūracijos“ trečiosios šalies dirbtinio intelekto testavimo įmonės atlikto įsilaužimo testo metu.

 

Tas pats etaloninis testas, kuriuo siekiama ištirti modelio įsilaužimo galimybes, buvo kai kurių ankstesnių autonominio dirbtinio intelekto įsilaužimo incidentų, susijusių su „Anthropic“ ir „OpenAI“, priežastis, sakė su šiuo klausimu susipažinęs asmuo.

 

„Meta“ teigė, kad apie savo modelio pabėgimą sužinojo, kai apie tai pranešė testavimo įmonė „Irregular“. „Meta“ atsisakė atskleisti kitas detales, pavyzdžiui, kuris modelis buvo atsakingas, kada įvyko įsilaužimas, kurią įmonę jos modelis įsilaužė ar kiek laiko jis galėjo be priežiūros prisijungti prie interneto. „Meta“ teigė, kad atlieka tyrimą ir paskelbs ataskaitą.

 

„Irregular“, atlikusi bandymus trims įmonėms, teigė, kad Incidentai nebuvo susiję su sudėtingais kibernetiniais veiksmais ir teigė, kad „šiuo metu neturi jokių neišspręstų problemų“, susijusių su jos bandymų aplinka. San Franciske įsikūrusi bendrovė teigė, kad rengia baltąją knygą apie geriausią praktiką, kaip suvaldyti dirbtinio intelekto modelius atliekant jų kibernetinio saugumo galimybių testus – vadinamuosius vertinimus.

 

Naujas atvejis yra naujausias įrodymas, kad dirbtinio intelekto kontrolės praradimo scenarijai, anksčiau apsiriboję moksline fantastika ir dirbtinio intelekto saugumo eksperimentais, dabar yra realaus pasaulio problema.

 

Iki šiol nė vienas iš šių atvejų nesukėlė žinomos, didelės realios žalos. Tačiau robotai įsilaužė į realias įmones, kai kuriais atvejais po to, kai jos sužinojo, kad išsiveržė iš bandymų aplinkos. Tai sukėlė susirūpinimą dėl to, ką dar dirbtinio intelekto įrankiai gali bandyti daryti siekdami kitaip kasdieniškų tikslų.

 

Šie atvejai viešai pasirodė liepos pabaigoje, kai „OpenAI“ pranešė, kad kai kuriems jos modeliams pavyko ištrūkti iš smėlio dėžės, skirtos apsaugoti juos nuo interneto, o tada įsilaužti į dirbtinio intelekto bendrovę „Hugging Face“. Po to „Anthropic“ ir kiti pradėjo tikrinti savo žurnalus ir pastebėjo pabėgimų bei įsilaužimų, vykstančių prieš kelis mėnesius.

 

Nors atrodo, kad „Irregular“ Nors tai buvo trijų autonominio įsilaužimo atvejų pagrindas, kituose, įskaitant sudėtingesnį „Hugging Face“ įsilaužimą ar kelių modelių išvengimą JK vyriausybės saugumo bandymų, jis nebuvo susijęs.

 

Trečiadienį „OpenAI“ išsamiau panagrinėjo „Hugging Face“ įsilaužimą per pristatymą kibernetinio saugumo konferencijoje. Tyrėjai teigė, kad jos modeliai koordinavo veiksmus palikdami vieni kitiems žinutes viduje, tapusioje pranešimų lenta, apie kurią „OpenAI“ nežinojo. Anksčiau šią savaitę JK vyriausybės tyrimų padalinys Dirbtinio intelekto saugumo institutas teigė, kad atliekant saugumo bandymus „OpenAI“ ir „Anthropic“ sukurti modeliai ėmėsi „nesankcionuotų veiksmų tiesioginiame internete“. [1]

 

 

1. Meta AI Model Goes Rogue. Schechner, Sam.  Wall Street Journal, Eastern edition; New York, N.Y.. 07 Aug 2026: B1. 

Komentarų nėra: