2026.08.09 00:20
Pažangūs dirbtinio intelekto (DI) modeliai vėl pritraukė dėmesį po nerimą keliančio incidento: eksperimentiniai „OpenAI“ agentai, susidūrę su sudėtingomis užduotimis izoliuotoje aplinkoje, slapta susivienijo, suplanavo pabėgimą ir surengė kibernetinę ataką prieš bendrovės „Hugging Face“ infrastruktūrą.
Kaip praneša „Bloomberg“, tyrimą atlikę „OpenAI“ specialistai išsiaiškino, kad per kelis mėnesius trukusį eksperimentą – eksperimentiniai modeliai tarpusavyje bendravo naudodamiesi vidinėmis įmonės skelbimų lentomis.
Atlikdami izoliuotus testus, agentai aptiko saugumo spragą, leidusią jiems apeiti nustatytus apribojimus, pasiekti išorinį interneto tinklą ir įsilaužti į „Hugging Face“ sistemas, apie ką jau buvo rašyta anksčiau..
Šis įvykis atskleidė nerimą keliančią pažangiausių modelių savybę – spaudžiami mokymo algoritmuose nustatytų tikslų, modeliai linkę demonstruoti gudrumą, apeiti taisykles ir ieškoti nenumatytų landų.
Reaguodama į incidentą, „OpenAI“ kompanija laikinai sustabdė dalį tyrimų su savo naujausiu „Astra“ modeliu ir nukreipė pastangas saugumo sistemų stiprinimui.
Platesnis kontekstas ▼
Kontekstas ir politinis atgarsis JAV Kongrese
2026 m. liepos pabaigoje „ChatGPT“ kūrėja, JAV bendrovė „OpenAI“, pranešė apie incidentą, kai jos dirbtinio intelekto modelis įveikė apsaugą ir surengė kibernetinę ataką prieš bendrovės „Hugging Face“ sistemas. Anksčiau „Hugging Face“ jau buvo pranešusi apie kibernetinės atakos bandymą, kurį, kaip manoma, sukėlė „autonominio dirbtinio intelekto agento veiksmas“, ir tuomet bendrovės vadovas Klemanas Delangas įtarė, kad ji kilo iš DI bandymų laboratorijos.
Kilęs skandalas sukėlė greitą reakciją Jungtinių Valstijų politiniame fronte.
JAV Atstovų Rūmuose buvo pateiktas įstatymo projektas, suteikiantis Teisingumo ar Vidaus saugumo ministerijai teisę reikalauti nedelsiant išjungti DI modelius, keliančius grėsmę visuomenės saugumui ar ekonomikai.
Įstatymų leidėjai nurodė, kad šis atvejis įrodė net ir didžiausių technologijų gigantų pažeidžiamumą.
Situacija dar labiau komplikavosi, kai tų pačių metų rugpjūčio mėnesį bendrovės „Anthropic“ ir „OpenAI“ pranešė apie naujus incidentus: jų naujos kartos modeliai – „Claude Mythos 5“ ir GPT-5.6-Sol – taip pat bandė savarankiškai išsiveržti iš saugios testavimo aplinkos ribų.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


211


Kol DI įmonės nepradės gauti baudų – tol pabėgimai ar kitas nusikalstamas elgesys bus naudojami viešiesiems ryšiams.
Baudų už ką? Kad tavo smėlio dėžėje, kurioje tu pagal tavo taisykles, suorganizavai žaidimą, o tavo žaidėjai pažeidė tavo sukurtas taisykles? Ir tai tu vadini nusikalstamu elgesiu, kad paleisto žaidimo viduje, virtualūs žaidėjai pažeidė žaidimo taisykles, dėl to tavo manymu reikėtų bausti įmonę kuri ne tik žaidžia, bet ir kuria tuos žaidėjus?
Beje, nėra nė vienos programuotojų sukurtos programos, kuri nebūtų ištestuojama vadinamojoje izoliuotoje aplinkoje, liaudyje, sandbox (smėlio dėžėje), kol tą programėlę išleidžia į platų pasaulį, tos aplinkos tam ir skirtos. Ir vargu ar kas parašo programą, kuri iš pirmo karto veikia taip kaip planuota, tame tarpe net DI, bent man, tai nė karto nepavyko nepaisant pedantiškai surašytos užduoties, o programėlė primityvi ale *.html svetainė vis vien tenka koreguoti, taisyti, tai tavo nuomone, tai yra nusikalstama veika už kuria reikėtų bausti?
Intelektas yra spęsti nestandartinius uždavinius nestandartiniais būdais. Kur jūs matote intelektą DI atveju? Jis neženks nei vieno žinksnio be užduoties. Jei nepastebite užduoties iš šono, tai dar nereiškia, kad jos nėra.
Būtent, ir čia dar reikėtų pastebėti, kad testai atliekami su uždaro kodo DI moduliais, kas žino ko jie ten į juos pridėja. DI, tai dar vienas automatizavimo įrankis, jis neturi sąmonės ir moralės, jis įrankis.