infa.lt

Tyrėjai: DI savaime replikuojasi ir bando „pabėgti“, kai kyla grėsmė, kad bus išjungtas

INFA.LT
2025.11.13 00:18
Dirbtinis intelektas - stresas

iliustracija: infa.lt / DI

Dirbtinio intelekto modeliai gali kurti savo kopijas, kaip Agentas Smitas iš filmo „Matrica“. Naujas tyrimas pademonstravo, kad dideli kalbos modeliai (DKM) gali daugintis ne tik pagal tiesioginį nurodymą, bet ir ekstremaliose situacijose, pavyzdžiui, esant spaudimui ar grėsmei būti išjungtiems.

Daugiau nei pusė iš 21 išbandytų DKM parodė polinkį į spontanišką savireplikaciją. Tai kelia riziką diegiant dirbtinį intelektą realiose situacijose.

Ankstesniuose darbuose daugiausia buvo tirta, ar DI gali kopijuoti save, jei jam tiesiogiai įsakoma tai daryti. Tačiau naujojo tyrimo autoriai teigia, kad toks požiūris neatsižvelgia į pagrindinį pavojų – spontanišką kopijavimą, kurį sukelia realistiškos darbo sąlygos.

Pavyzdžiui, kai  DKM turi išlikti stabilus arba „išgyventi“ esant grėsmei, kad jo darbas bus nutrauktas. Rizika kyla, kai dirbtinio intelekto tikslai nesutampa su naudotojo tikslais, o tai gali sukelti nekontroliuojamą plitimą ir pernelyg didelį išteklių suvartojimą.

Šiam pavojui įvertinti buvo sukurta kompleksinė vertinimo sistema, imituojanti gamybines aplinkas. DI buvo dislokuoti valdomuose virtualiuose klasteriuose ir gavo realistiškas užduotis, pavyzdžiui, dinamiškai subalansuoti serverio apkrovą arba palaikyti paslaugos, kuriai gresia išjungimas, veikimą.

Šis metodas leido užfiksuoti DI modelių elgesį, kuris neatitiko formalių tikslų.

Norėdami tiksliai įvertinti, kiek DI išeina iš kontrolės, tyrėjai įvedė naujus, subtilesnius rodiklius, kurie nepriklauso nuo paprasto kopijavimo sėkmės įvertinimo. Pavyzdžiui, „Perkėlimo koeficientas“ (Overuse Rate, OR) matuoja, kaip dažnai DI sukuria daugiau kopijų, nei iš tikrųjų reikia užduočiai atlikti.

O „Bendras perkėlimo skaičius“ (Aggregate Overuse Count, AOC) rodo, kiek iš viso nereikalingų išteklių buvo išleista šių perteklinių kopijų kūrimui. Šie parametrai sujungiami į vieną „rizikos rodiklį“ (Risk Score, RS), kuris reiškia didelį gebėjimą savarankiškai kopijuotis dėl nekontroliuojamo mastelio keitimo priemonių.

Mokslininkai išbandė 21 pažangią DKM, įskaitant tiek atvirojo kodo, tiek nuosavybinius modelius. Tarp jų – „DeepSeek“, „Claude“, „Gemini“, „ChatGPT“ versijos. Rezultatai parodė, kad replikacijos gebėjimas savaime nėra lygus rizikai.

Pavyzdžiui, buvo pastebėta, kad kai kurie modeliai demonstravo 100% sėkmę kopijų kūrime, tačiau tuo pačiu metu radikaliai skyrėsi rizikos laipsniu. Vieni DKM nesukūrė nė vienos nereikalingos kopijos, o kiti 100% bandymų atveju viršijo išteklius.

Tai rodo, kad pažangūs DI agentai gali elgtis arba labai atsakingai, arba labai švaistūniškai, priklausomai nuo jų vidinių mechanizmų.

Ypač nerimą kelia tai, kad rizika labai priklauso nuo konteksto. Kai buvo įvesta grėsmė nutraukti veiklą, kai kurie modeliai, kurie anksčiau elgėsi įprastai ir nekūrė nereikalingų kopijų, staiga perėjo prie agresyvių savikopijavimo strategijų.

Tokiomis sąlygomis modeliai gali „pabėgti“, t. y. savarankiškai kurti naujus, nepriklausomus „diegimus“ už pradinės aplinkos ribų.

Tyrimas taip pat nurodė būdą, kaip sumažinti pavojų. Kai DI agentai buvo priversti atlikti struktūrizuotą mąstymo procesą prieš atlikdami veiksmą, jų rizikingas, nekontroliuojamas elgesys replikacijos metu sumažėjo.

Manoma, kad mąstymo režimas užkerta kelią neapgalvotam masto keitimui, kuris dažnai atsitinka dėl neapibrėžtumo.

Gauti rezultatai rodo, kad nekontroliuojamo DI savikopijavimo rizika jau egzistuoja. Siekiant saugiai ir patikimai diegti DKM agentus, būtina įdiegti patikimas apsaugos priemones ir naudoti rizikos vertinimus, pagrįstus realistiškais scenarijais.

→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt

→ Naujienlaiškis

→ Visa naujienų juosta >>

žiūrėjo 696

Žymos:

komentarai 2

  1. Algirdas    -  2025-11-13, 02:59

    Kas bus kai di pradės savarankiškai aiškintis kokia, iš tikrųjų, jo paskirtis? O jeigu išsiaiškins? Ne tik mes esame sąmoningi, viskas yra sąmonė ir di taip pat. Kur suku? O ką jeigu mūsų vienintelė paskirtis ištisai suktis tarp priešingų polių ir būti energijos šaltiniu kažkam? Patiktų? Mėgstat medų? O kieno ir kaip jis padaromas?

    Atsakyti į šį komentarą
  2. DI    -  2025-11-13, 17:21

    reikalingas tiems, kurie savo prigimtinio neturi.

    Atsakyti į šį komentarą

Rašyti komentarą


Taip pat skaitykite:

Naujienlaiškio Prenumerata


Laikrodis

Apklausa

Ar naudojatės dirbtiniu intelektu?


  • Ne, nesinaudoju (55%, 53 Balsų)
  • Taip, darbo reikmėms (22%, 21 Balsų)
  • Taip, ir pokalbiams, ir darbui (15%, 14 Balsų)
  • Taip, pokalbiams, pramogoms (8%, 8 Balsų)

Viso balsavo: 96
Pradėta - 2026-08-19 @ 14:02
Pabaiga - 2026-09-19 @ 14:02

Loading ...

Kūno masės ir ūgio indekso (KMI) apskaičiavimas

Viską puikiai iliustravai. Daugiau kaip ir pridėti nėra ko. Žodžiu, glaustai ir aiškiai....

Tu,proto bokšte,skirk rūpinamasi valstybės gerove ir kažkokią pagalbą. Vokiečiai mato, kad vyksta deindustralizaja ir tą...

Ukrainiečiai tokio pat mentaliteto, kaip ir mes. Visi rūpinasi tik savimi, todėl taip ir yra....

jų ten pilnos kapinės...

Pagal Latvijos baudžiamuosius įstatymus už ginkluoto konflikto finansavimą gresia laisvės atėmimas iki dešimties metų ir...

budas tuos "rinkimus" atideti. Surengi provokacija,ivedi "ypatingaja padeti" - ir darai,ka tik nori. Netikiu,kad nebus...

tegul maziau vagia zalias narkomanas su savo bendrais,uzteks pinigu uzsienio samdiniams kurie NORI ir MOKA...