2026.10.04 07:29
Amerikos startuolis „Tavus“ pristatė „Griffin“ – pirmąjį pasaulyje „Human Interaction Model“ (HIM) klasės dirbtinio intelekto modelį, kuris išlaikė Turingo testą bendraujant gyvai vaizdu. Per maždaug minutės trukmės tiesioginį vaizdo pokalbį 48% dalyvių nusprendė, kad kalbėjosi su tikru žmogumi.
Modelis juokiasi, keičia balso toną, pertraukia ir leidžia sau būti pertraukiamam, puikiai jaučia pauzes. Be to, ji puikiai supranta pašnekovą ir jo aplinką, pavyzdžiui, gali padėti surinkti Rubiko kubą. „Griffin-Lite“ jau prieinama bandymams siaurai atrinktų asmenų grupei, o galingesnė versija tikimasi pasirodys „labai greitai“ – išsprendus pagrindinius saugumo klausimus.
Žmonės evoliuciškai prisitaikė bendrauti akis į akį: mes naudojame ne tik žodžius, bet ir intonaciją, mimiką, gestus bei pauzes – didžioji dalis žmogiškosios komunikacijos yra neverbalinė. Iki šiol mašinos to nesuprato ir reikalavo, kad mes prisitaikytume prie jų, išmoktume jų kalbą – reikiamą komandą, reikiamą paspaudimą, reikiamą nurodymą. Startuolis „Tavus“ mano, kad turėtų būti atvirkščiai.
HIM – tai naujos kartos dirbtinio intelekto modeliai, skirti suprasti ir generuoti žmogiškąjį bendravimą akis į akį realiuoju laiku. Jie klausosi pašnekovo ir kreipia dėmesį į veido išraiškas bei pauzes, o ne tik į žodžius. „Griffin“ sujungia ankstesnius „Tavus“ tyrimus realaus laiko suvokimo, šnekamosios kalbos ir išraiškingų žmogaus pavidalo vaizdo įrašų srityse į vieningą „video-to-video“ sistemą.
Ankstesnės sistemos, įskaitant pačios įmonės sukurtą balso ir vaizdo sąsają „Tavus“ (pagrįstą „Phoenix 4.5“, „Sparrow-2“ ir „Raven-1“), duodavo ne daugiau kaip 2% teigiamų rezultatų. Tai milžiniškas proveržis mašinos gebėjime suprasti žmogų. Startuolis tai aiškina savo novatorišku dvipusiu metodu, apimančiu audiovizualinį generavimą realiuoju laiku.
„Griffin“ generuoja kiekvieną pikselį kiekviename kadre realiuoju laiku, naudodama tik vieną pradinį vaizdą. Sistema valdo visą sceną: ne tik veidą, rankas ir pirštus, bet ir tokius elementus kaip kėdės, kurioje sėdi žmogus, judėjimas, jo metamas šešėlis ir fonas už jo nugaros.
Kiekvieną sekundės dalį ji sprendžia, ar dabar verta tylėti, linktelėti, pritarti ar pertraukti pašnekovą, ir visą tą laiką toliau žiūri ir klauso, įskaitant ir tuos momentus, kai kalba pati.
Kol kas modelis prieinamas tik atrinktiems testuotojams, nes „Tavus“ tikrai įsitikinę, kad jis sugeba apgauti žmogų, priversdamas jį manyti, jog jis bendrauja ne su dirbtiniu intelektu; modelio išleidimas žadamas „labai greitai“ po to, kai bus išspręsti saugumo klausimai ir sukurti vandens ženklai.
1950 m. Alanas Turingas uždavė klausimą: „Ar mašina gali mąstyti?“ – ir pasiūlė testą, kuris turėjo duoti atsakymą į šį klausimą. Praėjus beveik 75 metams, informatikos profesorius Peteris Denningas naujoje knygoje „Turingo klaida: kaip išsilaisvinti iš neišmaningų mašinų jungo“ teigia, kad dvi pagrindinės Turingo prielaidos atvedė dirbtinio intelekto tyrimus į aklavietę ir tapo dabartinės pasitikėjimo dirbtiniu intelektu krizės priežastimi.
„Modelių intelektas turi kitokius prioritetus nei mes, ir, matyt, mes jam nesame svarbūs, – pareiškė Denningas. – Jo mąstymo ir uždavinių sprendimo būdai mums atrodo svetimi. Kol kas nežinome, kaip saugiai sugyventi su šiuo intelektu.“
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


98

