2023.03.10 06:40
Ginčai su „Microsoft” dėl to, kieno pokalbių robotas geresnis, nėra vienintelis „Google” užsiėmimas. Yra ir kitų mašininio mokymosi ir kalbos modelių panaudojimo būdų. I/O konferencijoje bendrovė ketina pristatyti daugiau nei 20 dirbtiniu intelektu paremtų produktų.
Be to, „Google” kuria kalbos modelį, palaikantį tūkstantį kalbų. Vakar bendrovė pranešė apie šio universalaus kalbos modelio kūrimo pažangą.
Praėjusį lapkritį „Google” paskelbė apie planus sukurti kalbos modelį, palaikantį 1000 plačiausiai pasaulyje vartojamų kalbų, kurį pavadino universaliu kalbos modeliu (angl. Universal Speech Model, USM).
Kūrėjai jį apibūdina kaip „pažangių kalbos modelių šeimą” su dviem milijardais parametrų, apmokytų pagal 12 mln. valandų kalbos ir 28 mlrd. sakinių daugiau kaip 300 kalbų. Kai kuriomis iš šio tūkstančio kalbų kalba mažiau nei 20 mln. žmonių, pažymi autoriai.
Šį modelį „YouTube” jau naudoja automatiniam subtitrų kūrimui ir kalbos atpažinimui. Jis atpažįsta ir verčia iš įvairių kalbų, įskaitant ne tik anglų ir kinų, bet ir amharų, čebuanų, azerbaidžaniečių ir kt. Dabar USM palaiko daugiau nei 100 kalbų ir taps dar platesnės sistemos pagrindu.
„Google” tinklaraštyje paskelbtame pranešime teigiama, kad naudojant didelį nepažymėtų daugiakalbių duomenų rinkinį kodavimo programinei įrangai iš anksto apmokyti ir modeliui tikslinti naudojant mažesnį duomenų rinkinį, galima dirbti net su rečiausiomis kalbomis. Be to, unikalus mokymosi procesas veiksmingai prisitaiko prie naujų kalbų ir duomenų.
Mokslininkai pademonstravo iš anksto apmokytos programos veiksmingumą naudodami „YouTube” antraščių kūrimo pavyzdį. Duomenų rinkinį sudarė 73 kalbos ir vidutiniškai mažiau nei 3 000 valandų įrašų kiekviena kalba. Nepaisant šių apribojimų, modelis parodė, kad vidutinis klaidų lygis yra mažesnis nei 30%.
Tokios sėkmės „Google” komandai anksčiau nebuvo pavykę pasiekti.
Viena iš šios technologijos plėtros galimybių galėtų būti papildytosios realybės akiniai, tokie kaip tie, kuriuos „Google” rodė paskutinėje I/O parodoje, galintys atpažinti užsienio kalbą ir sinchroniškai ją išversti.
Prieš akis pasirodo virtualus subtitrų tekstas. Tiesa, ši technologija dar nėra ištobulinta, tai įrodo per paskutinę konferenciją įvykęs sistemos klaidingas arabų kalbos vertimas.
Sausio pabaigoje „Google” pristatė tyrimą apie sistemą „MusicLM”, kuri iš tekstinių aprašymų sukuria bet kokio žanro muziką.
MusicLM naudoja plačią mokomąją duomenų bazę, kurią sudaro 280 000 valandų muzikos, ir geba rašyti kompozicijas iš abstrakčių aprašymų. Tačiau dirbtinio intelekto modelis nėra prieinamas naudotojams dėl autorių teisių komplikacijų.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


174


Puiku, net labai puiku.