2024.05.15 06:40
JAV bendrovė „OpenAI“ pristatė multimodalinį generatyvinį dirbtinio intelekto modelį „GPT-4o”, kuris gali analizuoti garsą, vaizdą ir tekstą realiuoju laiku.
Kompanija ketina jį įdiegti savo produktuose per kelias ateinančias savaites.
„GPT-4o” modelio pavadinime esanti raidė „o“ reiškia „omni“ ir verčiama kaip „visapusiškas“; bendrovė teigia, kad tai rodo „GPT-4o” daugiamodalumą.
Dirbtinio intelekto (DI) modelis pasižymi „GPT-4o” lygio intelektu ir patobulintomis vaizdo ir teksto, taip pat garso ir balso galimybėmis. „GPT-4o” turi kontekstinį langą, kurį sudaro 128 tūkst. ženklų.
„OpenAI” mano, kad „GPT-4o” gerokai patobulins „ChatGPT” pokalbių robotą. Pastarasis jau turi balso režimą, tačiau naujuoju DI modeliu bus siekiama daugiau sąveikos su pokalbių robotu kaip asistentu, pavyzdžiui, bus galima jį pertraukti atsakinėjant.
Bus fiksuojamos naudotojo emocijos, ir dirbtinis intelektas galės reaguoti į naudotojo veiksmus realiuoju laiku. Taip pat bus patobulintos „ChatGPT“ vaizdinės galimybės, o ateityje pokalbių robotas galės stebėti tiesioginę sporto rungtynių transliaciją ir paaiškinti taisykles.
„GPT-4o” galima naudoti tiek mokamoje, tiek nemokamoje „ChatGPT“ versijoje, tačiau mokamų „ChatGPT Plus“ ir „Team“ abonentų žinučių limitas bus penkis kartus didesnis. Jei limitas bus viršytas, nemokamos versijos naudotojai pereis prie „GPT-3.5”, o mokamos – prie „GPT-4” versijų.
Nemokamos versijos naudotojai taip pat galės dabar ieškoti informacijos internete, kurti grafikus ir analizuoti duomenis, dirbti su naudotojo failais ir vaizdais bei prisiminti ankstesnes naudotojo sąveikas.
Taip pat bus galima naudotis GPT parduotuve.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


192

