2025.12.28 00:20
Elono Musko kompanijos „xAI“ sukurtas kalbos modelis „Grok“ netikėtai užėmė pirmąją vietą 2025 m. gruodžio mėnesį atliktame dirbtinio intelekto (DI) modelių patikimumo tyrime.
Tuo tarpu „ChatGPT“ ir „Gemini“ atsidūrė reitingo apačioje.
Analizę parengė analitinė kompanija „Relum“, kuri įvertino dešimt populiariausių pokalbių modelių pagal jų tinkamumą naudoti verslo užduotims.
Tada jiems buvo suteiktas patikimumo rizikos balas nuo 0 iki 99, kur aukštesni balai reiškė rimtesnes problemas.
Remiantis rezultatais, „Grok“ mažiausiai hallucinavo (t. y. pateikė klaidingus atsakymus ir išgalvojo faktus) – tik 8% iš visų užklausų.
Palyginimui, „OpenAi“ modelio „ChatGPT“ šis rodiklis siekė 35%, o Google „Gemini“ – dar didesnis – beveik 40 proc. Taip pat aukštą klaidų lygį – 27% – demonstruoja Microsoft „Copilot“ modelis.
Prie lyderio labai priartėjo kinų dirbtinis intelektas „DeepSeek“, kurio hallucinacijų lygis siekė 14 proc. Neprasti rodiklius pademonstravo „Claude“ – 17% ir „Perplexety“ – 13 proc.
Tyrimo autoriai pažymėjo, kad mažas haliucinacijų lygis yra labai svarbus verslui.
Statistika rodo, kad daugiau nei 65% JAV įmonių jau naudoja DI pokalbių robotus kasdieniame darbe.
Priklausomybė nuo DI įrankių tikriausiai dar labiau padidės, todėl įmonės turės rinktis neuroninius tinklo modelius atsižvelgdamos į tai, kiek jie yra patikimi ir tinkami konkretiems verslo poreikiams, teigiama „Relum“ ataskaitoje.
Nežiūrint į tai, „ChatGPT“ užima daugiau nei 80% pasaulinės pokalbių modelių rinkos ir 92% Ukrainos rinkos.
Artimiausi konkurentai – „Perplexity“ ir Microsoft „Copilot“. Jie surenka 15% visų naudotojų.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt



179

