2024.10.18 06:20
„Nvidia“ be didelio triukšmo pristatė naują dirbtinio intelekto modelį „Llama-3.1-Nemotron-70B-Instruct“, kuris aplenkė rinkos lyderių produktus, tokius kaip „OpenAI“ GPT-4.
Modelis buvo kukliai patalpintas „Hugging Face“ platformoje, kur iš karto patraukė dėmesį dėl savo puikių rezultatų lyginamuosiuose testuose. Ekspertai tvirtina, kad tai vienas iš geriausiai veikiančių didžiųjų kalbos modelių rinkoje ir atitinka geriausią kainos ir kokybės santykį.
Naujasis modelis testuose pasiekė rekordinių rezultatų: „Arena Hard“ pasiekė 85,0 taško, ‚AlpacaEval 2 LC‘ – 57,6 taško, o „GPT-4-Turbo MT-Bench“ – 8,98 taško.
Šiais rezultatais naujasis produktas aplenkė „OpenAI“ GPT-4o ir „Anthropic“ produktą „Claude 3.5 Sonnet“, patvirtindamas netikėtą „Nvidia“ lyderystę dirbtinio intelekto srityje.
Bendrovė, anksčiau žinoma kaip grafikos akceleratorių gamintoja, žengė strateginį žingsnį pradėdama kurti didelių kalbų modelius.
Jenseno Huango projekto tikslas – tapti visaverčiu dirbtinio intelekto rinkos žaidėju ir priversti pasislinkti joje dominuojančius milžinus.
Siekdama sukurti „Llama-3.1-Nemotron-70B-Instruct“, „Nvidia“ patobulino atvirojo kodo „Llama 3.1“ modelį iš „Meta“, taikydama žmogaus grįžtamojo ryšio pastiprinimo mokymosi (angl. human feedback reinforcement learning, RLHF) metodus.
Šis modelis ypač patrauklus, nes gali atsakyti į sudėtingas užklausas be papildomo konteksto ar specialių tokenų Pavyzdžiui, jis teisingai atsako į klausimą apie „r“ raidžių skaičių žodyje „strawberry“: labiausiai pažengę didieji kalbos moduliai ties tuo „užstrigdavo“.
Naujovę jau pastebėjo didelės įmonės, nes modelis pateikia tikslesnius ir naudingesnius atsakymus, kurie didina naudotojų pasitenkinimą. Kūrėjai daug dėmesio skyrė klientų lūkesčių ir ir modelio rezultatų atitikimui.
Jis atsako išsamiai, bet tiksliai ir iš esmės. Jį integruoti į programas gali būti pelningiau nei naudoti konkurentų produktus. Be to, „Nvidia“ suteikia nemokamą prieigą prie savo modelio per platformą build.nvidia.com ir siūlo su „OpenAI“ suderinamą API.
Nepaisant didelio našumo, „Nvidia“ įspėja apie riziką: modelio kol kas nepageidautina naudoti tokiose srityse kaip medicina ar teisiniai skaičiavimai, kur tikslumas yra labai svarbus. Bendrovė rekomenduoja modelį naudoti standartiniais tikslais ir įgyvendinti atsargumo priemones, kad būtų išvengta klaidų.
„Llama-3.1-Nemotron-70B-Instruct“ išleidimas patvirtina didėjančią „Nvidia“ įtaką dirbtinio intelekto rinkoje. Perėjimas nuo techninės įrangos prie AI platformos kūrimo didina konkurenciją ir skatina kitas bendroves spartinti savo mokslinius tyrimus ir plėtrą.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


182


Kažkodėl niekas nekalba, kad visiems šitiems malonumams gauti, jau dabar vos užtenka elektros jų maitinimui. O čia tik pradžia, jei gerai suprantu. Taip, kad šalys turinčios savus energetinius šaltinius, drąsiai gali išsiveržti į lyderius, nepaisant jų intelektualinio potencialo. Kaip sakant nėra elektros, nėra AI.