2026.09.22 10:42
Kinijos bendrovė „Alibaba“ žengia didžiulį žingsnį į priekį dirbtinio intelekto srityje: bendrovė kuria modelį, kuris bus iki keturių kartų didesnis nei jos dabartinis pagrindinis produktas, ir pristatė naujos kartos DI lustą, vadinamą galingiausiu Kinijoje. Šie žingsniai pakėlė bendrovės akcijų vertę 5 procentais, rašo „Reuters“ agentūra.
Pristatymas vyko tuo metu, kai Kinijos technologijų milžinės skuba kurti vietines alternatyvas „Nvidia“ procesoriams, griežtėjant JAV eksporto ribojimams.
Pristatymai „Alibaba Cloud“ kasmetinėje „Apsara“ konferencijoje Hangdžou mieste pademonstravo bendrovės strategiją plėsti visus savo DI verslo sluoksnius – nuo pamatinių modelių ir puslaidininkių iki duomenų centrų, reikalingų galingesnėms sistemoms treniruoti ir diegti.
„Tikrai revoliuciniai mašininio intelekto epochos produktai dar neatėjo“, – teigė generalinis direktorius Edijus Vu (Eddie Wu), prilygindamas šį lūžį Pramonės revoliucijai.
Jis prognozavo, kad ateityje technologijos sukurs daugiau nei 1 000 kartų daugiau „mąstymo“ nei visa žmonija (palyginimui – dabar ši dalis nesiekia 3%).
Planuojamas naujas modelis su 5–10 trilijonų parametrų
E. Vu pranešė, kad „Alibaba“ komanda „Qwen“ planuoja treniruoti naują modelį, turėsiantį nuo 5 iki 10 trilijonų parametrų. Juo siekiama spręsti „sudėtingesnes, ilgesnės perspektyvos užduotis“, judant link dirbtinio superintelekto, pralenkiančio žmogaus galimybes.
Dabartinis „Alibaba“ flagmanas „Qwen 3.8 Max“ turi 2,4 trilijono parametrų (parametrai yra apytikslis modelio dydžio ir pajėgumų matas).
Atskirame pranešime bendrovė nurodė, kad šiuo metu jau treniruoja naujos kartos „Qwen 4“ modelį, o vėlesni „Qwen 4.5“ ir „Qwen 5“ turėtų pasiekti 5–10 trilijonų parametrų ribą.
Pasak E. Vu, „Qwen“ komanda padarė „reikšmingą“ pažangą skatindama modelius tobulėti savarankiškai – nustatant silpnas vietas, atliekant eksperimentus ir generuojant mokymo duomenis su minimaliu žmogaus įsikišimu.
Naujas „Zhenwu V900“ lustas
Alibaba taip pat pristatė „Zhenwu V900“ – naują DI lustą, kurį sukūrė puslaidininkių padalinys „T-Head“.
E. Vu teigimu, šis procesorius pasiekia trigubai didesnį našumą nei jo pirmtakas „M890“ ir gali būti jungiamas į klasterius iki 500 000 lustų didžiausiems DI modeliams treniruoti bei paleisti.
Lustas paruoštas masinei gamybai ir komerciniam išleidimui 2027 metų pirmąjį ketvirtį, o bendrovė tikisi „reikšmingo“ kasmetinių DI lustų siuntų augimo.
Ankstesnės kartos „M890“ lustą „Alibaba“ pristatė gegužės mėnesį.
Tarp atvirų svorių dirbtinio intelekto modelių „Qwen 3.8“ užima garbingą vietą su daugiau kaip 100 kalbų palaikymu. Lietuvių kalbos palaikymas jame yra vienas iš aukščiausių tarp atviro kodo DI.
Lietuvių ir latvių bendra entuziastų grupė išleido „TildeOpen-30B“ Base atviro kodo modelį (su 30 mlrd parametrų), skirtą konkrečiai mažų tautinių grupių kalbų palaikymui – tokių kaip latviai, suomiai, estai, lietuviai ir t.t.
Tačiau šis modelis nėra skirtas bendravimui daugumai įprastu būdu – tai „base“ tipo modelis, o ne „instruct“ prie kurio esame įpratę, tad jo naudojimas yra specifinis.
→ Šis straipsnis nemokamas. Parengti jį ir išlaikyti čia – kainuoja.. Paremkite infa.lt


658

