Következő generációs mesterséges intelligencia-modellel állt elő egy kínai startup
Új, nagy teljesítményű mesterséges intelligencia-modellt mutatott be a kínai Zhipu AI startup. A GLM-5.3 a vállalat szerint ez jelentős előrelépést hoz a programozásban és az MI-ügynökök képességei terén - miközben több fontos teszten is az élmezőnybe került a nyílt forráskódú modellek között.
A Zhipu AI kínai mesterséges intelligencia-startup augusztus 14-én mutatta be következő generációs alapmodelljét, a GLM-5.3-at, amely a vállalat állítása szerint a kódolás és az MI-ügynökök területén már megközelíti a Claude Fable 5 képességeit.
A Zhipu AI szerint az új modell nemcsak a programozásban és a komplex feladatok megoldásában hoz fejlődést, hanem a kínai nyílt forráskódú MI-modellek lehetőségeit is tovább bővíti.
A vállalat kiemelte: az egyik új fontos terület a kiberbiztonság lehet. Az egyre fejlettebb MI-ügynökök ugyanis már képesek lehetnek sérülékenységek azonosítására, szoftverek önálló működtetésére és összetett feladatok végrehajtására, egyre kisebb emberi beavatkozás mellett.
Több százmilliárd paraméter
A GLM-5.3 összesen 743 milliárd paraméterrel rendelkezik. A Zhipu AI szerint azonban a teljesítmény növekedése nem elsősorban a modell méretének növeléséből származik.
A fejlesztések jelentős részét a modell utólagos tanítása, vagyis a post-training során érték el.

Következő generációs mesterséges intelligencia-modellel állt elő egy kínai startup
A vállalat szerint ennek köszönhetően a GLM-5.3 különösen a programozási és összetett mérnöki feladatok végrehajtásában mutatott jelentős fejlődést.
A Zhipu által közzétett technikai jelentés alapján a modell a Terminal-Bench 3.0 teszten 28,3 pontot ért el – ez a legmagasabb eredmény a nyílt forráskódú modellek között, s meghaladta a Moonshot AI Kimi K3 modelljének teljesítményét is.
Egy másik, kifejezetten szoftverfejlesztési képességeket vizsgáló teszten, a DeepSWE 1.1-en a GLM-5.3 66,9 pontot szerzett.
Az MI-ügynökök is fontos szerepet kapnak
A Zhipu AI szerint a GLM-5.3 több vezető benchmarkon is a legerősebb nyílt forráskódú modellek közé került.
A vállalat kiemelte a modell kódolási és MI-ügynöki képességeit, amelyek szerinte már megközelítik a Claude Fable 5 szintjét.
A Zhipu hozzátette: a GLM-5.3 gyakorlati programozási teljesítménye a többi kínai MI-modellét is meghaladja.
A fejlesztés jól mutatja, hogy a kínai mesterségesintelligencia-piac egyre nagyobb hangsúlyt helyez az olyan modellekre, amelyek nem csupán szöveget generálnak vagy kérdésekre válaszolnak, hanem összetett feladatokat is képesek önállóan végrehajtani.
A következő időszak egyik fontos kérdése ezért az lehet, hogy az egyre fejlettebb MI-ügynökök mennyire lesznek képesek önállóan működtetni szoftvereket, programozási feladatokat megoldani és akár kiberbiztonsági problémákat is felismerni.
A GLM-5.3 bemutatása újabb jele annak, hogy Kína továbbra is intenzíven fejleszti saját, nyílt forráskódú mesterségesintelligencia-modelljeit, s egyre inkább versenyre törekszik a vezető nemzetközi rendszerekkel.
Forrás: Chinadaily.com
B.A.
