Қытайлық Z.ai компаниясы GLM-5.3 салмақтарын ашық жариялауды жоспарлаған еді, бірақ киберқабілеттерін бағалағаннан кейін шығарылымды екі аптаға кейінге қалдырды. CyberGym тестінде модель 84,5% жинап, Anthropic компаниясының жабық Mythos 5 моделінен (83,8%) сәл озып шықты. Ал табылған осалдықтарды жұмыс істейтін эксплоиттерге айналдыру жағынан америкалық модель әлдеқайда жақсы нәтиже көрсетуде.
Не болды:
2026 жылғы 14 тамызда Z.ai (Zhipu AI компаниясының халықаралық бренді) 743 миллиард параметрі бар жаңа GLM-5.3 open-weight моделін таныстырды, оның шамамен 40 миллиарды әр токенге белсенді. Архитектурасы GLM-5.2-мен бірдей: өнімділіктің барлық өсімі жаңа негізгі модельді оқытпай-ақ, пост-тренинг ауқымын кеңейту есебінен алынды. Салмақтардың жария шығарылымы екі аптаға кейінге қалдырылды.
Жасанды интеллектінің бастапқы кодтағы осалдықтарды табу және растау қабілетін бағалайтын CyberGym тестінде GLM-5.3 84,5% жинады. Бұл Anthropic компаниясының жабық Mythos 5 моделінің 83,8%-нан және OpenAI компаниясының GPT-5.6 Sol моделінің 83,6%-нан жоғары. Нәтижелер Z.ai компаниясының өз деректеріне негізделген, тәуелсіз тексеруден өтпеген.
Қорғаныста мықты, шабуылда әлсіздеу:
GLM-5.3 моделі пайдаланудың барлық кезеңінде бірдей басымдық көрсетпейді. Табылған осалдықтарды жұмыс істейтін эксплойттарға айналдыру қабілетін өлшейтін ExploitBench тестінде модель 54,4% нәтиже көрсетті — бұл алдыңғы GLM-5.2 нұсқасынан (24,4%) 2,2 есе жоғары, бірақ Mythos 5 (78%) пен GPT-5.6 Sol (76,5%) көрсеткіштерінен айтарлықтай төмен.
Уақыты шектелген тапсырмада GLM-5.3 екі сағат ішінде шабуыл әзірлеу бойынша 105 тапсырманы орындады, ал Mythos 5 181 тапсырманы орындап шықты.
2 436 осалдық, соның ішінде 45 жылдық осалдық та бар:
Z.ai компаниясы NSFOCUS, CyberKunlun, DARKNAVY қауіпсіздік командаларымен және Цинхуа мен Нанькай университеттерінің зерттеушілерімен бірлесіп, 269 ашық бастапқы кодты жобадан 2 436 осалдық тапты. Табылғандардың 1 097-і критикалық немесе жоғары деңгейге бағаланды. Ең көне осалдық 1981 жылы енгізілген, багтың табылғанға дейінгі орташа өмір сүру мерзімі 26,6 жылды құрады.
Z.ai табылған осалдықтардың әлеуетті құнын bug bounty мен vulnerability acquisition нарықтарындағы төлемдер мен бағалармен салыстыра отырып, шамамен ¥30 млн (~$4,4 млн) деп бағалады. Релиз кезінде 53 осалдық жария етілді, 2 383-і эмбарго астында қалып отыр.
Табылғандардың арасында — ЖИ код редакторы Cursor-дағы «әлеуетті түрде елеулі осалдық» бар. Z.ai деректері бойынша, Cursor жақында SpaceX компаниясына сатып алынған; VentureBeat Cursor компаниясынан пікір сұратты, жарияланым сәтінде жауап әлі күтіліп отыр.
Неліктен релиз кейінге қалдырылды:
GLM-5.2 моделінің салмақтары іске қосылғаннан кейін бірнеше күн ішінде HuggingFace платформасында MIT лицензиясымен жарияланған болатын. Ал GLM-5.3 қауіпсіздік бағалауы аяқталғаннан кейін, шамамен 28 тамызда ашық қолжетімділікке шығады. Компанияның айтуынша, бұл GLM тарихындағы бірінші жағдай — кідірту модельдің жаңа киберқабілеттеріне байланысты болып отыр, экспорттық қысымға немесе платформа саясатына емес.
Шілдеде британдық AISI GLM-5.2 моделінің киберміндеттер бойынша жабық frontier-модельдерге жақындағанын көрсетті: алшақтық шамамен 4–7 айға бағаланды. GLM-5.2 моделінің симуляцияланған cyber range ортасында 100 миллиондық token-budget жүгіртуінің есептік құны шамамен $46 болды, ұқсас жабық модельдерде бұл көрсеткіш ~$85 құрады. AISI бөлек атап өткендей, олардың тестілеу орталары нақты желілердің бірқатар қорғанысын қамтымайды — мысалы, active defenders.
Киберқауіпсіздіктің сезімтал функциялары тек верификацияланған пайдаланушыларға арналған «сенімді қолжетімділік» бағдарламасы арқылы қолжетімді болады.
Open-weight жарысының жаңа шегі:
GLM-5.3 тарихы open-weight жарысының жаңа шегін көрсетеді. Ашық модельдер frontier-жүйелерден жарты жылдан астам артта қалып жатқанда, салмақтарды жариялау ең алдымен экожүйені жеделдету тәсілі ретінде қабылданды. Алшақтық бірнеше айға дейін қысқарғанда, ашық қолжетімділіктің артықшылықтарымен қатар, әзірлеуші релизден кейін қайтарып ала алмайтын мүмкіндіктер де таралады.
Open Source Shield:
Z.ai компаниясы open-source жобаларды аудиттеу және модельге қорғаныстық қолжетімділік беру мақсатында Open Source Shield бастамасын іске қосты. Мейнтейнерлер осалдықтарды автоматты іздеу және үйлестірілген патчинг үшін өздерінің GitHub репозиторийлерін жібере алады.
«Ашық әлемде тек ашық шабуыл беттері ғана бола алмайды, — деп жазды компания X желісінде. — Онда ашық қалқан да болуы керек».
Кодтау бенчмарктері:
Киберқауіпсіздіктен бөлек, GLM-5.3 Terminal-Bench 3.0 бойынша open-weight модельдер арасында ең жоғары нәтиже көрсетті — 28,3 балл (GLM-5.2 4,6 балл жинаған), Moonshot AI компаниясының Kimi K3 моделінен (17,4) озып шықты. DeepSWE 1.1 бойынша модель 66,9 балл жинады (GLM-5.2-де 46,2 балл болатын).
Дегенмен Terminal-Bench 3.0 бойынша жабық модельдер алда келеді: GPT-5.6 Sol — 34,6, Claude Fable 5 — 33,7. DeepSWE 1.1 бойынша GPT-5.6 Sol 72,7, Fable 5 69,7 балл жинайды.
Контекст:
Z.ai — Mythos деңгейіндегі мүмкіндіктер туралы мәлімдеген бірінші қытайлық компания емес. 2026 жылдың маусымында киберқауіпсіздік саласындағы 360 компаниясы өзінің Tulongfeng жүйесі ұқсас көрсеткіштерге жеткенін мәлімдеді, бірақ бұл мәлімдемелер де тәуелсіз растауға ие болған жоқ.
GLM-5.3 GLM-5.2 моделінің жетістігін жалғастырып отыр — ол төмен құн кезінде жетекші америкалық модельдерге жақындайтын мүмкіндіктерінің арқасында шетелдік әзірлеушілер арасында танымал болды.
Похожие материалы
Китайская GLM-5.3 обогнала Mythos 5 в тесте на поиск уязвимостей — и отложила релиз собственных весов
авг. 19, 2026
Nvidia ЖИ-агенттердің жаппай тапсырмалары үшін Nemotron 3.5 Lightning шығарды
авг. 13, 2026
Nvidia выпустила Nemotron 3.5 Lightning для массовых задач ИИ-агентов
авг. 13, 2026