Het verhaal
GLM-5.3 gebruikt dezelfde basis als GLM-5.2. Z.ai zegt dat alle winst uit post-training komt: meer omgevingen, meer diverse taken en meer compute op de bestaande stack. Het model is volgens het bedrijf sterker in complexe coding en lange-horizon-taken. Thinking kan niet meer worden uitgezet; de niveaus zijn low, high en max, met max als default en aanbevolen voor coding. Wie nog thinking.type disabled stuurt, moet eerst migreren, anders faalt het request.
Op de interne Z.ai Code Bench claimt het bedrijf 50 procent winst ten opzichte van 5.2. Op Terminal Bench 3.0 gaat de score van 4,6 naar 28,3; op DeepSWE v1.1 van 46,2 naar 66,9. Z.ai noemt het de sterkste open-weights coding-model en claimt open-source SOTA op Terminal Bench 3.0 en Agents’ Last Exam. Op de interne bench zou GLM-5.3 bij High effort 31,4 procent halen met ongeveer 50K output-tokens, boven Claude Opus 4.8, maar achter Claude Fable 5.
Naast coding wijst Z.ai op emergente cybercapaciteit. Op CyberGym scoort GLM-5.3 84,5 procent. Op ExploitBench verdubbelt het bijna 5.2 (54,4 versus 24,4). Samenwerking met Chinese security-teams leverde 2.436 bevindingen in 269 projecten op, waarvan 1.097 medium tot hoog; 53 zijn publiek, de rest onder embargo. Open gewichten volgen over twee weken na safety-evaluatie.
GLM-5.3 staat al in GLM Coding Plan en ZCode. Het Coding Plan werkt met punten; buiten piekuren (14:00–18:00 UTC+8, maandag tot vrijdag) telt 50 procent. ZCode belooft tot 31 augustus extra quota bovenop cache-besparing.