vllm.models.glm5next.nvidia ¶ Modules: attention – kda – GLM-5.3-Flash KDA layer with separate convolutions and a bounded safe gate. model – mtp – multimodal – GLM-5.3-Flash vision tower and multimodal processor. ops –