GLM.vLLM
GLM foundation-model testing on vLLM + EKS (invite-only)
Sign in
Models
แต่ละโมเดล = 1 Deployment (scale-to-zero). กด Start = Karpenter provision GPU node (~5-9 นาที) แล้ว vLLM โหลด weight. กด Stop = node consolidate (~1-2 นาที) หยุดค่า GPU.
Chat
Vision
อัปโหลดรูป (base64) แล้วถามโมเดล vision (GLM-4.5V/4.6V/4.6V-Flash).