GLM.vLLM
GPU node ที่เปิดอยู่กำลังคิดค่าใช้จ่าย — กด Stop เมื่อเลิกใช้

GLM.vLLM

GLM foundation-model testing on vLLM + EKS (invite-only)

Sign in

Models

แต่ละโมเดล = 1 Deployment (scale-to-zero). กด Start = Karpenter provision GPU node (~5-9 นาที) แล้ว vLLM โหลด weight. กด Stop = node consolidate (~1-2 นาที) หยุดค่า GPU.

Chat

Vision

อัปโหลดรูป (base64) แล้วถามโมเดล vision (GLM-4.5V/4.6V/4.6V-Flash).

preview