diff --git a/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml b/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml index 17648fbba1..c62e227aeb 100644 --- a/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml +++ b/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml @@ -60,7 +60,7 @@ spec: runtime: vllm modelCache: claimName: qwen36-27b-vllm-cache - image: docker.io/tcclaviger/vllm:latest@sha256:dfb67a2c947e995978c03fb7e1d7a0b0601cf3d9958865df1659b165a367153f + image: docker.io/tcclaviger/vllm:latest@sha256:a1db5e3ee5d2547dad224147e22c5bf95537485a5c4144d42045a56158d1ef73 replicas: 0 vllmConfig: maxModelLen: 180000