From 78883e69b888a43020e89bb3a84eb762ef37ba6e Mon Sep 17 00:00:00 2001 From: "renovate[bot]" <29139614+renovate[bot]@users.noreply.github.com> Date: Fri, 24 Jul 2026 17:01:27 +0000 Subject: [PATCH] =?UTF-8?q?fix(container):=20update=20image=20vllm/vllm-op?= =?UTF-8?q?enai-rocm=20(b72e4ac=20=E2=9E=94=20f0a8653)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml b/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml index 9d9725a76b..456058cdaf 100644 --- a/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml +++ b/kubernetes/apps/ai/llmkube/models/qwen36-27b-vllm.yaml @@ -73,7 +73,7 @@ spec: modelCache: claimName: qwen36-27b-vllm-cache # Use the ROCm nightly with the required AMD kernel support. - image: vllm/vllm-openai-rocm:nightly@sha256:b72e4aca14bae0f853cca1bb71bcf17dae30ef2e2f9ec39485f4da0506383380 + image: vllm/vllm-openai-rocm:nightly@sha256:f0a8653e39a9cdc1640654ea5a184bf83caf77fc1439a1a07d1e550e601c7e05 replicas: 0 # Limit concurrent sequence slots to fit the model's cache budget. parallelSlots: 8