diff --git a/benchmarks/multi_node/srt-slurm-recipes/vllm/deepseek-v4/8k1k/disagg-b200-low-latency.yaml b/benchmarks/multi_node/srt-slurm-recipes/vllm/deepseek-v4/8k1k/disagg-b200-low-latency.yaml index 2a449451b4..7549794136 100644 --- a/benchmarks/multi_node/srt-slurm-recipes/vllm/deepseek-v4/8k1k/disagg-b200-low-latency.yaml +++ b/benchmarks/multi_node/srt-slurm-recipes/vllm/deepseek-v4/8k1k/disagg-b200-low-latency.yaml @@ -17,7 +17,7 @@ name: "svf-vllm-disagg-b200-low-latency" # absorb cold-cache model loads. model: path: "deepseek-v4-pro" - container: "vllm/vllm-openai:v0.20.1" + container: "vllm/vllm-openai:v0.23.0" precision: "fp4" dynamo: @@ -131,7 +131,7 @@ benchmark: identity: container: - image: "vllm/vllm-openai:v0.20.1" + image: "vllm/vllm-openai:v0.23.0" frameworks: dynamo: "1.2.0.dev20260426" - vllm: "0.20.0" + vllm: "0.23.0"