diff --git a/.github/configs/amd-master.yaml b/.github/configs/amd-master.yaml index a41ac8839a..f6166699aa 100644 --- a/.github/configs/amd-master.yaml +++ b/.github/configs/amd-master.yaml @@ -2525,7 +2525,7 @@ dsv4-fp4-mi355x-atom-disagg: # https://github.com/vllm-project/recipes/commit/2a3728ed9892debfd767a72a58ebc90b33f186e5 # MXFP8 runs from TP=4 on gfx950; block size 128 is mandatory for MSA. minimaxm3-fp8-mi355x-vllm: - image: vllm/vllm-openai-rocm:minimax-m3 + image: vllm/vllm-openai-rocm:nightly-3f5a1e1733200760169ff31ebe60a271072b199e model: MiniMaxAI/MiniMax-M3-MXFP8 model-prefix: minimaxm3 runner: mi355x diff --git a/perf-changelog.yaml b/perf-changelog.yaml index e829cf9976..1cbadb492f 100644 --- a/perf-changelog.yaml +++ b/perf-changelog.yaml @@ -4295,3 +4295,10 @@ - "Update the MiniMax-M3 MXFP8 MI355X vLLM EAGLE3 benchmark image from vllm/vllm-openai-rocm:minimax-m3 to vllm/vllm-openai-rocm:nightly-3f5a1e1733200760169ff31ebe60a271072b199e." - "Benchmark configuration, EAGLE3 draft model, serving flags, and search space are unchanged." pr-link: https://github.com/SemiAnalysisAI/InferenceX/pull/1941 + +- config-keys: + - minimaxm3-fp8-mi355x-vllm + description: + - "Update the MiniMax-M3 MXFP8 MI355X vLLM image from vllm/vllm-openai-rocm:minimax-m3 to vllm/vllm-openai-rocm:nightly-3f5a1e1733200760169ff31ebe60a271072b199e." + - "Benchmark serving flags and TP/EP/DP-attention search space are unchanged." + pr-link: https://github.com/SemiAnalysisAI/InferenceX/pull/1942