diff --git a/docs/source/performance/perf-overview.md b/docs/source/performance/perf-overview.md index ae751112d947..891cc310ef89 100644 --- a/docs/source/performance/perf-overview.md +++ b/docs/source/performance/perf-overview.md @@ -202,7 +202,6 @@ trtllm-bench --model $model_name throughput --dataset $dataset_file --backend py ```yaml pytorch_backend_config: - enable_overlap_scheduler: true use_cuda_graph: true cuda_graph_padding_enabled: true cuda_graph_batch_sizes: diff --git a/tests/integration/defs/test_e2e.py b/tests/integration/defs/test_e2e.py index 812f983a6a75..1af65de89179 100644 --- a/tests/integration/defs/test_e2e.py +++ b/tests/integration/defs/test_e2e.py @@ -1354,7 +1354,6 @@ def test_ptp_quickstart_advanced_deepseek_v3_2nodes_8gpus( "trtllm-llmapi-launch", "python3", str(example_root / "quickstart_advanced.py"), - "--enable_overlap_scheduler", "--model_dir", f"{llm_models_root()}/{model_path}", "--moe_ep_size=8",