Skip to content
4 changes: 2 additions & 2 deletions vllm/entrypoints/openai/chat_completion/serving.py
Original file line number Diff line number Diff line change
Expand Up @@ -879,7 +879,7 @@
completion_tokens=completion_tokens,
total_tokens=num_prompt_tokens + completion_tokens,
)
if self.enable_prompt_tokens_details and num_cached_tokens:
if self.enable_prompt_tokens_details and num_cached_tokens is not None:
final_usage.prompt_tokens_details = PromptTokenUsageInfo(
cached_tokens=num_cached_tokens
)
Expand Down Expand Up @@ -1303,7 +1303,7 @@
completion_tokens=num_generated_tokens,
total_tokens=num_prompt_tokens + num_generated_tokens,
)
if self.enable_prompt_tokens_details and final_res.num_cached_tokens:
if self.enable_prompt_tokens_details and final_res.num_cached_tokens is not None:

Check failure on line 1306 in vllm/entrypoints/openai/chat_completion/serving.py

View workflow job for this annotation

GitHub Actions / pre-commit

Ruff (E501)

vllm/entrypoints/openai/chat_completion/serving.py:1306:89: E501 Line too long (89 > 88)
usage.prompt_tokens_details = PromptTokenUsageInfo(
cached_tokens=final_res.num_cached_tokens
)
Expand Down
4 changes: 2 additions & 2 deletions vllm/entrypoints/openai/completion/serving.py
Original file line number Diff line number Diff line change
Expand Up @@ -443,7 +443,7 @@ async def completion_stream_generator(
total_tokens=total_prompt_tokens + total_completion_tokens,
)

if self.enable_prompt_tokens_details and num_cached_tokens:
if self.enable_prompt_tokens_details and num_cached_tokens is not None:
final_usage_info.prompt_tokens_details = PromptTokenUsageInfo(
cached_tokens=num_cached_tokens
)
Expand Down Expand Up @@ -583,7 +583,7 @@ def request_output_to_completion_response(
if (
self.enable_prompt_tokens_details
and last_final_res
and last_final_res.num_cached_tokens
and last_final_res.num_cached_tokens is not None
):
usage.prompt_tokens_details = PromptTokenUsageInfo(
cached_tokens=last_final_res.num_cached_tokens
Expand Down
Loading