Skip to content

Commit 2a1d495

Browse files
authored
[benchmark] Correct input_tokens accumulation in backend_request_func (#8104)
* Correct input_tokens accumulation in backend_request_func Fix token accumulation by replacing '+=' with assignment. * Delete benchmarks/backend_request_func_swe.py
1 parent e6f72db commit 2a1d495

2 files changed

Lines changed: 2 additions & 1532 deletions

File tree

benchmarks/backend_request_func.py

Lines changed: 2 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -857,7 +857,7 @@ async def async_request_eb_openai_chat_completions_multi_turn(
857857
return outputs, metrics
858858

859859
# llm_cost = s1 - s0
860-
input_tokens += output.prompt_tokens
860+
input_tokens = output.prompt_tokens
861861
output_tokens += output.output_tokens
862862

863863
# 更新output_ids
@@ -971,7 +971,7 @@ async def async_request_eb_openai_chat_completions_multi_turn(
971971
)
972972
return outputs, metrics
973973

974-
input_tokens += output.prompt_tokens
974+
input_tokens = output.prompt_tokens
975975
output_tokens += output.output_tokens
976976
# 若session输入长度超过max_prompt_len,则停止session
977977
if max_prompt_len and input_tokens >= max_prompt_len:

0 commit comments

Comments
 (0)