fix: In the runner, every 8 tokens yield

This commit is contained in:
Dong_master
2025-08-03 23:23:51 +08:00
parent 48d11540ae
commit 44ac8b2b63
4 changed files with 20 additions and 20 deletions
@@ -189,7 +189,6 @@ class OpenAIChatCompletions(requester.LLMAPIRequester):
delta_message.is_final = True delta_message.is_final = True
delta_message.content = current_content delta_message.content = current_content
if chunk_idx % 64 == 0 or delta_message.is_final:
yield delta_message yield delta_message
# return # return
@@ -195,5 +195,4 @@ class GiteeAIChatCompletions(chatcmpl.OpenAIChatCompletions):
delta_message.is_final = True delta_message.is_final = True
delta_message.content = current_content delta_message.content = current_content
if chunk_idx % 64 == 0 or delta_message.is_final:
yield delta_message yield delta_message
@@ -286,7 +286,6 @@ class ModelScopeChatCompletions(requester.LLMAPIRequester):
delta_message.is_final = True delta_message.is_final = True
delta_message.content = current_content delta_message.content = current_content
if chunk_idx % 64 == 0 or delta_message.is_final:
yield delta_message yield delta_message
# return # return
+3
View File
@@ -47,6 +47,7 @@ class LocalAgentRunner(runner.RequestRunner):
else: else:
# 流式输出,需要处理工具调用 # 流式输出,需要处理工具调用
tool_calls_map: dict[str, llm_entities.ToolCall] = {} tool_calls_map: dict[str, llm_entities.ToolCall] = {}
msg_idx = 0
async for msg in query.use_llm_model.requester.invoke_llm_stream( async for msg in query.use_llm_model.requester.invoke_llm_stream(
query, query,
query.use_llm_model, query.use_llm_model,
@@ -54,6 +55,8 @@ class LocalAgentRunner(runner.RequestRunner):
query.use_funcs, query.use_funcs,
extra_args=query.use_llm_model.model_entity.extra_args, extra_args=query.use_llm_model.model_entity.extra_args,
): ):
msg_idx = msg_idx + 1
if msg_idx % 8 == 0 or msg.is_final:
yield msg yield msg
if msg.tool_calls: if msg.tool_calls:
for tool_call in msg.tool_calls: for tool_call in msg.tool_calls: