Skip to content

Commit 0d624c6

Browse files
authored
Merge pull request #1583 from lyj715824/bugfix/superteam
fix(agent): harden CoT parsing and avoid duplicate LLM calls
2 parents 776b7b8 + 142ae27 commit 0d624c6

4 files changed

Lines changed: 903 additions & 96 deletions

File tree

core/agent/domain/models/base.py

Lines changed: 10 additions & 15 deletions
Original file line numberDiff line numberDiff line change
@@ -19,22 +19,17 @@ class BaseLLMModel(BaseModel):
1919
model_config = ConfigDict(arbitrary_types_allowed=True)
2020

2121
async def create_completion(self, messages: list, stream: bool) -> Any:
22-
llm_object = await self.llm.chat.completions.create(
23-
messages=messages,
24-
stream=stream,
25-
model=self.name,
26-
timeout=int(os.getenv("DEFAULT_LLM_TIMEOUT", "90")),
27-
)
28-
if os.getenv("DEFAULT_LLM_MAX_TOKEN"):
29-
llm_object = await self.llm.chat.completions.create(
30-
messages=messages,
31-
stream=stream,
32-
model=self.name,
33-
timeout=int(os.getenv("DEFAULT_LLM_TIMEOUT", "90")),
34-
max_tokens=int(os.getenv("DEFAULT_LLM_MAX_TOKEN", "8000")),
35-
)
22+
request_kwargs = {
23+
"messages": messages,
24+
"stream": stream,
25+
"model": self.name,
26+
"timeout": int(os.getenv("DEFAULT_LLM_TIMEOUT", "90")),
27+
}
28+
max_tokens = os.getenv("DEFAULT_LLM_MAX_TOKEN")
29+
if max_tokens:
30+
request_kwargs["max_tokens"] = int(max_tokens)
3631

37-
return llm_object
32+
return await self.llm.chat.completions.create(**request_kwargs)
3833

3934
def _log_messages_to_span(self, sp: Span, messages: list) -> None:
4035
for message in messages:

0 commit comments

Comments
 (0)