LLM max_tokens 1000→8000: reasoning-модели тратили весь лимит на размышления и возвращали пустой ответ
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
@@ -20,7 +20,8 @@ class Settings(BaseSettings):
|
||||
LLM_API_KEY: str = os.getenv("LLM_API_KEY", "")
|
||||
LLM_MODEL: str = os.getenv("LLM_MODEL", "")
|
||||
LLM_TIMEOUT: int = int(os.getenv("LLM_TIMEOUT", "120"))
|
||||
LLM_MAX_TOKENS: int = int(os.getenv("LLM_MAX_TOKENS", "1000"))
|
||||
# reasoning-модели тратят max_tokens и на размышления — 1000 им мало
|
||||
LLM_MAX_TOKENS: int = int(os.getenv("LLM_MAX_TOKENS", "8000"))
|
||||
LLM_TEMPERATURE: float = float(os.getenv("LLM_TEMPERATURE", "0.3"))
|
||||
|
||||
@property
|
||||
|
||||
Reference in New Issue
Block a user