fix(llm): модель gpt-oss-120b, max_tokens 8000
Доступные модели на api.aillm.ru: whisper, qwen3.6-27b, gpt-oss-120b. gpt-oss-120b — та самая 120B модель. max_tokens поднят до 8000 (reasoning съедает часть токенов).
This commit is contained in:
+2
-2
@@ -15,10 +15,10 @@ import requests
|
||||
# ── Конфигурация ────────────────────────────────────────────────
|
||||
|
||||
DEFAULT_URL = "https://api.aillm.ru/v1/chat/completions"
|
||||
DEFAULT_MODEL = "deepseek-chat" # DeepSeek V3 на aillm.ru (120B эквивалент)
|
||||
DEFAULT_MODEL = "gpt-oss-120b" # 120B модель через LiteLLM-прокси
|
||||
|
||||
|
||||
def ask(prompt: str, model: str = None, max_tokens: int = 4000) -> dict:
|
||||
def ask(prompt: str, model: str = None, max_tokens: int = 8000) -> dict:
|
||||
"""
|
||||
Отправить промпт к LLM API.
|
||||
|
||||
|
||||
Reference in New Issue
Block a user