fix(llm): модель gpt-oss-120b, max_tokens 8000

Доступные модели на api.aillm.ru: whisper, qwen3.6-27b, gpt-oss-120b.
gpt-oss-120b — та самая 120B модель.
max_tokens поднят до 8000 (reasoning съедает часть токенов).
This commit is contained in:
2026-06-14 07:22:10 +04:00
parent fe8a5563bf
commit c580c935ac
+2 -2
View File
@@ -15,10 +15,10 @@ import requests
# ── Конфигурация ────────────────────────────────────────────────
DEFAULT_URL = "https://api.aillm.ru/v1/chat/completions"
DEFAULT_MODEL = "deepseek-chat" # DeepSeek V3 на aillm.ru (120B эквивалент)
DEFAULT_MODEL = "gpt-oss-120b" # 120B модель через LiteLLM-прокси
def ask(prompt: str, model: str = None, max_tokens: int = 4000) -> dict:
def ask(prompt: str, model: str = None, max_tokens: int = 8000) -> dict:
"""
Отправить промпт к LLM API.