fix(llm): модель gpt-oss-120b, max_tokens 8000
Доступные модели на api.aillm.ru: whisper, qwen3.6-27b, gpt-oss-120b. gpt-oss-120b — та самая 120B модель. max_tokens поднят до 8000 (reasoning съедает часть токенов).
This commit is contained in:
+2
-2
@@ -15,10 +15,10 @@ import requests
|
|||||||
# ── Конфигурация ────────────────────────────────────────────────
|
# ── Конфигурация ────────────────────────────────────────────────
|
||||||
|
|
||||||
DEFAULT_URL = "https://api.aillm.ru/v1/chat/completions"
|
DEFAULT_URL = "https://api.aillm.ru/v1/chat/completions"
|
||||||
DEFAULT_MODEL = "deepseek-chat" # DeepSeek V3 на aillm.ru (120B эквивалент)
|
DEFAULT_MODEL = "gpt-oss-120b" # 120B модель через LiteLLM-прокси
|
||||||
|
|
||||||
|
|
||||||
def ask(prompt: str, model: str = None, max_tokens: int = 4000) -> dict:
|
def ask(prompt: str, model: str = None, max_tokens: int = 8000) -> dict:
|
||||||
"""
|
"""
|
||||||
Отправить промпт к LLM API.
|
Отправить промпт к LLM API.
|
||||||
|
|
||||||
|
|||||||
Reference in New Issue
Block a user