naeel
14c8984ed2
debug(llm): показать HTTP-версию в ошибке
2026-06-14 07:51:06 +04:00
naeel
8cb7139924
fix(llm): httpx + h2 раздельно в requirements
...
httpx[http2] мог не парситься платформой. httpx и h2 отдельными строками.
2026-06-14 07:45:15 +04:00
naeel
a684d51169
fix(llm): h2+socket вместо curl — HTTP/2 на чистом Python
...
h2 — pure Python, ставится без компиляции в slim-контейнерах.
ssl.create_default_context() + ALPN h2 + h2.connection.H2Connection.
2026-06-14 07:44:21 +04:00
naeel
099edbcb61
fix(llm): curl --http2 вместо httpx
...
httpx требует h2, который не ставится в облаке.
curl есть везде и гарантированно держит HTTP/2.
subprocess.run(['curl','-s','--http2',...])
2026-06-14 07:40:12 +04:00
naeel
59048308e4
fix(llm): httpx с HTTP/2 вместо requests
...
api.aillm.ru за ddos-guard — требует HTTP/2. requests (HTTP/1.1) не работал.
httpx[http2] — поддержка HTTP/2, работает с ddos-guard.
2026-06-14 07:27:16 +04:00
naeel
c580c935ac
fix(llm): модель gpt-oss-120b, max_tokens 8000
...
Доступные модели на api.aillm.ru: whisper, qwen3.6-27b, gpt-oss-120b.
gpt-oss-120b — та самая 120B модель.
max_tokens поднят до 8000 (reasoning съедает часть токенов).
2026-06-14 07:22:10 +04:00
naeel
44e53edc72
feat(llm): llm_client.py — HTTP-клиент к aillm.ru
...
ask(prompt, model, max_tokens) → {text, model, usage} | {error}
OpenAI-совместимый формат, temperature=0.1 для стабильности.
Переменные: LLM_API_URL, LLM_API_KEY.
2026-06-14 07:00:04 +04:00