Справка / Чат
Чат.
Метод POST /v1/chat/completions. Тело такое же, как у OpenAI. Подходит официальный клиент, если указать эту базу и ключ Yourstack.
Вызов.
curl -sD - https://yourstack.ru/v1/chat/completions \
-H "Authorization: Bearer esli_…" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "Объясни стек в одном предложении."}]
}'
Короткое имя модели раскрывается в полный идентификатор. Можно передать и полное имя. Ответ JSON не дополняется полями стоимости, чтобы клиенты OpenAI его принимали. Списание приходит в заголовках X-Yourstack-Cost-Rub и X-Yourstack-Balance-Rub.
Клиент OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://yourstack.ru/v1", api_key="esli_…")
reply = client.chat.completions.create(
model="glm-5.3-flash",
messages=[{"role": "user", "content": "Привет"}],
)
Ограничения тела.
От 1 до 200 сообщений. max_tokens и max_completion_tokens, если указаны, должны быть от 1 до 16384. Неизвестная модель и yourstack-decide в этом методе отклоняются: решение вызывается отдельно.
Вход и выход считаются отдельно, по цене выбранной модели. Число токенов берётся из usage.prompt_tokens и usage.completion_tokens. Сумма округляется вверх до 0,01 ₽. Таблица цен — в разделе моделей.