Справка / Чат

Чат.

Метод POST /v1/chat/completions. Тело такое же, как у OpenAI. Подходит официальный клиент, если указать эту базу и ключ Yourstack.

Вызов.

curl -sD - https://yourstack.ru/v1/chat/completions \
  -H "Authorization: Bearer esli_…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [{"role": "user", "content": "Объясни стек в одном предложении."}]
  }'

Короткое имя модели раскрывается в полный идентификатор. Можно передать и полное имя. Ответ JSON не дополняется полями стоимости, чтобы клиенты OpenAI его принимали. Списание приходит в заголовках X-Yourstack-Cost-Rub и X-Yourstack-Balance-Rub.

Клиент OpenAI.

from openai import OpenAI
client = OpenAI(base_url="https://yourstack.ru/v1", api_key="esli_…")
reply = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[{"role": "user", "content": "Привет"}],
)

Ограничения тела.

От 1 до 200 сообщений. max_tokens и max_completion_tokens, если указаны, должны быть от 1 до 16384. Неизвестная модель и yourstack-decide в этом методе отклоняются: решение вызывается отдельно.

Вход и выход считаются отдельно, по цене выбранной модели. Число токенов берётся из usage.prompt_tokens и usage.completion_tokens. Сумма округляется вверх до 0,01 ₽. Таблица цен — в разделе моделей.