logo

Chat Completions

POST /v1/chat/completions — основной чат-эндпоинт, совместимый с OpenAI.

curl https://llmoxy.com/v1/chat/completions \
  -H "Authorization: Bearer <LLMOXY_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-4o-mini",
    "messages": [
      { "role": "system", "content": "Be concise." },
      { "role": "user", "content": "What is LLMoxy?" }
    ]
  }'

Тело запроса

Основные поля:

ПолеОписание
modelОбязательно. ID модели.
messagesОбязательно. Массив сообщений диалога.
temperature, top_p, n, stopПараметры управления сэмплированием, передаются совместимому провайдеру.
max_tokens, max_completion_tokensОграничения на выходные токены.
streamУстановите true для включения потоковой передачи SSE.
stream_options.include_usageВозвращает usage в потоковых ответах, если провайдер поддерживает.
tools, tool_choiceВызов инструментов в стиле OpenAI.
response_formatЗапрос структурированного вывода для поддерживаемых моделей.
reasoning_effortПоддерживаемые модели рассуждения могут использовать low, medium, high.
modalities, audioДоступно для моделей с поддержкой мультимодального аудио.
userНеобязательно. Для идентификации вашего конечного пользователя.

Разные модели поддерживают разные параметры. Если в ответе указано, что параметр не поддерживается, удалите его или смените модель.

Потоковый вывод

{
  "model": "gpt-4o-mini",
  "stream": true,
  "messages": [
    { "role": "user", "content": "Stream one sentence." }
  ]
}

Ответы используют SSE-чанки в стиле OpenAI и завершаются [DONE].

Вызов инструментов

{
  "model": "gpt-4o-mini",
  "messages": [
    { "role": "user", "content": "What is the weather in Singapore?" }
  ],
  "tools": [
    {
      "type": "function",
      "function": {
        "name": "get_weather",
        "description": "Get the current weather for a city.",
        "parameters": {
          "type": "object",
          "properties": {
            "city": { "type": "string" }
          },
          "required": ["city"]
        }
      }
    }
  ]
}

Модели с поддержкой вызова инструментов получают определения инструментов и возвращают ответы в стиле OpenAI.

Устаревшие completions

Клиенты устаревшего текстового дополнения могут использовать POST /v1/completions.