LLMoxy предоставляет маршрут, совместимый с OpenAI Responses:
POST /v1/responses
Если ваше приложение уже использует структуру Responses API, или требует полей таких как input, instructions, reasoning и previous_response_id, вы можете использовать этот эндпоинт.
Базовый запрос
curl https://llmoxy.com/v1/responses \
-H "Authorization: Bearer <LLMOXY_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"input": "Explain gateway routing in one sentence.",
"instructions": "Be direct."
}'
Основные поля
| Поле | Описание |
|---|---|
model | Обязательно. ID модели. |
input | Строка или массив в стиле сообщений. |
instructions | Системный инструкционный текст. |
max_output_tokens | Ограничение на выходные токены. |
temperature, top_p | Параметры управления сэмплированием. |
stream | Включает потоковый вывод, если провайдер поддерживает. |
tools, tool_choice | Параметры вызова инструментов. |
reasoning.effort | Поддерживаемые модели рассуждения могут использовать low, medium, high. |
reasoning.summary | Запрашивает сводку рассуждения, если провайдер поддерживает. |
previous_response_id | Продолжает предыдущий ответ, если провайдер поддерживает. |
truncation | auto или disabled. |
Этот эндпоинт предназначен для совместимости. Фактическое поведение зависит от выбранной модели.
Сжатие диалога
LLMoxy также предоставляет:
POST /v1/responses/compact
Поддерживаемые модели могут сжимать длинную историю разговора через этот эндпоинт. Аутентификация такая же, как и для других запросов /v1.
