LLMoxy fournit une route compatible OpenAI Responses :
POST /v1/responses
Si votre application utilise déjà la structure de l'API Responses, ou a besoin de champs tels que input, instructions, reasoning et previous_response_id, vous pouvez utiliser ce point de terminaison.
Requête de base
curl https://llmoxy.com/v1/responses \
-H "Authorization: Bearer <LLMOXY_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"input": "Explain gateway routing in one sentence.",
"instructions": "Be direct."
}'
Champs courants
| Champ | Description |
|---|---|
model | Obligatoire. ID du modèle. |
input | Chaîne ou tableau de style message. |
instructions | Texte d'instruction de niveau système. |
max_output_tokens | Limite de tokens de sortie. |
temperature, top_p | Paramètres de contrôle d'échantillonnage. |
stream | Active le flux lorsque le fournisseur le prend en charge. |
tools, tool_choice | Paramètres d'appel d'outils. |
reasoning.effort | Les modèles de raisonnement pris en charge peuvent utiliser low, medium, high. |
reasoning.summary | Demande un résumé de raisonnement lorsque le fournisseur le prend en charge. |
previous_response_id | Continue la réponse précédente lorsque le fournisseur le prend en charge. |
truncation | auto ou disabled. |
Ce point de terminaison est destiné à la compatibilité. Le comportement réel dépend du modèle sélectionné.
Compression de conversation
LLMoxy fournit également :
POST /v1/responses/compact
Les modèles pris en charge peuvent compresser l'historique de conversation long via ce point de terminaison. L'authentification est identique à celle des autres requêtes /v1.
