POST /v1/chat/completions est le principal point de terminaison de chat compatible OpenAI.
curl https://llmoxy.com/v1/chat/completions \
-H "Authorization: Bearer <LLMOXY_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"messages": [
{ "role": "system", "content": "Be concise." },
{ "role": "user", "content": "What is LLMoxy?" }
]
}'
Corps de la requête
Champs courants :
| Champ | Description |
|---|---|
model | Obligatoire. ID du modèle. |
messages | Obligatoire. Tableau de messages de conversation. |
temperature, top_p, n, stop | Paramètres de contrôle d'échantillonnage, transmis aux fournisseurs compatibles. |
max_tokens, max_completion_tokens | Limites de tokens de sortie. |
stream | Définissez sur true pour activer le flux SSE. |
stream_options.include_usage | Renvoie l'usage dans les réponses en flux lorsque le fournisseur le prend en charge. |
tools, tool_choice | Appel d'outils compatible OpenAI. |
response_format | Demande une sortie structurée pour les modèles pris en charge. |
reasoning_effort | Les modèles de raisonnement pris en charge peuvent utiliser low, medium, high. |
modalities, audio | Disponible pour les modèles prenant en charge l'audio multimodal. |
user | Facultatif. Pour votre propre identification d'utilisateur final. |
Les modèles ne prennent pas tous en charge les mêmes paramètres. Si la réponse indique qu'un paramètre n'est pas pris en charge, supprimez-le ou changez de modèle.
Sortie en flux
{
"model": "gpt-4o-mini",
"stream": true,
"messages": [
{ "role": "user", "content": "Stream one sentence." }
]
}
Les réponses utilisent des chunks SSE de style OpenAI et se terminent par [DONE].
Appel d'outils
{
"model": "gpt-4o-mini",
"messages": [
{ "role": "user", "content": "What is the weather in Singapore?" }
],
"tools": [
{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get the current weather for a city.",
"parameters": {
"type": "object",
"properties": {
"city": { "type": "string" }
},
"required": ["city"]
}
}
}
]
}
Les modèles prenant en charge l'appel d'outils reçoivent les définitions d'outils et renvoient des réponses d'appel d'outils compatibles OpenAI.
Anciennes completions
Les anciens clients de complétion de texte peuvent utiliser POST /v1/completions.
