LLMoxy は OpenAI Responses 互換ルートを提供します:
POST /v1/responses
アプリケーションがすでに Responses API 構造を使用している場合、または input、instructions、reasoning、previous_response_id などのフィールドが必要な場合は、このエンドポイントを使用できます。
基本リクエスト
curl https://llmoxy.com/v1/responses \
-H "Authorization: Bearer <LLMOXY_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"input": "Explain gateway routing in one sentence.",
"instructions": "Be direct."
}'
常用フィールド
| フィールド | 説明 |
|---|---|
model | 必須。モデル ID。 |
input | 文字列またはメッセージスタイルの配列。 |
instructions | システムレベルの指示テキスト。 |
max_output_tokens | 出力トークン制限。 |
temperature, top_p | サンプリング制御パラメータ。 |
stream | 上流が対応している場合、ストリーミングを有効化。 |
tools, tool_choice | ツール呼び出しパラメータ。 |
reasoning.effort | 推論対応モデルで low、medium、high を使用可能。 |
reasoning.summary | 上流が対応している場合、推論サマリーをリクエスト。 |
previous_response_id | 上流が対応している場合、前回のレスポンスを継続。 |
truncation | auto または disabled。 |
このエンドポイントは互換性を目的としています。実際の動作は選択したモデルに依存します。
会話圧縮
LLMoxy は以下も提供します:
POST /v1/responses/compact
対応モデルはこのエンドポイントを通じて長い会話履歴を圧縮できます。認証方式は他の /v1 リクエストと同じです。
