Responses
POST /v1/responses指定した入力に対してモデル応答を生成します。OpenAI Responses API と互換です。
リクエストボディ
Section titled “リクエストボディ”| パラメータ | 型 | 必須 | 説明 |
|---|---|---|---|
model | string | はい | モデル ID |
input | string | array | はい | テキスト文字列 (ユーザーメッセージとして扱われる) または入力アイテムの配列 |
instructions | string | いいえ | コンテキストの先頭に追加されるシステム / デベロッパーメッセージ |
stream | boolean | いいえ | SSE でストリーミング。デフォルト: false |
temperature | number | いいえ | サンプリング温度 (0〜2) |
top_p | number | いいえ | Nucleus サンプリング (0〜1) |
max_output_tokens | integer | いいえ | 生成トークン数の上限 |
tools | array | いいえ | モデルが呼び出し可能な関数ツール |
tool_choice | string | object | いいえ | "none"、"auto"、"required"、または特定のツール |
parallel_tool_calls | boolean | いいえ | 並列ツール呼び出しを許可 |
reasoning | object | いいえ | { "effort": …, "summary": "auto"|"concise"|"detailed" }。effort はモデルごとに検証されます — 受け付ける値はそのモデルの reasoning_efforts で、それ以外は 400 になります。 |
truncation | string | いいえ | "auto" (コンテキストに収まるよう切り詰め) または "disabled" |
previous_response_id | string | いいえ | マルチターン会話を継続 |
store | boolean | いいえ | 後から取得できるようレスポンスを保存 |
metadata | object | いいえ | トラッキング用のキーバリューペア |
text | object | いいえ | テキストレスポンスフォーマットの設定 |
seed | integer | いいえ | 決定論的サンプリングのシード |
stop | string | string[] | いいえ | 最大 4 つの停止シーケンス |
top_k | integer | いいえ | Top-k サンプリング (プロバイダ依存) |
repetition_penalty | number | いいえ | 繰り返しペナルティ (プロバイダ依存) |
単純な文字列:
{ "model": "deepseek-ai/deepseek-v4-flash", "input": "Explain quantum computing in one paragraph."}構造化された入力アイテム:
{ "model": "deepseek-ai/deepseek-v4-flash", "input": [ { "role": "user", "content": [ { "type": "input_text", "text": "Describe this image" }, { "type": "input_image", "image_url": "https://..." } ] } ]}入力アイテムのタイプ:
| タイプ | 説明 |
|---|---|
| メッセージ | { "role": "user"|"assistant"|"developer"|"system", "content": string | content[] } |
| 関数呼び出しの出力 | { "type": "function_call_output", "call_id": "...", "output": "..." } |
| アイテム参照 | { "type": "item_reference", "id": "..." } |
コンテンツタイプ: input_text、input_image、input_file
{ "id": "resp_abc123", "object": "response", "status": "completed", "created_at": 1700000000, "model": "deepseek-ai/deepseek-v4-flash", "output": [ { "type": "message", "role": "assistant", "content": [ { "type": "output_text", "text": "Quantum computing uses quantum bits (qubits)..." } ] } ], "usage": { "input_tokens": 15, "output_tokens": 80, "total_tokens": 95 }}レスポンスのステータス
Section titled “レスポンスのステータス”| ステータス | 説明 |
|---|---|
completed | 生成完了 |
failed | 生成失敗 (error フィールドを参照) |
in_progress | 生成中 (ストリーミング) |
incomplete | 途中で停止 (incomplete_details.reason を参照) |
cancelled | リクエストがキャンセルされた |
queued | 処理待ち |
使用量 (usage)
Section titled “使用量 (usage)”| フィールド | 型 | 説明 |
|---|---|---|
input_tokens | integer | 入力で消費したトークン数 |
output_tokens | integer | 生成された出力トークン数 |
total_tokens | integer | 入力と出力の合計 |
input_tokens_details | object | { cached_tokens } |
output_tokens_details | object | { reasoning_tokens } |
マルチターン会話
Section titled “マルチターン会話”previous_response_id を指定すると、履歴全体を再送信せずに会話を継続できます:
{ "model": "deepseek-ai/deepseek-v4-flash", "input": "Now explain it to a 5-year-old.", "previous_response_id": "resp_abc123"}保存されたレスポンスは、API キーのユーザー(およびその組織)にスコープされ、非公開です。別のユーザーや組織が作成した previous_response_id(または item_reference)、あるいは存在しない ID を指定した場合は 404 Not Found を返します。
レスポンスはモデルごとに保存されるため、会話はそのレスポンスを作成したモデルで継続してください。別のモデルに previous_response_id を送った場合も 404 Not Found を返します。