レスポンスヘッダ
ai& は OpenAI / Anthropic 形式のレスポンスボディに変更を加えず、リクエストのメタデータは HTTP ヘッダで提供します。これにより公式 SDK とのワイヤ形式互換性が保たれます。
識別 / トレース
Section titled “識別 / トレース”| ヘッダ | 説明 |
|---|---|
X-Request-ID | トレース対象の API ルート(推論、認証、課金、Files)におけるこのリクエストの一意 ID。サポート問い合わせ時に添付してください。 |
traceparent | OpenTelemetry のコンテキスト伝播で使用するヘッダ。トレース対象の推論ルートと auth/files/billing の HTTP リクエストでは、受信値を受け入れるか新しいトレースを開始し、可能な場合は下流へ伝播して、サーバーのトレースコンテキストをレスポンスで返します。これにより分散トレースを関連付けられます。 |
X-Model | 実際にリクエストを処理したモデルのカタログ名(小文字化)。解決後の名前を返すため、送信した値と大文字小文字が異なる場合があります。予約名 auto を使用した場合、選択されたモデルが報告される唯一の場所です。比較は大文字小文字を区別せずに行ってください。 |
コストメトリクス(オプトイン)
Section titled “コストメトリクス(オプトイン)”コスト・計測系のヘッダはデフォルトでは送出されません。リクエストヘッダ X-Aiand-Metrics: true を付与した場合のみ、非ストリーミングのレスポンスに付与されます:
| ヘッダ | 説明 |
|---|---|
X-Cost | リクエストのコスト(請求通貨建て)。 |
X-Cost-Currency | X-Cost の通貨(usd または jpy)。 |
X-Inference-Ms | 上流モデルがレスポンス生成に要した時間(ミリ秒)。 |
トークン数はヘッダでは提供されません — レスポンスボディの usage ブロックを参照してください。
reasoning effort
Section titled “reasoning effort”| ヘッダ | 説明 |
|---|---|
X-Reasoning-Effort | effort を送信したリクエストにおいて、実際に適用されたレベル (chat / text completions と /v1/messages では reasoning_effort、/v1/responses では reasoning.effort)。常にそのモデルの公開レベルのいずれかです。送信しなかった場合は付与されません — その場合はモデル自身のデフォルトが適用され、当社が値を補うことはありません。 |
モデルが受け付けない effort を送信した場合、通常は有効な値を列挙した 400 で拒否されます — モデルごとの値は reasoning_efforts を参照。一部のモデルは拒否せずサポート対象のレベルにフォールバックする設定になっており、その場合このヘッダは送信した値と異なります。課金対象の reasoning トークンは、要求したレベルではなく適用されたレベルのものです。この違いが重要な場合は、リクエストの値と比較してください。
レート制限ヘッダの一覧は レート制限 を参照。
ストリーミング
Section titled “ストリーミング”ストリーミングレスポンスでは X-Request-ID は即時送出されますが、コストヘッダは付与されません。X-Aiand-Metrics: true を付与すると、chat completions のストリームではモデルの終端メッセージの後にトークン数・コスト・通貨を含む event: metrics の trailer イベントが追加されます。ストリーミングイベント を参照。