Skip to main content
POST
Chat completions
POST /v1/chat/completions 是最常用的对话生成接口,支持流式输出、函数调用(tools/functions)以及 JSON mode。

请求示例

常见用法

  • 流式输出:在请求体中设置 stream: true。cURL 请添加 -N 选项,Python 端可组合 requests.post(..., stream=True) 逐行读取。
  • 函数调用:通过 toolstool_choice 描述可调用的函数,后续在响应中解析 tool_calls 并执行业务逻辑。
  • JSON 约束:配合 response_format 设置为 {"type": "json_schema"},可让模型严格返回结构化数据。
PhanEdge 会自动对齐常见第三方兼容实现中的差异字段,减少模型切换带来的适配成本。

PhanEdge 扩展字段

以下字段是 PhanEdge 在标准 OpenAI 响应体基础上的扩展,用于暴露上游模型的计费明细。

usage.prompt_tokens_details

其中 prompt_tokens 为输入 token 总量(含缓存命中与缓存写入)。缓存写入相关字段为 omitempty,GPT 等无缓存写入的模型不会输出。
结合 计费对账 中的单价字段,可直接从响应体实时估算单次请求的缓存写入费用。

Authorizations

Authorization
string
header
required

Authorization: Bearer

Body

application/json

The body is of type object.

Response

200 - application/json

OK

The response is of type object.