mingyanmingyan
mingyan

OpenAI Completions API

基于 OpenAI Chat Completions 兼容格式的文本生成接口,当前仅开放 deepseek-v4-flash 模型

POST/gw_llm_power/v1/chat/completions
baseUrlhttp://apillm.globalaiopc.com/gw_llm_power
该接口兼容 OpenAI Chat Completions 请求与响应格式,可使用 OpenAI SDK 或兼容客户端接入。
使用 Authorization 请求头进行身份认证。
请求头要求:
cURL
Authorization: Bearer {{YOUR_API_KEY}}
Content-Type: application/json

支持的模型

当前按模型系列划分如下:

DeepSeek 深度求索

模型图片分析视频分析说明
deepseek-v4-flash不支持不支持适合文本对话、文本生成、摘要、改写、代码辅助等纯文本场景

智谱 GLM

暂无可用模型,后续上线后在此补充。

豆包

暂无可用模型,后续上线后在此补充。

请求参数

modelstring必填
要使用的模型名称。当前请固定传 deepseek-v4-flash
messagesarray必填
对话消息数组。每个消息对象通常包含 rolecontent 字段。
temperaturenumber
采样温度,控制输出的随机性。建议范围为 0 到 2。
top_pnumber
核采样参数。建议与 temperature 二选一调整。
streamboolean
是否启用流式返回。设置为 true 时,响应将以 SSE 格式返回,并以 data: [DONE] 结束。
max_completion_tokensinteger
模型最大输出 token 数。
stopstring/array
停止生成的序列,可传字符串或数组。

Messages 数组结构

rolestring必填
消息角色,可选值:systemuserassistant
contentstring必填
消息内容。deepseek-v4-flash 当前仅支持纯文本内容,不支持图片分析或视频分析的多模态数组。

响应说明

接口返回 OpenAI 兼容格式响应。
idstring
本次对话请求的唯一标识。
objectstring
返回对象类型,通常为 chat.completion
createdinteger
响应创建时间戳。
modelstring
实际使用的模型名称。
choices[].message.rolestring
模型返回消息角色,通常为 assistant
choices[].message.contentstring
模型生成的文本内容。
usage.prompt_tokensinteger
输入 token 数。
usage.completion_tokensinteger
输出 token 数。
usage.total_tokensinteger
总 token 数。

注意事项

  1. 请求地址固定为 http://apillm.globalaiopc.com/gw_llm_power/v1/chat/completions
  2. 请使用 Authorization 请求头传递 API 密钥
  3. deepseek-v4-flash 当前不支持图片分析和视频分析,请仅传纯文本消息
  4. 流式响应使用 SSE 返回,结束标志为 data: [DONE]