外观
Chat Completions API
适合已经使用 messages 格式的文本应用。当前教程覆盖基本非流式文本请求;新应用需要多轮工具流程时,优先参考 Responses。
地址与鉴权
POST https://api.avanovo.com/v1/chat/completions,使用本站 API Key 作为 Bearer Token。先完成快速开始的准备步骤。
sh
curl --fail-with-body -sS -i https://api.avanovo.com/v1/chat/completions \
-H "Authorization: Bearer ${TOKEN_RELAY_API_KEY}" \
-H 'Content-Type: application/json' \
-d '{"model":"gpt-6-astra","stream":false,"max_tokens":256,"messages":[{"role":"user","content":"请用一句话介绍你自己。"}]}'示例使用 gpt-6-astra;请确认 Key 可见且允许对应协议。max_tokens 的兼容行为与模型有关,不要将它无条件应用到其他型号。迁移其他客户端时按对应模型要求核对参数。
读取结果
基本文本结果从 choices[].message.content 读取。下面仅为结构示意:
json
{
"choices": [{
"index": 0,
"message": {"role": "assistant", "content": "这里是模型生成的回答。"},
"finish_reason": "stop"
}]
}检查 finish_reason,例如 length 表示可能触及长度限制,不代表完整回答。保存响应头 X-Oneapi-Request-Id,用量和费用到日志核对。
已有应用如何迁移
- 将 SDK Base URL 改为
https://api.avanovo.com/v1。 - 使用本站 Key,选择当前 Key 可见且支持 Chat 协议的模型。
- 保留最小
messages文本请求,先验证基本输出,再逐项恢复应用需要的参数。 - 核对实际请求路径、响应格式与日志,不要只检查客户端“连接成功”的提示。
Chat 的 messages、choices 与 Responses 的 input、output 不可直接互换。不要仅替换 URL 而保留另一种协议的正文。
功能边界
本页不承诺 Chat 的流式、工具、多模态及其他扩展在每个型号上等价支持。本站已有多轮与工具调用依据采用 Responses;相关说明见能力与限制。错误处理见排障。