外观
快速开始
这篇帮助你完成一次最小文本请求。如果你只想使用编程工具,可以完成前两步后直接阅读 Codex 教程。
1. 准备账号和余额
注册成功不代表已有额度。当前在线充值未启用,也不承诺注册赠送额度。 如果余额为零,可以先阅读文档并准备配置,待账号有可用额度后再发起请求;不要反复尝试调用或寻找不存在的充值按钮。
2. 创建 API Key
在控制台打开「API 密钥」,创建用于本次接入的 Key:
- 名称填写便于识别的用途,例如“本地开发”。
- 设置合适的有效期与有限额度;分组使用账号可用的选项。
- 若设置模型限制,允许你要调用的模型。保存并妥善保管 Key。
账户余额和 Key 剩余额度都需要足够;Key 的“无限配额”不会增加账户余额。字段含义和停用方式见 API Key 管理。
3. 设置 Key 并确认模型
以下命令适用于 Bash(macOS、Linux 或 Windows 的 WSL / Git Bash)。先输入 bash 进入 Bash,再隐藏输入本站 Key:
bash
read -r -s -p '请输入本站 API Key:' TOKEN_RELAY_API_KEY
printf '\n'
export TOKEN_RELAY_API_KEY输入不会回显,也不会将 Key 字面值写入命令历史。不要把真实 Key 写进代码、截图或聊天记录。用完后执行 unset TOKEN_RELAY_API_KEY。
在同一个 Bash 会话查询当前 Key 可见的模型:
bash
curl --fail-with-body -sS https://api.avanovo.com/v1/models \
-H "Authorization: Bearer ${TOKEN_RELAY_API_KEY}"响应中的 data[].id 是请求需要的模型 ID。下面使用 gpt-6-astra,请先确认当前 Key 可见且允许使用 Responses 协议。模型列表可见不代表所有协议或功能均受支持;不要随意把示例替换为任意型号。
4. 发出一次文本请求
需要 curl 7.76 或更新版本,以支持 --fail-with-body。该请求会消耗可用额度;准备好后在同一 Bash 会话执行:
sh
curl --fail-with-body -sS -i https://api.avanovo.com/v1/responses \
-H "Authorization: Bearer ${TOKEN_RELAY_API_KEY}" \
-H 'Content-Type: application/json' \
-d '{"model":"gpt-6-astra","stream":false,"max_output_tokens":256,"input":[{"role":"user","content":"请用一句话介绍你自己。"}]}'-i 同时显示响应头与 JSON 正文。成功时应得到 HTTP 200,正文中 status 为 completed,并在 output 中找到文本消息。结构示意如下,实际文本和用量会不同:
json
{
"status": "completed",
"output": [{
"type": "message",
"role": "assistant",
"content": [{"type": "output_text", "text": "这里是模型生成的回答。"}]
}]
}如果状态为 incomplete,可能触及输出预算;这不等于完整完成。只看到 HTTP 200 或部分文本,还需要核对响应状态。SDK 提供的 output_text 便利属性与原始 JSON 的 output 数组不同。
5. 找到本次日志
记录请求时间、模型 ID 和响应头中的 X-Oneapi-Request-Id。在控制台「使用日志」按时间与模型找到对应记录,查看用量及费用;在「钱包」查看余额变化。日志明细说明见使用日志。
失败时先按排障步骤检查地址、Key、模型权限和额度。不要用连续重试来判断是否成功。
下一步
- 应用开发:使用 SDK,或阅读 Responses 的流式与多轮说明。
- 已有 Chat 应用:查看 Chat Completions。
- 完成操作后执行
unset TOKEN_RELAY_API_KEY,清除当前会话的变量。