Developer guide
接好模型,开始创造。
从创建密钥到第一条请求,一份可以直接用的接入指南。
三步完成接入
地址与鉴权
Base URL
https://pq.678691.xyz/v1
请求头使用 Authorization: Bearer YOUR_API_KEY。SDK 的 Base URL 已含 /v1 时,不要重复添加。
密钥只放在你自己的客户端或服务端环境变量中;不要写入公开网页、截图或代码仓库。
发送第一条对话
示例使用稳定分组的 glm-5.3-flash。使用其他分组时,请同步替换模型 ID。
Python / OpenAI SDK
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["LOTHYS_API_KEY"],
base_url="https://pq.678691.xyz/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[{"role": "user", "content": "你好,Lothys"}],
stream=True,
)
for chunk in response:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="")BASE URL / https://pq.678691.xyz/v1
cURL / 流式对话
curl https://pq.678691.xyz/v1/chat/completions \
-H "Authorization: Bearer $LOTHYS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role": "user", "content": "你好"}],
"stream": true
}' BASE URL / https://pq.678691.xyz/v1
先选分组,再选模型
无敌稳定(首选)
适合常用模型的日常调用。当前支持 GLM 5.3、GLM 5.3 Flash 和 DeepSeek V4.1 Flash,实际列表以控制台为准。
高速稳定分组
独立的备用分组。需要时由你手动切换,模型 ID 使用 bd/ 前缀,价格与首选分组分别计算。
社区福利分组
适合学习与轻量体验。免费上游的并发和可用性可能波动,繁忙时请稍后再试。
读懂价格,不被倍率困扰
本站充值比例为 1:12:实付 1 元获得 12 元站内余额。因此,站内扣费金额和现金实付不是同一个数字。
模型描述中的「官方价 × 倍率 / 折数」已按充值比例折算。查看具体模型说明和消费日志,比单看分组倍率更准确。
首选分组与高速稳定分组均要求账户余额大于 12 元。等于 12 元也未达到门槛;余额不足时接口会给出中文提示。
查看当前模型价格遇到问题时
401:密钥无效或已经过期
检查密钥是否复制完整、是否已被禁用,以及 Authorization 请求头格式。不要用后台登录密码代替 API Key。
403:余额未达到分组要求
按返回的中文提示补充余额,或选择账户有权限使用的其他分组。
429:模型繁忙或请求过快
降低并发并使用退避重试,不要连续快速刷新。免费上游可能有更严格的请求限额。
5xx:上游暂时不可用
保留请求时间、模型名和 request id,稍后重试或联系管理员。需要备用模型时,可手动切换到高速稳定分组;请留意该组独立价格。
模型不在当前分组里
密钥绑定的分组必须提供该模型。0731 是独立型号,不要把 deepseek-v4-flash-0731 与其他 DeepSeek 型号混用。