接入文档 & 常见问题
本站为 OpenAI 兼容格式的 API 中转服务。本页所有示例均在线上环境实测通过。价格如有调整以控制台「模型价格」页为准。
快速开始(3 分钟接入)
2
充值余额
进入控制台「钱包 → 充值」,按提示完成充值(有问题可扫首页微信二维码联系站长)。
3
创建令牌(API Key)
控制台「令牌」页 → 添加令牌 → 设置名称和额度 → 保存后复制 sk- 开头的密钥。密钥只属于你,请勿泄露。
4
发起第一次调用
把下面示例中的 sk-你的令牌 换成你自己的密钥即可运行。
接入信息
| 接口地址(BASE URL) | https://api.cgltgcg.com(OpenAI SDK 填 https://api.cgltgcg.com/v1) |
| 对话接口 | POST /v1/chat/completions 已实测 |
| 模型列表 | GET /v1/models 已实测 |
| 鉴权方式 | 请求头 Authorization: Bearer sk-你的令牌 |
| 流式输出 | 支持 SSE,请求体加 "stream": true 已实测 |
| 服务器位置 | 香港,大陆直连低延迟,无需代理 |
代码示例
curl
curl https://api.cgltgcg.com/v1/chat/completions \
-H "Authorization: Bearer sk-你的令牌" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "你好"}]
}'
Python(openai 官方 SDK)
from openai import OpenAI
client = OpenAI(
api_key="sk-你的令牌",
base_url="https://api.cgltgcg.com/v1",
)
resp = client.chat.completions.create(
model="gemini-3-flash-preview",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
Python 流式输出
stream = client.chat.completions.create(
model="gemini-3-pro",
messages=[{"role": "user", "content": "写一首七言绝句"}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Node.js(openai 官方 SDK)
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "sk-你的令牌",
baseURL: "https://api.cgltgcg.com/v1",
});
const resp = await client.chat.completions.create({
model: "gemini-3-flash-preview",
messages: [{ role: "user", content: "你好" }],
});
console.log(resp.choices[0].message.content);
常用客户端配置教程
Cherry Studio
设置 → 模型服务 → 添加提供商,类型选 OpenAI:
· API 地址:https://api.cgltgcg.com
· API 密钥:sk-你的令牌
· 点「管理」拉取模型列表,勾选需要的模型即可。
Chatbox
设置 → 模型提供方 → 添加自定义提供方:
· API 模式:OpenAI API 兼容
· API 域名:https://api.cgltgcg.com
· API 路径:/v1/chat/completions
· 填入密钥,模型名手动填(见价格表)。
ChatGPT-Next-Web
设置 → 自定义接口:
· 接口地址:https://api.cgltgcg.com
· API Key:sk-你的令牌
· 自定义模型名:如 gemini-3-pro,gpt-5.4,claude-sonnet-4-6
LobeChat
设置 → 语言模型 → OpenAI:
· API Key:sk-你的令牌
· 接口代理地址:https://api.cgltgcg.com/v1
· 打开「使用客户端请求模式」可获得更快响应。
沉浸式翻译
设置 → 翻译服务 → OpenAI → 自定义 API 接口地址:
· 接口地址:https://api.cgltgcg.com/v1/chat/completions
· APIKEY:sk-你的令牌
· 模型选自定义,填 gemini-3-flash-preview(便宜快速,适合翻译)。
Cline / Roo Code(VS Code)
设置中 API Provider 选 OpenAI Compatible:
· Base URL:https://api.cgltgcg.com/v1
· API Key:sk-你的令牌
· Model ID:如 claude-sonnet-4-6 或 gpt-5.4(写代码推荐)。
模型与价格
价格单位:美元(USD)。文本模型按 token 计费(每百万 token);绘图模型按次计费。实时价格以 控制台价格页 为准。
文本对话模型(按量计费,$ / 1M tokens)
| 模型 | 输入 | 输出 | 说明 |
| gemini-3-flash-preview | $0.75 | $4.50 | 便宜快速,日常/翻译首选 |
| gemini-3-flash-preview-all | $0.75 | $6.00 | flash 全功能版 |
| gemini-3-pro | $3.00 | $18.00 | Gemini 3 Pro 系列 |
| gemini-3-pro-preview | $3.00 | $18.00 |
| gemini-3-pro-thinking | $3.00 | $18.00 |
| gemini-3.1-pro-preview | $3.00 | $18.00 |
| gpt-5.4-mini | $1.13 | $6.75 | 缓存输入 ×0.1 |
| gpt-5.4 | $3.75 | $22.50 | 缓存输入 ×0.1 |
| gpt-5.5 | $7.50 | $45.00 | 缓存输入 ×0.1 |
| gpt-5.4-2026-03-05 | $0.75 | $4.50 | codex 分组专属,缓存 ×0.1 |
| claude-sonnet-4-6 | $4.50 | $22.50 | 写代码推荐 |
| claude-opus-4-6 | $7.50 | $37.50 | Claude 旗舰 |
绘图 / 图像模型(按次计费,$ / 次)
| 模型 | 单价 | 模型 | 单价 |
| gemini-3.1-flash-image-preview | $0.195 | gemini-3-pro-image-preview | $0.375 |
| gemini-3.1-flash-image-preview-2k | $0.613 | gemini-3-pro-image-preview-2k | $1.029 |
| gemini-3.1-flash-image-preview-4k | $0.696 | gemini-3-pro-image-preview-4k | $1.757 |
| nanobanana-2-c | $0.195 | gemini-3-pro-image-preview-vip | $1.713 |
| nanobanana-pro-c | $0.375 | gemini-3-pro-image-preview-2k-vip | $2.790 |
| gpt-image-2 | $0.132 | gemini-3-pro-image-preview-4k-vip | $3.750 |
| gpt-image-2-vip | $0.180 | | |
提示:绘图模型同样走 /v1/chat/completions 对话接口,直接用自然语言描述要画的图即可,按调用次数扣费,与提示词长度无关。
常见问题
报错 401:无效的令牌 / Invalid token
① 检查密钥是否完整复制(以 sk- 开头);② 令牌是否被删除或禁用;③ 令牌是否设置了 IP 白名单;④ 确认请求头格式为 Authorization: Bearer sk-xxx(Bearer 后有空格)。
报错 403:余额不足 / 令牌额度已用尽
先看控制台「钱包」余额,再看「令牌」页该令牌的剩余额度——两者是独立的:令牌额度用完但账户有钱时,编辑令牌调高额度或勾选「无限额度」即可。
报错 429:请求过于频繁
触发了限流,稍等几秒重试即可。程序调用建议加指数退避重试(大多数 SDK 自带,如 openai SDK 的 max_retries)。
请求超时 / 长时间无响应怎么办?
思考类模型(thinking / pro 系列)首字延迟可达几十秒,属正常现象。建议:① 开启 "stream": true 流式输出,边生成边返回;② 客户端超时设置调到 300 秒以上。本站服务端超时为 600 秒。
计费规则是怎样的?为什么输出 token 比我看到的字多?
按「输入 token × 输入单价 + 输出 token × 输出单价」实时扣费,调用明细在控制台「日志」页可查。思考类模型的推理过程(reasoning tokens)计入输出 token,因此输出计费量可能大于最终可见文字。
支持哪些接口格式?Claude / Gemini 模型怎么调?
本站统一使用 OpenAI 兼容格式,所有模型(含 claude、gemini 系列)都走 /v1/chat/completions,无需区分厂商格式,换模型只改 model 字段即可。
令牌安全建议
① 不同用途建不同令牌并设额度上限,泄露时损失可控;② 不要把密钥提交到 GitHub 或写进前端代码;③ 怀疑泄露立即在控制台删除该令牌并新建。
大陆网络能直连吗?需要代理吗?
可以直连,无需任何代理。服务器在香港,大陆访问延迟低;如遇网络波动可稍后重试或联系站长。
充值 / 价格 / 合作咨询
扫
首页微信二维码联系站长。模型价格可能随上游调整,以控制台「模型价格」页实时显示为准。