接入文档 & 常见问题

本站为 OpenAI 兼容格式的 API 中转服务。本页所有示例均在线上环境实测通过。价格如有调整以控制台「模型价格」页为准。

快速开始 接入信息 代码示例 客户端教程 模型价格 常见问题

快速开始(3 分钟接入)

1
注册账号
打开 api.cgltgcg.com/sign-up 注册并登录。
2
充值余额
进入控制台「钱包 → 充值」,按提示完成充值(有问题可扫首页微信二维码联系站长)。
3
创建令牌(API Key)
控制台「令牌」页 → 添加令牌 → 设置名称和额度 → 保存后复制 sk- 开头的密钥。密钥只属于你,请勿泄露。
4
发起第一次调用
把下面示例中的 sk-你的令牌 换成你自己的密钥即可运行。

接入信息

接口地址(BASE URL)https://api.cgltgcg.com(OpenAI SDK 填 https://api.cgltgcg.com/v1
对话接口POST /v1/chat/completions 已实测
模型列表GET /v1/models 已实测
鉴权方式请求头 Authorization: Bearer sk-你的令牌
流式输出支持 SSE,请求体加 "stream": true 已实测
服务器位置香港,大陆直连低延迟,无需代理

代码示例

curl

curl https://api.cgltgcg.com/v1/chat/completions \
  -H "Authorization: Bearer sk-你的令牌" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "你好"}]
  }'

Python(openai 官方 SDK)

from openai import OpenAI

client = OpenAI(
    api_key="sk-你的令牌",
    base_url="https://api.cgltgcg.com/v1",
)

resp = client.chat.completions.create(
    model="gemini-3-flash-preview",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

Python 流式输出

stream = client.chat.completions.create(
    model="gemini-3-pro",
    messages=[{"role": "user", "content": "写一首七言绝句"}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Node.js(openai 官方 SDK)

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "sk-你的令牌",
  baseURL: "https://api.cgltgcg.com/v1",
});

const resp = await client.chat.completions.create({
  model: "gemini-3-flash-preview",
  messages: [{ role: "user", content: "你好" }],
});
console.log(resp.choices[0].message.content);

常用客户端配置教程

Cherry Studio

设置 → 模型服务 → 添加提供商,类型选 OpenAI
· API 地址:https://api.cgltgcg.com
· API 密钥:sk-你的令牌
· 点「管理」拉取模型列表,勾选需要的模型即可。

Chatbox

设置 → 模型提供方 → 添加自定义提供方:
· API 模式:OpenAI API 兼容
· API 域名:https://api.cgltgcg.com
· API 路径:/v1/chat/completions
· 填入密钥,模型名手动填(见价格表)。

ChatGPT-Next-Web

设置 → 自定义接口:
· 接口地址:https://api.cgltgcg.com
· API Key:sk-你的令牌
· 自定义模型名:如 gemini-3-pro,gpt-5.4,claude-sonnet-4-6

LobeChat

设置 → 语言模型 → OpenAI:
· API Key:sk-你的令牌
· 接口代理地址:https://api.cgltgcg.com/v1
· 打开「使用客户端请求模式」可获得更快响应。

沉浸式翻译

设置 → 翻译服务 → OpenAI → 自定义 API 接口地址:
· 接口地址:https://api.cgltgcg.com/v1/chat/completions
· APIKEY:sk-你的令牌
· 模型选自定义,填 gemini-3-flash-preview(便宜快速,适合翻译)。

Cline / Roo Code(VS Code)

设置中 API Provider 选 OpenAI Compatible
· Base URL:https://api.cgltgcg.com/v1
· API Key:sk-你的令牌
· Model ID:如 claude-sonnet-4-6gpt-5.4(写代码推荐)。

模型与价格

价格单位:美元(USD)。文本模型按 token 计费(每百万 token);绘图模型按次计费。实时价格以 控制台价格页 为准。

文本对话模型(按量计费,$ / 1M tokens)

模型输入输出说明
gemini-3-flash-preview$0.75$4.50便宜快速,日常/翻译首选
gemini-3-flash-preview-all$0.75$6.00flash 全功能版
gemini-3-pro$3.00$18.00Gemini 3 Pro 系列
gemini-3-pro-preview$3.00$18.00
gemini-3-pro-thinking$3.00$18.00
gemini-3.1-pro-preview$3.00$18.00
gpt-5.4-mini$1.13$6.75缓存输入 ×0.1
gpt-5.4$3.75$22.50缓存输入 ×0.1
gpt-5.5$7.50$45.00缓存输入 ×0.1
gpt-5.4-2026-03-05$0.75$4.50codex 分组专属,缓存 ×0.1
claude-sonnet-4-6$4.50$22.50写代码推荐
claude-opus-4-6$7.50$37.50Claude 旗舰

绘图 / 图像模型(按次计费,$ / 次)

模型单价模型单价
gemini-3.1-flash-image-preview$0.195gemini-3-pro-image-preview$0.375
gemini-3.1-flash-image-preview-2k$0.613gemini-3-pro-image-preview-2k$1.029
gemini-3.1-flash-image-preview-4k$0.696gemini-3-pro-image-preview-4k$1.757
nanobanana-2-c$0.195gemini-3-pro-image-preview-vip$1.713
nanobanana-pro-c$0.375gemini-3-pro-image-preview-2k-vip$2.790
gpt-image-2$0.132gemini-3-pro-image-preview-4k-vip$3.750
gpt-image-2-vip$0.180
提示:绘图模型同样走 /v1/chat/completions 对话接口,直接用自然语言描述要画的图即可,按调用次数扣费,与提示词长度无关。

常见问题

报错 401:无效的令牌 / Invalid token
① 检查密钥是否完整复制(以 sk- 开头);② 令牌是否被删除或禁用;③ 令牌是否设置了 IP 白名单;④ 确认请求头格式为 Authorization: Bearer sk-xxx(Bearer 后有空格)。
报错 403:余额不足 / 令牌额度已用尽
先看控制台「钱包」余额,再看「令牌」页该令牌的剩余额度——两者是独立的:令牌额度用完但账户有钱时,编辑令牌调高额度或勾选「无限额度」即可。
报错 429:请求过于频繁
触发了限流,稍等几秒重试即可。程序调用建议加指数退避重试(大多数 SDK 自带,如 openai SDK 的 max_retries)。
请求超时 / 长时间无响应怎么办?
思考类模型(thinking / pro 系列)首字延迟可达几十秒,属正常现象。建议:① 开启 "stream": true 流式输出,边生成边返回;② 客户端超时设置调到 300 秒以上。本站服务端超时为 600 秒。
计费规则是怎样的?为什么输出 token 比我看到的字多?
按「输入 token × 输入单价 + 输出 token × 输出单价」实时扣费,调用明细在控制台「日志」页可查。思考类模型的推理过程(reasoning tokens)计入输出 token,因此输出计费量可能大于最终可见文字。
支持哪些接口格式?Claude / Gemini 模型怎么调?
本站统一使用 OpenAI 兼容格式,所有模型(含 claude、gemini 系列)都走 /v1/chat/completions,无需区分厂商格式,换模型只改 model 字段即可。
令牌安全建议
① 不同用途建不同令牌并设额度上限,泄露时损失可控;② 不要把密钥提交到 GitHub 或写进前端代码;③ 怀疑泄露立即在控制台删除该令牌并新建。
大陆网络能直连吗?需要代理吗?
可以直连,无需任何代理。服务器在香港,大陆访问延迟低;如遇网络波动可稍后重试或联系站长。
充值 / 价格 / 合作咨询
首页微信二维码联系站长。模型价格可能随上游调整,以控制台「模型价格」页实时显示为准。