控制台
// 欢迎回来
接入地址
主接口(OpenAI 兼容):
…
余额 (USD)
…
近30天请求
…
近30天 token
快速开始
把
$KEY 换成上面的令牌即可。模型 id 见「模型」页。我的令牌
// 这些令牌只属于你 · 妥善保管
新建令牌
令牌列表
| id | 名字 | 令牌 | 启用 | 用量 | 限速 | 有效期 | 创建 | |
|---|---|---|---|---|---|---|---|---|
| 加载中… | ||||||||
模型
// 当前可路由的模型
仅展示当前有可用 key、且未被标记下线的模型;不可用会自动移除
可用模型
| 模型 id | 来源 |
|---|---|
| 加载中… | |
模型排行
// 按真实调用数据对比,挑选最合适的模型
近 7 天全网真实请求统计。延迟、平均输出按成功请求计算;价格为你实际支付价(已含折扣)。点表头可排序:延迟低=快,价格低=省。
模型对比
| 模型 | 来源 | 响应延迟 ▲ | 成功率 | 价格 $/1M 入/出 | 平均输出 | 近7天调用 |
|---|---|---|---|---|---|---|
| 加载中… | ||||||
响应延迟:开始返回的耗时(流式为首字节 TTFT,非流式为整次往返)。价格 = 每 100 万 token 的美元单价(已含折扣),按输出价排序。样本越多越可信;无成功样本的模型延迟显示 –。
文档
// OpenAI / Anthropic 兼容 · 同一套 SDK 即可接入
接口与鉴权
Chat Completions 接口:
鉴权头:
Authorization: Bearer <你的令牌>
curl
OpenAI SDK
Anthropic 兼容(Claude SDK)
网关同时实现 Anthropic Messages 接口,Claude 官方 SDK / Claude Code 可直接接入:
POST
鉴权:
x-api-key: <你的令牌> 或 Authorization: Bearer <你的令牌>。base_url 用上面的 Base URL,模型 id 与 OpenAI 接口同一套。请求体为 Anthropic 格式:
messages + max_tokens(必填)。响应同样带 X-KeyPool-Provider / X-KeyPool-Model / X-KeyPool-Fallback 响应头(回退后 Model 可能与请求不同)。模型 id
| 模型 id | 来源 |
|---|---|
| 加载中… | |
POST /v1/chat/completions
Base URL(OpenAI
baseURL 用这个):请求体(与 OpenAI 一致;支持
stream:true SSE 流式):网关默认会在所选模型不可用时自动回退到同类可用模型。要关闭回退、强制只用所选模型,加
"fallback": false(此时模型不可用直接返回错误)。响应头
| 响应头 | 含义 |
|---|---|
| X-KeyPool-Provider | 实际命中的供应商(如 gemini) |
| X-KeyPool-Model | 实际使用的模型 id(回退后可能与请求不同) |
| X-KeyPool-Fallback | 出现即表示发生了回退,值为原始请求的模型 |
其它接口
GET /v1/models — 列出当前可路由的模型(仅含有可用 key、且未被标记不可用的模型):GET
原生透传(直接用各家原生协议,网关只负责选 key 与计费):
/gemini/* · /mistral/* · /openrouter/*
把上游的原生路径接在前缀后即可,例如
/gemini/v1beta/models/...:generateContent。鉴权同样用 Authorization: Bearer <你的令牌>。错误码
错误响应为 OpenAI 兼容结构,错误信息在
body.error.message:| 状态码 | 含义 / 处理 |
|---|---|
| 402 | 余额不足 — 充值后重试 |
| 429 | 限流 / 额度超限 — 退避后重试 |
| 4xx | 请求错误(参数 / 模型 id / 鉴权) |
| 5xx | 上游错误 — 稍后重试 |
计费
按 token 计费:每次调用按输入 / 输出 token 数分别结算,价格见管理员配置的「模型价格」。余额不足时请求会被拒绝。用量与流水见「用量」与「余额」页。
总览
// key 池健康度
池子状态
可用 active
–
冷却 cooldown
–
禁用 disabled
–
| 供应商 | 可用 | 冷却 | 禁用 |
|---|---|---|---|
| 加载中… | |||
Key 池
// 导入即上架 · 坏 key 自动下架
导入 key
支持
gemini openai mistral openrouter deepseek groq moonshot glm qwen deepinfra fireworks cerebras ai21 cohere elevenlabs stability。重复自动跳过;坏 key 首次调用即自动禁用。各供应商状态
| 供应商 | 可用 | 冷却 | 禁用 |
|---|---|---|---|
| 加载中… | |||
需要逐个查看?
模型可用性
加载中…
逐个模型试调一次,把不可用的(余额不足 / 模型下线)标灰;不可用的模型不会出现在
/v1/models。Key 列表
// 每个 key 单独查看与操作 · 测活 / 余额(OpenRouter)
所有 key
| 供应商 | key | 请求/失败 | 上次错误 | 测活 / 余额 | 添加时间 | 操作 |
|---|---|---|---|---|---|---|
| 加载中… | ||||||
「测活」实时探测:OpenRouter 显示真实余额;Gemini/Mistral 只能判断是否可用(限流也算可用)。探活成功会自动把禁用/冷却的 key 拉回可用。
用户
// 开通制 · 待开通的排在最上面
用户列表
| 邮箱 | 角色 | 状态 | 创建 | |
|---|---|---|---|---|
| 加载中… | ||||
令牌
// 全局令牌 · 含管理员直发
发令牌
仅显示一次,请立即复制保存
令牌列表
| id | 名字 | 角色 | 归属 | 用量 | RPM | 过期 | 启用 | 创建 | 操作 |
|---|---|---|---|---|---|---|---|---|---|
| 加载中… | |||||||||
聊天
// 选个模型直接聊 · 按 token 计费
剩余余额 – USD
开始对话…
调试聊天
// 用某个 key 直连试聊 · 不走池子 · 不计费
选一个 key,直连试聊…
用量
// 近 30 天 · 你自己的调用
总请求
–
成功率
–
总 token
–
近 14 天请求 成功 失败
按供应商
| 供应商 | 请求 | 成功 | 平均延迟 | token |
|---|---|---|---|---|
| 加载中… | ||||
最近请求
| 时间 | 供应商 | 模型 | 状态 | 延迟 | token | session |
|---|---|---|---|---|---|---|
| 加载中… | ||||||
日志
// 近 30 天 · 全部调用
总请求
–
成功率
–
总 token
–
近 14 天请求 成功 失败
按供应商
| 供应商 | 请求 | 成功 | 平均延迟 | token |
|---|---|---|---|---|
| 加载中… | ||||
用户使用排行 · 近 30 天
| # | 用户 | 请求 | 成功率 | token | 最近 |
|---|---|---|---|---|---|
| 加载中… | |||||
点某一行可只看该用户的日志。
最近请求 第 1 页
| 时间 | 用户 | 供应商 | 模型 | 状态 | 延迟 | token | session |
|---|---|---|---|---|---|---|---|
| 加载中… | |||||||
计费
// 余额 · 充值 · 流水 · 定价
充值
余额总览
余额合计 USD
–
用户数
–
付费用户数
–
| 邮箱 | sub | 余额 USD | |
|---|---|---|---|
| 加载中… | |||
最近流水 最多展示最近 100 条
| 时间 | 用户 | 类型 | 金额 USD | 余额 USD | 模型 | token | 备注 |
|---|---|---|---|---|---|---|---|
| 加载中… | |||||||
模型价格
| 模型 | 输入 $/Mtok | 输出 $/Mtok | |
|---|---|---|---|
| 加载中… | |||
价格以 micro-USD 每 Mtok 存储;按输入/输出 token 分别计费。
余额
// 你的额度与流水
当前余额
余额 USD
–
充值
通过 Stripe 在线支付。支付成功后余额会在确认后自动到账。
最近流水
| 时间 | 类型 | 金额 USD | 余额 USD | 模型 | token | 备注 |
|---|---|---|---|---|---|---|
| 加载中… | ||||||