统一接入
OpenAI 兼容协议
完全兼容
/v1/chat/completions、/v1/embeddings、/v1/images/generations、/v1/audio/*、/v1/responses、/v1/realtime 等接口。Claude 原生协议
提供
/v1/messages 端点,支持 system prompt、工具调用、视觉输入及 thinking 模式。Gemini 原生协议
提供
/v1beta/models/{model}:generateContent 端点,完整支持多模态输入与函数调用。格式转换
OpenAI ⇄ Claude / OpenAI → Gemini / Gemini → OpenAI 等格式自动转换。
模型覆盖
完整模型清单见 模型总览。
计费与额度
- 按量计费:按上游官方倍率折算 Token,缓存命中按更低倍率结算。
- 令牌级配额:为每个 API Key 单独设置可用额度、过期时间、模型范围。
- 充值与发票:由专属代理人协助人工充值,可按需开具发票。
高可用路由
多通道负载
同一模型可绑定多个上游通道,按权重随机分流。
失败重试
上游错误自动切换到健康通道,客户端无感重试。
速率限制
支持用户级 / 模型级 RPM、TPM 限流,保护后端稳定性。
实时监控
控制台提供请求量、消耗、错误率仪表盘。
进阶能力
- 思考链:支持 OpenAI
reasoning_effort、Claudethinking、Geminithinking_budget。 - 函数调用:OpenAI Tools / Claude Tool Use / Gemini Function Calling 全协议互通。
- 结构化输出:
response_formatJSON Schema 强约束输出。 - 多模态输入:图片(URL / base64)、PDF、音频 chunk 等。
- 流式响应:SSE 流、Server-Sent Events,完整兼容 OpenAI 流协议。
账号与日志
- 邮箱 / GitHub / Discord / Telegram / LinuxDO / OIDC 多种登录方式。
- 2FA / WebAuthn / Passkey 双重验证。
- 不记录 prompt / 响应内容,只在控制台回查每次调用的模型、Token 用量与扣费明细。
- 支持私有化部署。