特性说明
核心
用量与成本
- 按令牌、模型、渠道逐条记账,日志里能查到每次请求的计费明细
- 区分输入、输出、缓存命中与推理 token,OpenAI、Azure、DeepSeek、Claude、Qwen 等的缓存计费都单独统计
- 支持按次、按量的计费策略配置,以及分组倍率
- 内部充值与额度分配(易支付、Stripe)
鉴权与安全
- OAuth 登录:GitHub、Discord、LinuxDO、Telegram
- OIDC 统一认证
- WebAuthn / Passkeys
- 令牌可限定分组、模型、额度与有效期
智能路由
- 渠道加权随机
- 失败自动重试到其他可用渠道
- 用户级别的模型限流
格式支持与转换
支持的请求格式与转换方向见接口文档。要点是:客户端用一种格式,可以调 到另一种格式的上游,不必为每家上游改代码。
推理力度(Reasoning Effort)
通过模型名后缀控制推理力度,不需要改请求体:
Gemini 还可以用 gemini-2.5-pro-thinking-128 这样的写法直接指定思考预算。
模型与任务类型
对话、响应(Responses)、实时对话(Realtime)、图像、音频、视频、向量、重排序, 以及 Midjourney Proxy 与 Suno 这类异步任务型接口。