AUTOOpenAI 兼容 · 自动路由
gemini-*、gemma-* 自动走 Google;Azure 部署名自动走 Azure。
BASE URL
POST /chat/completions 或 POST /responses
| 名称 | 密钥 | 可用范围 | 额度用量 | 过期时间 | 状态 | 创建时间 | 操作 |
|---|---|---|---|---|---|---|---|
|
加载中...
|
|||||||
“历史估算”来自升级前的汇总 Token,只用于报表,不计入子 Key 已用金额。
| 时间 | 密钥名称 | 实际上游 | 端点 | 模型 | 输入 | 缓存命中 | 输出 | 思考 | 总 Token | 估算费用 | 状态 |
|---|---|---|---|---|---|---|---|---|---|---|---|
|
📋
暂无调用日志 |
|||||||||||
本月至今
| 日期 | 币种 | 实际费用 |
|---|---|---|
尚无账单数据 | ||
| 子 Key | 请求 | Token | 估算费用 |
|---|---|---|---|
本期暂无 Azure 调用 | |||
单位按规则原币种显示:Google/Azure 为 USD,TokenHub 为 CNY。所有金额额度统一按调用时保存的汇率折算为 USD;有限金额额度遇到未知价格会在调用上游前停止。
| 供应商 / 规则 | 生效期 | 输入 | 缓存读取 | 缓存写入 | 输出 | 官方来源 |
|---|---|---|---|---|---|---|
读取价格表… | ||||||
| 时间 | 端点 | 输入 | 缓存 | 输出 | 思考 | 费用 | 状态 |
|---|
先按模型能力选择 Base URL,再复制对应示例。
推荐始终使用 Authorization Header,这种方式适用于下面全部 Base URL。
Authorization: Bearer sk-你的子密钥
模型名称相近,但接口协议不同。视频任务不能使用 Chat Completions。
gemini-*、gemma-* 自动走 Google;Azure 部署名自动走 Azure。
POST /chat/completions 或 POST /responses
把 WorkBuddy 固定发送的 Chat 请求转换为 Azure Responses,解决推理与 function tools 冲突。
gpt-5.6-sol、luna、terra 支持 Responses 和 Chat。
POST /chat/completions 或 POST /responses
支持图片生成和 multipart 图片编辑,仍然只向网关发送子 Key。
POST /images/generations 或 /images/edits
使用 WebSocket 实时转写,连接时通过 Authorization 发送子 Key。
gpt-realtime-whisper
适合 generateContent、图片生成,以及需要 Gemini 原生参数的调用。
POST /models/{model}:generateContent
模型 gemini-omni-flash-preview 必须使用 Interactions API。
POST /interactions
异步任务:提交后每 3–5 秒查询。网关按子 Key 隔离任务并在成功后结算。
POST /wand/minimax-video-v2/generation
展开需要的模型类型;示例地址会自动使用当前网关域名。
/chat/completions,WorkBuddy 会自动追加。开启“工具调用”和“推理模式”;关闭“仅思考模式”和“自定义协议”。
409 workbuddy_bridge_state_expired,重新发送上一条用户消息。
ws:// 或 wss://;Authorization 中仍然填写网关子 Key。
usage.total_tokens 读取实际用量,并记到本次使用的子 Key。
total_tokens 结算一次。768P 4 秒约需预留 ¥2(再按后台汇率折合 USD)。
分别列出自动路由入口和 Gemini 原生入口可见的模型。