跳转到内容

OctaFuse 2.6.0:完善 Vertex AI 鉴权、图片计费与日常调试

发布于

OctaFuse Gateway 2.6.0 重点完善项目级 Vertex AI 的服务账号鉴权与文生图计费,让供应商接入、分时定价和异常请求扣费更明确、更容易核验。

管理后台同步优化了路由编辑、Playground 和 Simulator,并新增 BytePlus、阿里云百炼国际站、Meta Model API、Cerebras、SambaNova、DeepInfra、Novita、Command Code、Hugging Face、Vercel 等供应商导入模板。

一句话看懂 2.6.0:

统一项目级 Vertex AI 的服务账号鉴权,明确图片与时段计费规则,并让日常配置和联调更高效。

01|项目级 Vertex AI 统一使用服务账号鉴权

Section titled “01|项目级 Vertex AI 统一使用服务账号鉴权”

项目级 Vertex AI 现在可以直接在供应商凭证栏粘贴 GCP 服务账号 JSON。Gateway 会在请求发出前自动签名 JWT 并换取 OAuth 2.0 access token,再通过 Authorization: Bearer 调用上游。

同一份服务账号凭证可用于两条 Vertex AI 调用路径:

  • OpenAI 兼容端点.../endpoints/openapi,适合通过 Chat Completions 兼容协议访问 Vertex AI。
  • 原生 Gemini 端点:项目级 publishers/google/models 路径,保持 Gemini 原生请求和响应格式。

服务账号 JSON 不会被拼接到 ?key=,也不会原样发送给上游。通过 OpenAI 兼容端点调用 Google 模型时,如果路由中的 provider_model_name 缺少 google/,Gateway 会自动补齐;原生 Gemini 路径仍使用原模型名。

Playground 与 Proxy 使用同一套凭证解析和 access token 换取流程,因此可以在正式接入业务流量前先验证项目 ID、服务账号权限和上游模型名。

OctaFuse Provider 模板目录筛选出两种 Google Vertex AI 接入方式

在 Provider 页面点击 Import 并搜索 Vertex,即可区分 Express Mode API Key 与项目级服务账号两种接入方式。

图片模型现在通过 image_billing_mode 明确区分两种计费方式:

  • token:根据上游返回的文本和图片 Token 用量计费,适用于 GPT Image、Gemini 图片模型等。
  • per_image:根据确认返回的图片张数计费,可选参考图输入单价,适用于 Seedream、GLM Image、Grok Image 等。

2.6.0 同时统一了失败请求的扣费规则:客户端取消、Gateway 超时、明确的上游 4xx / 5xx、网络错误以及空结果都不扣费。入口预算预检只用于判断请求能否发送到上游,不再作为异常结果的最终扣费依据。

为了避免旧数据被错误解释为按张计费,仅包含旧版 image 块、但没有显式声明 image_billing_mode 的配置将不再扣费;包含有效 image_* Token 单价的旧配置仍按 Token 模式处理。

OctaFuse 模型页面按 Image 类型筛选,并展示按张与按 Token 两类价格

模型列表会直接标出 /img/M,便于在配置路由前先确认图片模型采用按张还是按 Token 计费。

路由的用户计费倍率(Charged)与供应成本倍率(Metered)现在更容易理解:默认倍率用于未命中任何时段的请求;命中每日时段后,时段中填写的倍率直接覆盖默认值。

新配置使用 schedule.mode: "override"。为了兼容历史数据,未设置 mode 的旧配置仍沿用“默认倍率 × 时段倍率”的叠乘规则。

Routes 工作台也同步优化了倍率格式、时段提示和路由拓扑展示,便于在保存前核对实际生效方式。

OctaFuse 路由编辑器展示默认计费倍率与两个每日时段

在同一个路由编辑器中核对客户端入口、上游映射、目录标准价、默认倍率和每日覆盖时段。

04|Playground、Simulator 与供应商目录升级

Section titled “04|Playground、Simulator 与供应商目录升级”

Playground 增加了更多 Chat、Responses、Anthropic 与 Gemini 请求样例,并增强对流式响应、终态用量和 Gemini 工具调用参数的观察。Simulator 则根据选择的客户端请求入口确定协议,更贴近真实客户端经过 Proxy 的调用方式。

OctaFuse Playground 选择单条路由并载入 Tool stream 请求样例

选择单条路由后可直接载入 Tool stream 等请求样例;Playground 不扣减用户预算、不写请求日志,也不执行路由池故障转移。

OctaFuse Simulator 根据 Gemini 模型请求入口提供 OpenAI 与 Gemini 协议选择

Simulator 先选择客户端可见模型和路由组,再按匹配到的请求入口生成协议与请求路径;填写 Proxy 地址和测试密钥后即可验证完整链路。

本次更新还扩充了供应商目录,新增多项国际站、官方模型 API、推理平台和聚合网关预设。官网的供应商目录模型目录已经同步到 v2.6.0。

模型目录中的 gemini-3.1-flash-lite-preview 已调整为 Google 当前使用的 ID gemini-3.1-flash-lite。该模型目前仍处于预览阶段;已导入数据库的旧模型记录不会自动改名,需要删除后重新导入或手动修改。

本版本没有数据库表结构变更。请拉取同版本的 Proxy、Admin 与 migrate 镜像,按现有流程执行一次 migrate Job,再滚动重启 Proxy 与 Admin。

升级前可查看 GitHub Release v2.6.0完整 Changelog

如果 Postgres 中仍保存内置图片模型的旧价目,可先执行:

Terminal window
node scripts/db/migrate-image-billing-modes.mjs --dry-run

确认结果后再使用 --apply。该脚本只自动处理已知的内置模型 ID;MySQL、D1 和自定义模型需要人工核对 image_billing_mode

升级后建议重点验证:

  • 项目级 Vertex AI 的项目 ID、服务账号权限、OpenAI 兼容端点与原生 Gemini 端点。
  • 所有图片模型的 token / per_image 配置,以及取消、超时和上游失败不扣费。
  • 每日时段命中后是否使用覆盖倍率,旧配置是否仍保持原有叠乘行为。
  • Playground 的流式响应与 Gemini 工具调用,以及 Simulator 的真实 Proxy 链路。

2.6.0 没有新增客户端接口,而是集中完善了已有能力的鉴权、计费和运维体验:Vertex AI 凭证不再依赖容易混淆的 ?key= 配置,图片异常请求的扣费边界更加清晰,分时倍率也与管理后台中的实际含义保持一致。

如果 OctaFuse 对你的项目有帮助,欢迎在 GitHub 上点一个 Star。你的关注和反馈,会帮助我们继续完善路由、协议适配与自托管体验。