OpenAI 兼容 API:base_url 指过来,一把密钥直达 117 个模型。
每次调用当场记一行流水——模型、tokens、成本、延迟,可审计、可分账。
厂商官网多少,你就多少——不加价、不打折、不套倍率;厂商调价,我们跟着调。所以我们不是「更便宜的通道」:同一个模型,我们的价和你直接找厂商买是同一个数。token 直通不是我们的生意——网关是改造服务的配套,收入只来自驻场改造。收费细则都写在 Bootcamp 页 →
一把密钥、117 个模型。换模型改一个字段,不锁定任何厂商。
模型、tokens、成本、延迟、发起人、策略命中,逐笔入账。审计不是日志,是产品。
权限、配额、内容策略在网关层强制执行——治理不靠模型自觉。
按团队、项目分账;预算上限、超额告警,计量到每一个 token。
一条请求进来依次过:密钥有效性 → 到期 → 来源 IP → 限流 → 可调模型 → 余额与预算 → 策略。被门挡下的调用照样记一行,写明是哪道门挡的——排错时你自己就能查出来,不用来问我们。
每把密钥单独设:到期时间 · 来源 IP 白名单(IPv4/CIDR)· 每分钟上限 · 可调模型名单。被 IP 拦时错误里回显你这次的来源 IP,照着贴进白名单就能自己解决。只有管理员能建密钥、改设置。
模型白名单 · 敏感词 · 数据出域(邮箱/手机/身份证/银行卡/密钥)· 频率上限。四类都在网关层判,命中即拦并记下是哪条策略拦的。频率类回 429 + retry-after,其余回 403。
每一笔带发起人与业务流两列,账本和审计页都能按它们筛。密钥可以绑一条业务流,你的客户端一行代码都不用改。机器密钥背后没有人,我们就留空——不编。
你代码里写死的模型名可以映射到另一个模型,客户端零改动。映射生效时账上同时记下你请求的原名和实际落到的模型——我们不会在背后换了模型还不留痕。
不做货架页。接上之后 GET /v1/models 实时返回完整模型清单。其中部分厂商目录经我们的 AWS 云与模型产品授权代理资质提供)。今天有什么、明天上什么,以接口返回为准。
按 token 计价、直接可用:/v1/chat/completions /v1/responses /v1/embeddings /v1/rerank,逐笔进你的流水。
图像生成与语音默认关闭。它们按张 / 按字符 / 按秒计费,我们的价格表目前只有 token 维度。与其按 0 元放行、让你看到一本不扣费的假账,不如先关着。需要用就联系我们开通,开通后照样逐笔记流水并如实标注「未计价」。