AI 改造 投资与并购 出海 网关 公开案例 API 文档
更多:关于 / 白皮书 / 验收基线 / 公开账本 / 花名册 —— 见页脚
登录EN[email protected]
算一笔账
● GATEWAY · IN PRODUCTION

接入只改一行,每一笔都记账

OpenAI 兼容 API:base_url 指过来,一把密钥直达 117 个模型。
每次调用当场记一行流水——模型、tokens、成本、延迟,可审计、可分账。

# 现有代码零改动,只换一行
client = OpenAI(
  base_url="https://api.tokenpower.ai/v1",
  api_key=os.environ["TOKENPOWER_API_KEY"]
)
resp = client.chat.completions.create(
  model="qwen-flash"# 或 qwen-plus / DeepSeek-V3.1-Fast / claude-opus-4-8 …
  messages=[…]
)
收费口径 · 先说清楚

模型单价与厂商官网一比一

厂商官网多少,你就多少——不加价、不打折、不套倍率;厂商调价,我们跟着调。所以我们不是「更便宜的通道」:同一个模型,我们的价和你直接找厂商买是同一个数。token 直通不是我们的生意——网关是改造服务的配套,收入只来自驻场改造。收费细则都写在 Bootcamp 页 →

网关只做四件事 · 共用一条审计链

多模型接入

一把密钥、117 个模型。换模型改一个字段,不锁定任何厂商。

全链路审计

模型、tokens、成本、延迟、发起人、策略命中,逐笔入账。审计不是日志,是产品。

策略与限流

权限、配额、内容策略在网关层强制执行——治理不靠模型自觉。

预算与分账

按团队、项目分账;预算上限、超额告警,计量到每一个 token。

七道门 · 每一道被拦的调用都记在账上

一条请求进来依次过:密钥有效性 → 到期 → 来源 IP → 限流 → 可调模型 → 余额与预算 → 策略。被门挡下的调用照样记一行,写明是哪道门挡的——排错时你自己就能查出来,不用来问我们。

密钥四件套

每把密钥单独设:到期时间 · 来源 IP 白名单(IPv4/CIDR)· 每分钟上限 · 可调模型名单。被 IP 拦时错误里回显你这次的来源 IP,照着贴进白名单就能自己解决。只有管理员能建密钥、改设置。

策略四类

模型白名单 · 敏感词 · 数据出域(邮箱/手机/身份证/银行卡/密钥)· 频率上限。四类都在网关层判,命中即拦并记下是哪条策略拦的。频率类回 429 + retry-after,其余回 403。

归因到人、到业务流

每一笔带发起人与业务流两列,账本和审计页都能按它们筛。密钥可以绑一条业务流,你的客户端一行代码都不用改。机器密钥背后没有人,我们就留空——不编。

模型映射

你代码里写死的模型名可以映射到另一个模型,客户端零改动。映射生效时账上同时记下你请求的原名和实际落到的模型——我们不会在背后换了模型还不留痕。

模型列表

不做货架页。接上之后 GET /v1/models 实时返回完整模型清单。其中部分厂商目录经我们的 AWS 云与模型产品授权代理资质提供)。今天有什么、明天上什么,以接口返回为准。

端点

按 token 计价、直接可用:/v1/chat/completions /v1/responses /v1/embeddings /v1/rerank,逐笔进你的流水。
图像生成与语音默认关闭。它们按张 / 按字符 / 按秒计费,我们的价格表目前只有 token 维度。与其按 0 元放行、让你看到一本不扣费的假账,不如先关着。需要用就联系我们开通,开通后照样逐笔记流水并如实标注「未计价」。

它在平台里的位置

网关是四层平台的底座

落地服务的每一笔账,都从这一层的审计链开始。网关已在生产环境跑真实流量——这是我们敢按结果收费的底气。

这条流水怎么读成一本账,看控制台 →

DEPLOY · 关键环境部署
AGENTS · 可信执行
GRAPH · 业务对象图谱
GATEWAY · 模型接入与治理 ● 已在生产

API 之上,还有整套改造服务

网关解决接入与治理;驻场工程师把 AI 落成账上见数的结果