OpenAI 兼容 · 一个 Key 调 20+ 大模型

模型 API 中转站

一套 OpenAI 兼容接口,接入 DeepSeek、GLM、Kimi、Qwen、MiniMax、MiMo、Grok、Gemini、GPT 等主流大模型。 按真实 token 计费、缓存命中最低 2 折、调用失败不扣点,与站内 AI 写作共用同一份 AI 点数。

注册即送 AI 点数体验 · 无月费、按量计费 · 随时可申请开具发票
20+已上架模型
2 折缓存命中价低至
4 位小数点精度计费
0 点失败调用不扣点
为什么用中转站

不用在每家厂商分别注册、充值、改代码

把多家大模型厂商统一成一种接口、一份账单,换模型只改一个 model 参数。

一个 Key 通吃

同一个接口地址 https://www.wmzls.com/v1、同一个密钥调用全部模型,基座从 DeepSeek 换到 GLM、Kimi、GPT 不用改一行业务代码。

一份钱包结算

模型 API 与站内 AI 写作、生图共用同一份 AI 点数,充值一次两边可用;小额试用多家模型,不必在每家厂商分别压余额。

缓存命中更省

编程工具每轮重发的上下文常被上游缓存命中,这部分只按「缓存命中价」计费(多数模型约为输入价 2 折),长会话账单显著更低。

失败不扣点

上游报错、超时、限流等失败调用一律不扣点数;每条调用都留下模型、token、耗时与状态记录,账单随时可核对。

模型与价格

实时单价,按 token 实扣

单价单位为「AI 点数 / 1K tokens」,精确到 0.0001 点;下表为 1 倍基准价,购买 Coding Plan / Agent Plan 后即按 1 倍消耗。

模型 上下文 输入 · 未命中 点/1K 输入 · 缓存命中 点/1K 输出 点/1K
模型清单加载中…

未开通订阅的用户按 3 倍消耗点数,开通 Coding Plan / Agent Plan 后立即按 1 倍消耗。 调用失败不扣点,调用前会做余额预检,不会产生欠费。

订阅套餐

Coding Plan 与 Agent Plan

按月订阅一个「套餐额度池」:期内调用先抵扣套餐额度(按 1 倍基准价),额度用尽自动回落 AI 点数余额按量计费、不断流。未订阅用户模型 API 按 3 倍消耗,开通后立即回到 1 倍。

面向 Claude Code、Cline、Cursor 等编程场景:套餐额度抵扣模型 API 调用,配合缓存命中价,长会话成本更低。

套餐加载中…

同档续费额度累加、到期顺延;换档时剩余额度自动结转。套餐随时可停,额度用尽自动回落 AI 点数余额,不会中断服务。
登录后在 用户中心 → AI 点数 购买与续费。

快速接入

三步拿到第一次回复

兼容 OpenAI 协议,支持流式输出(stream: true)与 /v1/completions/v1/embeddings

1

创建密钥

控制台 → 模型API → + 新建密钥,生成的 sk-relay-… 只展示一次,请立即保存。

2

填接口地址

把 Base URL 填为 https://www.wmzls.com/v1,API Key 填刚创建的密钥,模型名照抄控制台列表。

3

发起调用

用任意 OpenAI SDK 或客户端发起请求,响应头 X-Credits-Charged 会回传本次扣费。

curl https://www.wmzls.com/v1/chat/completions \
  -H "Authorization: Bearer sk-relay-你的密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Deepseek-v4-flash",
    "messages": [{"role": "user", "content": "用三句话介绍泉州"}],
    "stream": true
  }'
开箱即用

任何支持 OpenAI 接口的客户端都能接

只要客户端支持自定义 Base URL,按下面三个参数配置即可;密钥可分别限速、限额、限模型。

OpenAI 官方 SDK Cursor Cline Cherry Studio Chatbox NextChat 沉浸式翻译 自建应用 / 脚本 / 机器人

Base URL:https://www.wmzls.com/v1 | API Key:你在控制台创建的 sk-relay- 密钥 | 模型:控制台列表里的对外模型名(区分大小写)

计费与安全

账单可算、密钥可控、记录可查

计费公式:未命中缓存输入 ÷ 1000 × 输入单价 + 命中缓存输入 ÷ 1000 × 缓存价 + 输出 ÷ 1000 × 输出单价。

计费规则

  • 按量计费:无月费、无最低消费,用多少扣多少,小数点后 4 位。
  • 失败不扣点:上游报错、超时、限流等失败调用一律不计费。
  • 余额预检:调用前先校验点数余额,不足直接拒绝,不会透支欠费。
  • 订阅更省:开通 Coding Plan / Agent Plan 后,未命中部分按 1 倍基准价消耗,未订阅按 3 倍。
  • 额度兜底:套餐额度用尽自动回落点数余额继续计费,不会中断调用。

安全与治理

  • 密钥哈希存储:明文仅在创建时展示一次,平台无法反查明文。
  • 细粒度限额:可设每分钟请求数、并发数、TPM、额度上限、有效期与可用模型白名单。
  • 随时吊销:怀疑泄露立刻吊销,旧密钥立即失效,再新建替换即可。
  • 调用可审计:每条调用记录模型、token 数、耗时、状态与实扣点数。
  • 钱包流水对齐:扣费在钱包流水中体现为「模型API调用」,可与调用记录逐条核对。
常见问题

接入前你可能想知道

和逐个对接厂商相比好在哪?

一个接口地址、一个密钥、一份 AI 点数即可调用多家厂商模型。不用分别注册实名、分别充值、分别维护余额,换模型只需改 model 参数。

模型名怎么写?

必须与控制台「模型与接入」列表里的对外模型名完全一致(区分大小写),例如 Deepseek-v4-flash。清单会随上架调整,以页面实时显示为准。

缓存命中为什么便宜?

编程工具每轮都会重发完整上下文,上游通常会对重复前缀做缓存,这部分只按缓存命中价计费(多数模型约输入价 2 折),长会话能省下大量点数。

失败会扣点吗?

不会。上游报错、超时、限流等失败调用不计费;调用前还会做余额预检,点数不足会直接返回 402 insufficient_credits,不会产生欠费。

点数怎么获得?

可在用户中心 AI 点数 页充值,也可通过每日签到、成长任务、邀请好友、创作活动等方式免费获取;站内 AI 写作与模型 API 共用同一份点数。

有更详细的文档吗?

有。API 中转站总览五分钟接入模型 API计费、限额与排障 三篇覆盖了从创建密钥到错误码对照的全部内容。

现在就把大模型接进你的应用

注册即可领取体验点数,创建密钥后 5 分钟内发出第一次请求。