一套 OpenAI 兼容接口,接入 DeepSeek、GLM、Kimi、Qwen、MiniMax、MiMo、Grok、Gemini、GPT 等主流大模型。 按真实 token 计费、缓存命中最低 2 折、调用失败不扣点,与站内 AI 写作共用同一份 AI 点数。
把多家大模型厂商统一成一种接口、一份账单,换模型只改一个 model 参数。
同一个接口地址 https://www.wmzls.com/v1、同一个密钥调用全部模型,基座从 DeepSeek 换到 GLM、Kimi、GPT 不用改一行业务代码。
模型 API 与站内 AI 写作、生图共用同一份 AI 点数,充值一次两边可用;小额试用多家模型,不必在每家厂商分别压余额。
编程工具每轮重发的上下文常被上游缓存命中,这部分只按「缓存命中价」计费(多数模型约为输入价 2 折),长会话账单显著更低。
上游报错、超时、限流等失败调用一律不扣点数;每条调用都留下模型、token、耗时与状态记录,账单随时可核对。
单价单位为「AI 点数 / 1K tokens」,精确到 0.0001 点;下表为 1 倍基准价,购买 Coding Plan / Agent Plan 后即按 1 倍消耗。
| 模型 | 上下文 | 输入 · 未命中 点/1K | 输入 · 缓存命中 点/1K | 输出 点/1K |
|---|---|---|---|---|
| 模型清单加载中… | ||||
未开通订阅的用户按 3 倍消耗点数,开通 Coding Plan / Agent Plan 后立即按 1 倍消耗。 调用失败不扣点,调用前会做余额预检,不会产生欠费。
按月订阅一个「套餐额度池」:期内调用先抵扣套餐额度(按 1 倍基准价),额度用尽自动回落 AI 点数余额按量计费、不断流。未订阅用户模型 API 按 3 倍消耗,开通后立即回到 1 倍。
面向 Claude Code、Cline、Cursor 等编程场景:套餐额度抵扣模型 API 调用,配合缓存命中价,长会话成本更低。
同档续费额度累加、到期顺延;换档时剩余额度自动结转。套餐随时可停,额度用尽自动回落 AI 点数余额,不会中断服务。
登录后在 用户中心 → AI 点数 购买与续费。
兼容 OpenAI 协议,支持流式输出(stream: true)与 /v1/completions、/v1/embeddings。
把 Base URL 填为 https://www.wmzls.com/v1,API Key 填刚创建的密钥,模型名照抄控制台列表。
用任意 OpenAI SDK 或客户端发起请求,响应头 X-Credits-Charged 会回传本次扣费。
curl https://www.wmzls.com/v1/chat/completions \
-H "Authorization: Bearer sk-relay-你的密钥" \
-H "Content-Type: application/json" \
-d '{
"model": "Deepseek-v4-flash",
"messages": [{"role": "user", "content": "用三句话介绍泉州"}],
"stream": true
}'
from openai import OpenAI
client = OpenAI(
base_url="https://www.wmzls.com/v1",
api_key="sk-relay-你的密钥",
)
resp = client.chat.completions.create(
model="Deepseek-v4-flash", # 换成你想用的模型
messages=[{"role": "user", "content": "用三句话介绍泉州"}],
)
print(resp.choices[0].message.content)
import OpenAI from 'openai';
const client = new OpenAI({
baseURL: 'https://www.wmzls.com/v1',
apiKey: 'sk-relay-你的密钥',
});
const resp = await client.chat.completions.create({
model: 'Deepseek-v4-flash',
messages: [{ role: 'user', content: '用三句话介绍泉州' }],
});
console.log(resp.choices[0].message.content);
只要客户端支持自定义 Base URL,按下面三个参数配置即可;密钥可分别限速、限额、限模型。
Base URL:https://www.wmzls.com/v1 | API Key:你在控制台创建的 sk-relay- 密钥 | 模型:控制台列表里的对外模型名(区分大小写)
计费公式:未命中缓存输入 ÷ 1000 × 输入单价 + 命中缓存输入 ÷ 1000 × 缓存价 + 输出 ÷ 1000 × 输出单价。
一个接口地址、一个密钥、一份 AI 点数即可调用多家厂商模型。不用分别注册实名、分别充值、分别维护余额,换模型只需改 model 参数。
必须与控制台「模型与接入」列表里的对外模型名完全一致(区分大小写),例如 Deepseek-v4-flash。清单会随上架调整,以页面实时显示为准。
编程工具每轮都会重发完整上下文,上游通常会对重复前缀做缓存,这部分只按缓存命中价计费(多数模型约输入价 2 折),长会话能省下大量点数。
不会。上游报错、超时、限流等失败调用不计费;调用前还会做余额预检,点数不足会直接返回 402 insufficient_credits,不会产生欠费。
可在用户中心 AI 点数 页充值,也可通过每日签到、成长任务、邀请好友、创作活动等方式免费获取;站内 AI 写作与模型 API 共用同一份点数。
有。API 中转站总览、五分钟接入模型 API、计费、限额与排障 三篇覆盖了从创建密钥到错误码对照的全部内容。