把智谱 GLM Coding Plan 套餐 Key(bigmodel / Z.ai)反代成标准 Anthropic API, 给 Claude Code、new-api、9router、Cherry Studio 等工具当上游用。
零依赖,Node 18+ 单文件。
PLAN_PROXY_API_KEY=<你的套餐Key> node glm-plan-proxy.mjs默认 http://127.0.0.1:8128。Key 只在内存中使用,不落盘、不打印、不上传。
| 变量 | 默认 | 说明 |
|---|---|---|
PLAN_PROXY_API_KEY |
无(必填) | 上游套餐 API Key |
PLAN_PROXY_PORT |
8128 |
监听端口 |
PLAN_PROXY_HOST |
127.0.0.1 |
监听地址;改 0.0.0.0 必须设 PLAN_PROXY_KEY,否则拒绝启动 |
PLAN_PROXY_KEY |
空 | 反代自身的访问密钥(客户端用 Authorization: Bearer 或 x-api-key) |
PLAN_PROXY_ACCOUNT |
bigmodel |
上游选择:bigmodel = 智谱开放平台;zai = Z.ai |
PLAN_PROXY_AUDIT |
开 | 设 0 关闭审计落盘(内存统计仍进行) |
PLAN_PROXY_AUDIT_FILE |
脚本同目录 glm-plan-proxy-audit.jsonl |
审计文件路径 |
POST /v1/messages— Anthropic 协议(流式 SSE 原样透传)POST /v1/messages/count_tokens— 先透传上游,上游不认则本地粗估GET /v1/models— 返回 GLM-5.3 / GLM-5.3-FlashGET /v1/usage— 上游消耗与下游审计查询(需访问密钥)GET /health— 健康检查(附今日请求量与 token 概要)
每请求从上游响应提取 usage(input / output / cache_creation / cache_read tokens;
流式从 SSE 的 message_start / message_delta 事件取累计值),两个口径都留痕:
- 上游消耗:
GET /v1/usage返回按天(本地日,与北京时间重置口径一致)、按模型、 按客户端(IP · UA 家族)的汇总,以及最近 50 条请求明细。重启不丢数——启动时从审计 文件恢复历史聚合。/health附今日请求数与 token 概要。 - 下游审计:每请求一条 JSONL 追加到审计文件:时间(UTC + 本地)、账号、端点类型、
客户端 IP 与 UA、密钥掩码与是否有效、请求模型、上游回显模型、是否流式、状态码、
耗时、请求/响应字节数、usage、错误摘要。401 也记录(安全事件);客户端 SSE 半途
断开记 499,上游已消耗的 token 照记。审计文件超 32MB 自动轮转为
.1。
- 类型:Anthropic / Claude
- Base URL:
http://127.0.0.1:8128 - Key:
PLAN_PROXY_KEY的值(未设则随便填)
- 额度与上游账号共享;上游限流/封控风险自担。
- Key 更新后重启本服务即可,无需改配置。
- 不支持的端点(如 batch、embedding)返回 404。
本项目仅供个人学习与研究使用,与智谱(Zhipu / bigmodel)、Z.ai 无任何关联。 使用本工具产生的一切后果(包括但不限于账号限流、封禁)由使用者自行承担, 请务必遵守上游服务的用户协议与条款。