双协议报文入口
同时提供 OpenAI /v1/chat/completions 与 Anthropic /v1/messages,Claude Code 与官方 SDK 不改一行代码指过来
流式稳定转发
SSE 逐块透传、首字即回,不设整体读超时,长回答不被砍断
自动故障转移
同一模型多条线路,连续失败自动冷却切换,调用方零感知
按 Token 精确计费
输入/输出词元分别计价,支持阶梯价与错峰倍率,逐笔明细可查
密钥治理
每把 Key 可单独设到期时间、可用模型白名单与每分钟速率上限
可观测与告警
Prometheus 指标、模型主动探活、上游告警外发
30 秒接入
把 BASE_URL 指过来即可
# 第一步:设置 BASE_URL
export OPENAI_BASE_URL=https://your-domain/v1
# 第二步:发第一个请求
curl https://your-domain/v1/chat/completions \
-H "Authorization: Bearer sk-你的密钥" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o",
"messages": [{"role":"user","content":"你好"}],
"stream": true
}'
常见问题
我需要在每个模型厂商那里分别开户吗? +
不需要。模型已经接好,你只需要在本站创建一把 API Key,勾选要用的模型分组即可。价格按词元用量结算,账单、充值、发票都只面对本站一家。
Claude Code 能直接用吗? +
可以。把 ANTHROPIC_BASE_URL 指到本站地址,/v1/messages 与 /v1/chat/completions 两套报文都能直接收,客户端不用改代码。
调用失败时会怎样? +
全部线路都失败的请求不产生消费,被预占的额度当场归还。流式中途断开仍按已生成的 token 计费,因为那部分已经是真实成本。
怎么控制成本、防止被盗刷? +
每把 Key 可设到期时间、模型白名单和每分钟速率上限。还可以为每个成员设月度上限,服务端只存密钥摘要,泄露后即时停用。