改两个环境变量,直接开用
标准 Anthropic Messages 协议。Claude Code、官方 SDK、任何兼容客户端,把 base_url 指过来就能跑,代码一行不用改。
一个密钥,调用全部模型
选一个接入点
密钥和协议都一样,挑个离你近的就行
延迟由你的浏览器现场探测 /health 得到,条长按相对最快者换算。页面不写死任何数值;探测不通时显示"无法探测",不会补一个假数字。
换模型只改一个字段
点一个试试 —— 端点、密钥、代码都不用动
export ANTHROPIC_BASE_URL=https://api.skiapi.dev
不变
export ANTHROPIC_AUTH_TOKEN=sk-••••••••
不变
/model claude-opus-5
窗口大小是模型自带的属性,逐模型不同 —— 不是能勾出来的开关。上面这排按钮换一个,窗口就跟着换一个。
同一个模型可以有几个等价写法。[1m] 是给「只能填一个纯模型名」的客户端用的显式变体名;换写法只改名字,窗口和 thinking 都不动。
四个入口,哪个对你最快?
按一下,你的浏览器会真的向四个入口各发 6 次 /health。赛道每前进一格都是一次真实到达,不是定时器动画 —— F12 → 网络里能看到同一批请求。
-
api.skiapi.dev 美国 · 盐湖城主入口—ms —
-
cn.skiapi.dev 中国方向中继—ms —
-
as.skiapi.dev 日本 · 东京—ms —
-
gw.skiapi.dev 备用网关—ms —
上下文尺子
粘一段你自己的代码或文档进来,浏览器本地数一遍 token,量出它在四个模型窗口里各占多少 —— 再算这坨内容重复问 N 次,开缓存到底值不值
还没有内容
示例:粘一个 2000 行的源文件试试 —— 约 4.2 万 token。在 opus 的 1M 窗口里它只占 4%,可在 deepseek-3.2 的 128K 里已经吃掉三分之一。同一坨内容,不同模型不是一回事。
—
近似值,实际以 API 返回的 usage 为准
- 字符
- 0
- 中日韩字
- 0
- 拉丁字母
- 0
- 行
- 0
- 这段的密度
- —
| 计费项 | 倍率 | 本站 $/M | 官方 $/M | 这坨内容一次 |
|---|---|---|---|---|
| input(不缓存) | 1.00× | $0.400 | $5.00 | — |
| cache write · 5m | 1.25× | $0.500 | $6.25 | — |
| cache write · 1h | 2.00× | $0.800 | $10.00 | — |
| cache read(命中) | 0.10× | $0.040 | $0.50 | — |
算法:不缓存 = N × 全价;用缓存 = 首次写入 + (N−1) 次命中读取。缓存要在 TTL 内命中才算 —— 5m 档超过五分钟没再发就过期,下次仍按写入计费,回本次数要重新算。token 数是本地近似值, 窗口占用与金额都会跟着它一起浮动;结账以 API 返回的 usage 为准。
省下来的三件事
一键接入
一个密钥打通全系 Claude,不用一家一家申请。
协议统一
都走标准 Anthropic Messages 格式,换模型就改一个 model 字段。
用量透明
用多少算多少,可以给每个密钥设上限,谁花的一眼能看到。
要是一家一家自己接,会多出多少活
条长是"要维护的东西的个数",分母取模型广场里实际在供的 6 家上游
接入成本
SDK + 鉴权方式 · 个每家一套 SDK、一套鉴权、一套错误码
一个密钥,一套协议
付费方式
要分别充值的账户 · 个每家单独充值、单独对账
一个余额,用多少扣多少
客户端兼容
Claude Code 能直连的厂商 · 个Claude Code 只认 Anthropic 协议
全部模型都能用 Claude Code 调
6 家 = 模型广场当前在供的上游厂商(Anthropic、OpenAI、DeepSeek、MiniMax、Z.ai、Qwen)。你自己接几家,就把分母换成几。