跳到主要内容
Anthropic 协议兼容网关

改两个环境变量,直接开用

标准 Anthropic Messages 协议。Claude Code、官方 SDK、任何兼容客户端,把 base_url 指过来就能跑,代码一行不用改。

一个密钥,调用全部模型

GET /health 还没测
# 两个环境变量,就这些
$ export ANTHROPIC_BASE_URL=https://api.skiapi.dev
$ export ANTHROPIC_AUTH_TOKEN=sk-••••••••
# 下面这行现在就在你的浏览器里跑,不是动画
# 正在探测…
F12 → 网络,可复核这次请求
2 要改的环境变量 ANTHROPIC_BASE_URL · ANTHROPIC_AUTH_TOKEN
4 可选接入点 {api,cn,as,gw}.skiapi.dev
·· 可调用模型 现拉自 /api/v1/model-plaza
接入

选一个接入点

密钥和协议都一样,挑个离你近的就行

延迟由你的浏览器现场探测 /health 得到,条长按相对最快者换算。页面不写死任何数值;探测不通时显示"无法探测",不会补一个假数字。

API 端点https://api.skiapi.dev
环境变量export ANTHROPIC_BASE_URL=https://api.skiapi.dev
模型

换模型只改一个字段

点一个试试 —— 端点、密钥、代码都不用动

export ANTHROPIC_BASE_URL=https://api.skiapi.dev 不变
export ANTHROPIC_AUTH_TOKEN=sk-•••••••• 不变
/model claude-opus-5
上下文 1M thinking 支持
上下文窗口 1M
0500K1M

窗口大小是模型自带的属性,逐模型不同 —— 不是能勾出来的开关。上面这排按钮换一个,窗口就跟着换一个。

写法

同一个模型可以有几个等价写法。[1m] 是给「只能填一个纯模型名」的客户端用的显式变体名;换写法只改名字,窗口和 thinking 都不动。

查看全部模型与价格 43 个模型 · 本站价与官方价并列

竞速

四个入口,哪个对你最快?

按一下,你的浏览器会真的向四个入口各发 6 次 /health。赛道每前进一格都是一次真实到达,不是定时器动画 —— F12 → 网络里能看到同一批请求。

  1. api.skiapi.dev 美国 · 盐湖城主入口
    ms

  2. cn.skiapi.dev 中国方向中继
    ms

  3. as.skiapi.dev 日本 · 东京
    ms

  4. gw.skiapi.dev 备用网关
    ms

还没跑 —— 按下面的按钮,用你自己的网络测一遍

真实请求 · 打本站公开的 /health,不用密钥、不花配额

着色按你自己的中位数算:比它慢 1.8 倍以上才标「慢」。不写死毫秒阈值 —— 欧洲访客 300ms 是正常、同城 300ms 是异常,绝对值对两者无法同时成立。

上下文尺子

粘一段你自己的代码或文档进来,浏览器本地数一遍 token,量出它在四个模型窗口里各占多少 —— 再算这坨内容重复问 N 次,开缓存到底值不值

在本机数,不上传
或把文件拖进来
这坨内容有多大

还没有内容

示例:粘一个 2000 行的源文件试试 —— 约 4.2 万 token。在 opus 的 1M 窗口里它只占 4%,可在 deepseek-3.2 的 128K 里已经吃掉三分之一。同一坨内容,不同模型不是一回事。

在各家窗口里占多少 每条按自己的窗口归一化,条长之间不可比
claude-opus-5[1m] 1M
qwen3-coder-next 256K
claude-sonnet-4.5 200K
deepseek-3.2 128K
这坨内容重复问 N 次,缓存值不值 只算 input 侧 · 本站实收 = 官方价 × 0.08
第一次用缓存反而更贵。 写入要按 1.25× 计费,而不缓存就是 1.00× —— 首次开缓存等于多付 25%。要到第二次重复发同一段内容,命中读取只花 0.10×,累计才追平并反超。只问一次的场景,缓存是纯亏。
1
写入 TTL
回本 第 2 次
用缓存 $0.0000
不用缓存 $0.0000
省下 $0.0000
倍率与单价(claude-opus-5 · input 官方 $5.00/M)
计费项 倍率 本站 $/M 官方 $/M 这坨内容一次
input(不缓存)1.00×$0.400$5.00
cache write · 5m1.25×$0.500$6.25
cache write · 1h2.00×$0.800$10.00
cache read(命中)0.10×$0.040$0.50

算法:不缓存 = N × 全价;用缓存 = 首次写入 + (N−1) 次命中读取。缓存要在 TTL 内命中才算 —— 5m 档超过五分钟没再发就过期,下次仍按写入计费,回本次数要重新算。token 数是本地近似值, 窗口占用与金额都会跟着它一起浮动;结账以 API 返回的 usage 为准

能力

省下来的三件事

一键接入

一个密钥打通全系 Claude,不用一家一家申请。

要管的密钥数1 / 6

协议统一

都走标准 Anthropic Messages 格式,换模型就改一个 model 字段。

换模型要改的字段1 / 6

用量透明

用多少算多少,可以给每个密钥设上限,谁花的一眼能看到。

配额上限(示例)62%
对照

要是一家一家自己接,会多出多少活

条长是"要维护的东西的个数",分母取模型广场里实际在供的 6 家上游

接入成本

SDK + 鉴权方式 · 个
一家一家自己接6

每家一套 SDK、一套鉴权、一套错误码

SkiAPI1

一个密钥,一套协议

付费方式

要分别充值的账户 · 个
一家一家自己接6

每家单独充值、单独对账

SkiAPI1

一个余额,用多少扣多少

客户端兼容

Claude Code 能直连的厂商 · 个
一家一家自己接1 / 6

Claude Code 只认 Anthropic 协议

SkiAPI6 / 6

全部模型都能用 Claude Code 调

6 家 = 模型广场当前在供的上游厂商(Anthropic、OpenAI、DeepSeek、MiniMax、Z.ai、Qwen)。你自己接几家,就把分母换成几。

两行命令就能开始

不用改代码,不用换客户端