模型与状态
这一页是实时的,每 60 秒自己刷新一次。不需要登录。
现在能用哪些
正常 现在就能用。
恢复中 这会儿打不通,会自己好,你什么都不用做 —— 想立刻继续就先换一个模型。
暂停供应 短期内回不来,请换一个模型。这期间发过来的请求不会扣你的钱。
上下文窗口就是我们真正收得下的量,不是标称值 —— 我们报多少就收多少。
真超了也不会直接报错:我们会先丢掉最旧的几轮帮你接着跑,裁过的话响应头
x-context-trimmed 里写明。
单次输出上限是把窗口塞满时也还给得出来的数。输入没那么大时,实际能出的更多。
单价
单位:元 / 百万 token。灰色划掉的是官方公开价,下面是你的价。
我们的价钱一律是官方价的三折,三档分别乘 0.3,不做别的手脚。
缓存命中指同一段前缀第二次发过来时的价钱,比输入价便宜一大截。
多轮对话和 agent 天然会命中,我们把亲和做在了链路上(同一个会话尽量落回同一处),
命中率会比随机分发高得多。你在
用量与账单里能看到自己每一笔的命中量。
分时段计费的模型(DeepSeek 那两个)跟着官方的时段走,上面显示的是
此刻这一档。
怎么接
| 接口地址 | — |
| 协议 | OpenAI 格式、Anthropic 格式、Responses 格式都支持,用你客户端原本的那套 |