结论先说:一个 Claude 中转站值不值得充值,5 分钟就能测出来。看响应 model 字段是否等于请求模型、usage 是否完整、流式是否被截断,再看状态页和价格页是否敢公开数据。下面是我们自己给 OrcAI 做验收时用的 10 项清单,你可以拿去测任何一家。
10 项检查清单
| # | 检查项 | 怎么测 | OrcAI 自测结果 |
|---|---|---|---|
| 1 | model 字段一致 | 请求 claude-opus-5,看响应 model | 近 7 天 100 万+ 条日志无一例不一致 |
| 2 | usage 字段完整 | input_tokens / output_tokens / cache_read_input_tokens 是否存在且合理 | 完整返回,缓存读取按缓存价计费 |
| 3 | 上下文不截断 | 发 200K token 长文,让模型复述开头 | 按厂商规格(Opus 5 / Sonnet 5 为 1M) |
| 4 | 流式完整 | stream=true 看是否有 message_stop | 近 7 天 100% 请求为流式 |
| 5 | 限速透明 | 并发打 20 个请求看 429 与 retry-after | 分组级并发限制,429 可重试 |
| 6 | 状态页公开 | 是否有逐模型探测与历史 | 每 90 秒探测,公开 |
| 7 | 价格透明 | 倍率、汇率、缓存价是否写明 | 0.3 倍率,¥1 = $1 |
| 8 | 渠道来源公开 | 敢不敢说自己是什么渠道 | Kiro(AWS)授权渠道,控制台可见 |
| 9 | 退款政策 | 未用额度能否退 | 可联系客服退未用额度 |
| 10 | 隐私 | 是否存储请求正文 | 用量日志只含计费字段 |
5 分钟自检:三条 curl
# ① model 字段
curl -s https://api.orcai.cc/v1/messages -H "x-api-key: sk-你的密钥" -H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-opus-5","max_tokens":32,"messages":[{"role":"user","content":"hi"}]}' | jq '.model,.usage'
# ② 流式完整性:最后一个事件应是 message_stop
curl -sN https://api.orcai.cc/v1/messages -H "x-api-key: sk-你的密钥" -H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":64,"stream":true,"messages":[{"role":"user","content":"数到十"}]}' | tail -3
# ③ 缓存计费:同一 system 连发两次,第二次 usage.cache_read_input_tokens 应大于 0
常见坑
- "官方直连"四个字:真正的 Anthropic 官方 API 直连成本是 100% 官方价,卖到 0.5 折还说官方直连的,要么亏本要么说谎。看渠道来源比看口号有用。
- 只看首 token 延迟:探测请求的延迟和真实长对话差很多,看状态页的 24 小时可用率更有意义。
- 低价但截断上下文:用长文复述法一测就露馅。
OrcAI 怎么做
OrcAI Claude 稳定分组倍率 0.3(约合官方价 4.2%),渠道来源写在控制台分组名里,模型 ID 与官方一致,状态页每 90 秒探测。我们不引用第三方评测分数,只公开自家日志口径,欢迎用上面三条命令自己测。