AI 中转站这个赛道,劣币驱逐良币的现象很严重。本节用可验证的技术事实, 说清楚我们做了什么、不做什么,以及你如何自己核实。营销话术不能保真,代码细节可以。
1. 请求正文 · 永不入库
你打过来的 prompt、消息内容、上下文、上传的图片、tool call 参数,从不写入我们的数据库或日志。 管理后台能看到的只有:
User-Agent— 你用的客户端 (SDK 版本 / IDE)token 计数— input_tokens, output_tokens, cached_tokensmodel— 调用的模型名created_at— 调用时间戳status_code— HTTP 状态码 (200/429/500 等)upstream_account_id— 调度到哪个上游账号latency_ms— 端到端耗时
请求体是流式直通到上游,中间不落盘、不缓存、不分析、不审计。响应体同理。
自证方法: 联系客服调阅你自己 24 小时内任意一笔调用的"全部存储字段"。 你会发现里面没有 messages 数组、没有 prompt 字符串、没有 image base64。这是设计层面承诺,不是运营自觉。
2. 上游账号 · 完整分类
每个上游账号在管理面板按 platform 字段分类,我们公开承认每种类型的稳定性差异:
| 类型 | 稳定性 | 说明 |
|---|---|---|
| 官方 API Key (Anthropic / OpenAI / Google) | 最高 | 付费购买的官方 console key,签合规协议 |
| 官方 OAuth (Pro / Plus / Team / Enterprise) | 高 | 登录 OAuth 拿 access token,有 rate limit 但稳定 |
| 第三方 IDE 集成 (Cursor / Windsurf / Codex) | 中 | 逆向 IDE 内嵌的官方账号,会跟随 IDE 风控调整 |
| Pro 订阅 (claude.ai / chat.openai.com) | 低-中 | 个人账号订阅,有较严风控 |
我们不把"IDE 集成"伪装成"官方 API"卖。如果你抽中的是 IDE 通道, 错误日志和上游账号 ID 会明确显示来源。
3. 计费可对账
计费完全按上游 usage 字段。我们透传 response_id / chat_id, 你拿到这个 ID 后,如果有官方账号可以去后台对账:
# Anthropic 响应 (透传)
{
"id": "msg_01ABC...", // ← 这个 ID 在 Anthropic 后台可查
"type": "message",
"model": "claude-sonnet-5",
"usage": {
"input_tokens": 1234, // ← 计费按这个
"output_tokens": 567,
"cache_read_input_tokens": 800,
"cache_creation_input_tokens": 0
}
}
我们的扣费 = upstream usage × 该模型定价 × VIP 折扣系数。 公式公开,定价表见 模型与价格 页面。
4. 鉴别中转真伪 · 10 个测试项
你可以拿下面 10 项去衡量任何一家中转 (包括我们):
- 调用一个明确 400 的请求 (例: temperature=999),看返回的
error.type是否原样 (真官方:invalid_request_error+ 具体字段) - 对比首 token 延迟 与官方 API 的差距 (官方一般 <1s,中转应 <1.5s)
- 测 prompt caching (Anthropic) — 第二次同 prefix 是否命中 cache,
cache_read_input_tokens是否>0 - 测 vision — 上传一张图 (base64),看是否真的能 OCR/描述
- 测 tool use — 复杂 JSON schema 的 tool calling 是否能正确执行
- 测 stream usage — 流式响应末尾的
message_delta.usage是否完整 - 对比同 prompt 在多家中转的输出 (固定 temperature=0) — 应该几乎一致
- 查响应 header — 是否含
x-request-id、anthropic-version等官方头 - 测长 context (200k tokens) — 真 Opus / Sonnet 能吃下,小模型会截断
- 测复杂推理 — 数学竞赛题、代码 debug、长链条逻辑 — 这是 Opus 与 Haiku 最明显的差距
5. 行业常见掺水手法
列在这里供识别。我们不做这些,你可以拿去对照其他中转。
手法一 · IDE 逆向冒充官方 API
抓 KIRO、Cursor、Windsurf、Codex 等 IDE 的 Anthropic 集成 cookie, 把这个端点伪装成"Claude 官方 API"卖。稳定性极差: IDE 任何一次更新、Anthropic 改协议、对方账号被风控,你的"官方 API"立刻挂。 真官方 API 的 beta header、prompt caching、stream usage 末段统计往往不全。
手法二 · Cookie 中转
抓某个用户的 claude.ai / chat.openai.com 登录态 cookie 包装成 API 卖。 原账号被风控、改密码、cookie 过期,所有买家立刻断流。 而且明确违反服务条款,被发现可能反追溯。
手法三 · 模型欺诈
对外宣称 GPT-4 / Claude Opus,实际后端转发到 GPT-3.5 / Claude Haiku, 或用开源 Llama 微调套壳。固定一个高难度 prompt 多家对比就能识破。
手法四 · token 虚标
上游返回 usage 是 1000 token,中转改成 1500 多扣 50%。 对账方法: 拿透传的 response_id 去官方后台查实际 usage。 我们的扣费严格按上游 usage 字段,可对账。
手法五 · 假"流式"
非流式生成完后切片伪装流式 (首 token 延迟 5s+),或在流中段插入广告/统计。 我们的流是纯透传,首 token 延迟和官方差距只有网络往返。
手法六 · 错误码改写
把上游的 overloaded_error / insufficient_quota 等统一改写成 "服务繁忙"。掩盖了真实问题,客户端无法做精细化退避。 我们原样透传所有上游错误,你能定位到精确层。
6. 我们对自己的要求 (公开承诺)
- 事故公开 — 任何超过 5 分钟的中断在公告里留痕,不删历史
- 退款明文 — 支持申请退款;最终实际退款 = 充值金额 − 赠送金额 − 已消耗金额 (签到/盲盒/VIP 等赠送余额不退);申请退款即清空余额并默认放弃全部用户权益 (含移出群聊、账号封禁)
- 价格不暗调 — 模型单价改动提前 7 天预告
- 不卖渠道源 — 不会把你的 API key、IP、调用模式打包卖给第三方画像
- 开源策略 — 平台主体代码对自部署用户开放,商业模式不靠技术黑盒
- 日志保留 7 天 — 错误响应可能保留 7 天用于排障 (仅 status + 响应头,不含正文),之后自动删除