Back to blog

AI 中转站分析

AI API 中转站的定价体系、模型倍率机制、隐蔽成本、避坑方法和选型框架。

背景

#

OpenAI / Anthropic / Google 的模型 API 在大陆无法直接访问。AI 中转站购买官方额度、架设反向代理,以统一接口转售给国内用户。问题在价格极不透明——同模型报价差 3-5 倍是常事。

中转站底层多为 OneAPI 或 NewAPI,做三件事:协议转换、计费扣减(按倍率算额度)、路由分发(多后端负载均衡)。

模型倍率

#

倍率系统的来源:OneAPI 把所有模型价格与基准模型 davinci-002($0.002/1K tokens)对齐。但这个基准的绝对价格没意义,问题在于中转站可以任意调整倍率

从官方定价到用户实际支付,每个环节都能掺水:

环节可操作空间
模型倍率任意设定,与官方无关
额度汇率1 元 = 5000~20000 不等
最低消费每笔最低扣费
四舍五入向上取整

算绝对倍率

def real_cost(cny_per_million, usd_per_million, rate=7.3):
    """绝对倍率 = 中转站价格 ÷ 官方价格"""
    return cny_per_million / (usd_per_million * rate)

例:某站 Claude Sonnet 4.6 输入收 8 元/M token,官方 $3/M × 7.3 = 21.9 元。绝对倍率 8/21.9 = 0.37——官方价的 37%。

成本估算实例

按官方价(输入 $3/M、输出 $15/M)算一个实际工作负载:每天 200 万输入 token + 20 万输出 token。

官方:   (2 × 3) + (0.2 × 15) = $9 ≈ 65.7 元/天
倍率0.6:65.7 × 0.6 = 39.4 元/天
倍率1.5:65.7 × 1.5 = 98.6 元/天

同样用量,两家中转站月成本差约 1800 元。下单前先拿自己的 token 用量套一遍,别只看标价倍率。

读报价页清单

#

拿到任意中转站报价页,按序核对:

  1. 模型名是否带日期/版本后缀,能否对上官方在售模型(防冒牌)
  2. 输入/输出是否分开标价,还是只标一个笼统倍率
  3. 充值汇率:1 元兑多少额度,充值消耗是否同一汇率
  4. 最低消费:单次请求最低扣多少额度
  5. 有无计费误差项:请求失败、被限流是否也扣费
  6. 渠道说明:是否标注直连官方,还是"聚合/转发"

六项核对完再下单。

常见坑

#

1. 冒牌模型

中转站在 NewAPI 后台改个模型别名,就能用低成本模型冒充高价模型。检测方法:

import openai
client = openai.OpenAI(api_key="key", base_url="https://中转站/v1")
resp = client.chat.completions.create(
    model="claude-sonnet-4.6",
    messages=[{"role": "user", "content": "你是谁?"}]
)
print(resp.model)  # 看实际返回什么模型名

2. 隐蔽成本

  • 最低消费:每次请求最低扣 1000 额度,短请求实际翻倍
  • 额度双重汇率:充值和消耗用不同汇率
  • 预充值不退:跑路即损失,先小额试充再续

怎么选

#

靠谱中转站的特征:

  • 明码标价,公示每百万 token 价格
  • 主要渠道来自官方 API,不是多层嵌套代理
  • 有工单或用户群
  • 支持按量计费,不强制高额预付
  • 有公开接入文档

辅助工具:

自建中转

#
services:
  newapi:
    image: calciumion/new-api:latest
    ports: ["3000:3000"]
    volumes: [./data:/data]
    restart: always

自建完全掌控渠道,数据不经过第三方。需要一台境外服务器,仍需购买官方 API 额度。

参考:linux.do 讨论帖

$ echo "collect what matters, write it down"