← Writing

AI 中转站商业模式大揭秘

有些中转站,已经把报价打到了官方价格的 0.1 折。 这么便宜,它到底靠什么赚钱?

我调研了超过 100 家中转站,把它们的供货方式、收费规则和技术方案都搞清楚了,归纳出六种典型的盈利模式。这篇就把三件事讲透:供应链:Token 从哪来,商业模式:钱从哪赚,技术方案:后台到底怎么跑。

01 什么是中转站

你在编程工具里发出一个AI请求,中转站收到它,找到上游模型,拿回结果,再从你的余额里扣钱。

最短的链路是:

你的工具 → 中转站 → 模型服务

中间还能多一层:

你的工具 → 零售中转站 → 多家供应商 → 模型服务

所以,中转站采购的“货”,具体可能是 API 调用额度、账号订阅配额,或者能提供推理服务的算力。有的中转站站找其他中转站供应商,有的把配额分给不同用户,有的再包装成月卡。面向开放权重模型,混合型中转还能接入自己租 GPU 部署的推理服务,把算力成本摊进每次调用。

同一个“中转站”招牌下面,可能装着多种类型的生意。

02 第一类:API 聚合

这类平台主要有两种收钱方式:拿到更低的采购价,再加价卖给用户;或者按上游的价格卖额度,在充值时收手续费。

比如官方标价 10 元的调用,假设平台采购花了 8 元,卖给用户 9 元,就留下 1 元差价。支付、服务器和维护的开支,还要从里面扣。

RouterPlex 在官网介绍的就是采购差价模式。OpenRouter 则在 FAQ 里说明,模型调用按上游价格计费,购买额度时收取费用。RouterPlex 官网OpenRouter FAQ

用户愿意通过它们购买,是因为不用再分别注册、充值和接入多家模型服务。一个 Key、一个余额就能用多个模型,首页也会着重宣传这些功能。

平台后台要维护各家供应商的接口、凭据和价格。收到请求后,检查用户的权限和余额,选择能提供目标模型的线路,失败后再尝试其他线路。各家接口的流式输出、工具调用和错误格式不一样,还需要做适配。

这里的“换线路”也有区别:同一个模型可以有多个供应商,某家不可用就换一家;如果按任务选择不同模型,换掉的就不只是供应商,模型能力和价格也会跟着变。

03 第二类:订阅配额池

先买一批带使用额度的订阅账号,再把这些账号接进同一个系统,对外按 Token、次数或套餐收费。

它利用的是订阅价和 API 按量价之间的差异。订阅先付月费,在已有配额内,实际用掉的额度越多,分摊到每次调用的订阅成本就越低。买来的额度闲着不用,就浪费了;超过这些账号能提供的容量,又得加购。

所以,这类平台需要管理的账号状态很多:剩余配额、并发占用、限流时间、是否可用。收到请求后,找一个还有额度、能接新请求的账号。达到限制的账号先暂停分配,等额度恢复后再用。

同一段对话还会尽量分配到同一个账号,这叫会话粘性。用户拿到的是平台发放的 Key,不需要知道后台具体用了哪个账号。

Sub2API 就是这类系统的开源例子,包含多账号管理、配额分发、Token 计费、会话粘性,以及用户和账号两级并发控制。Sub2API 项目

“共享配额”“低成本”“原生工具接入”都是这类方案常用的卖点。实际经营时,账号可用性和高峰并发会直接影响交付:总额度还有剩余,不代表所有用户都能同时用。

04 第三类:二级分销

有些站长自己不采购原厂 API,也不维护账号池。他从另一家中转站买额度,再搭一个自己的站卖出去。

批发商提供模型和容量,零售站负责找客户、收款和售后。两边各自定价,零售站赚中间的差价。

这类站的系统可以基于 New API 等开源项目搭建,用户管理、充值、计费、渠道调度、失败重试和协议转换都有现成模块。New API 项目

后台接上批发商的 Key,再给自己的用户发 Key。用户发出请求时,既消耗自己在零售站的余额,也消耗零售站在批发商那里的额度,需要分别记账。

售价通过模型、输出和用户组倍率来调整。同一条线路,可以给散户、代理和大客户设不同价格。请求前预扣额度,结束后按实际用量结算。New API 计费文档

站长做的生意就很接近普通代理:写接入教程、做社群、提供中文客服,或者用邀请返佣发展下一级客户。本地支付和售后也能成为用户选择它的理由。

这类站依赖上游供应。同一个批发商出了故障,接在它后面的几个零售站会一起受影响。

05 第四类:Coding/Agent 套餐

这一类按月收钱,给用户一包额度,可以用来调用多个模型。卖点是每个月花多少钱比较确定,不用一直盯着按量账单。

平台收入固定下来,上游成本却取决于用户怎么用。同样的月卡,有人只在周末写几段代码,有人每天都让 Agent 跑任务。平台得看这批用户加起来会产生多少成本,再决定套餐价格和额度。

月卡也需要逐次计量。调用哪个模型扣多少点,多久重置额度,用不完能结转多少,每分钟允许多少请求,都得在后台设置。

Router9 的产品就把固定月费、credits、额度结转、每个 Key 的预算和限流放在一起,面向 Agent 和编程工具用户。Router9 官网

月卡和前面的账号池是两个维度。月卡说的是怎么向用户收费,上游既可以按 Token 采购,也可以接批发商或订阅配额池。因此,看到一家站卖月卡,还不能知道它的货从哪里来。

06 第五类:企业网关

这类平台可以让客户自带 API Key,也就是 BYOK。模型账单由客户直接付给供应商,网关收软件、托管、部署和支持服务的钱。

客户主要是需要统一管理模型调用的团队。每个项目的预算、可用模型和访问权限不同,费用也要按团队分别统计。

网关给不同团队和项目发虚拟 Key,再映射到真正的上游凭据。管理员可以给项目设预算、限制可用模型,查看每个团队花了多少钱。供应商故障时,也能按配置切换。

LiteLLM 的架构文档能看到这套处理过程:检查 Key 和预算、限流、选择线路、转换协议,再记录用量。数据库保存 Key、团队和消费记录,Redis 用来做缓存和限流计数。LiteLLM 架构文档

企业付钱,是为了少花工程师的维护时间,也为了管理权限和开支。这类产品的宣传重点自然偏向私有部署、审计、预算管理和企业支持。

07 第六类:数据变现

还有一种收入来自用户产生的数据。平台收集提示词、模型回答和调用记录,整理成数据集,卖给需要训练数据的团队。

Zilan Qian 在 ChinaTalk 记录了中转站转售日志的业内说法,后续访谈也谈到了数据清洗与出售,但具体交易链条尚未得到独立核实。调查原文研究者访谈

编程场景的日志尤其值得关注。里面除了问题和回答,还有工具发送的代码上下文、用户的追问和纠错。整理后,可以得到一组组真实任务的处理记录。

加工过程包括整理会话、去除敏感信息、清理无效轮次、评估质量,再转成训练数据格式。LogMiner 这个开源项目展示的就是日志加工流程。日志加工技术示例

如果平台能出售这些数据,收入就不只来自用户充值。按这个商业模式推算,它有动力用低价吸引用户持续调用,因为调用过程中还能得到新的数据。采集、存储和加工的成本也要扣掉。

记录运行日志、使用数据训练模型、把数据卖给第三方,是不同的行为。做过清洗和脱敏,也不等于用户同意出售。

08 0.1折是怎么做到的

0.1 折就是官方标价的 1%。官方标价 100 元的用量,平台只收 1 元。如果只赚这笔调用的钱,上游成本和其他随单开支加起来就得低于 1 元。

订阅配额池能降低分摊成本,但要看订阅实际能提供多少可用额度。缓存命中、批量任务也会改变价格,不过对应的是特定调用条件,不能直接当成所有请求的单价。

促销是另一种情况。平台可以先补贴,让用户试用,之后再靠续费和其他付费收回来。若还有数据销售收入,则需要另外计算这部分收入和加工成本。

还有些折扣要连着充值规则一起算:充了多少现金,到账多少点数,每个模型按什么倍率扣费。同样写着“100 美元额度”,不同平台能完成的调用量并不一定相同。