中国最大独立Token工厂,年亏三个亿
AI越来越能干,也越来越烧Token。
国家数据局数据显示,到今年3月,我国日均Token调用量已超过140万亿,相比2024年初增长了1000多倍。
Token愈发无处不在,也让围绕模型调用、推理优化和Token调度的基础设施需求快速增长。
按照常理,这应该是AI发展红利下的又一“卖铲人”好生意。
但从正在冲击“Token工厂第一股”的硅基流动来看,现状还没那么乐观。
弗若斯特沙利文数据显示,以2025年Token年吞吐量计,其是中国最大的独立生态Token供应商。
但据招股书,2025年,硅基流动营收5533万元,净亏损达3.45亿元,也就是说,它每挣1块钱,就亏掉6块多。
这不禁令人疑惑,怎么调用需求越来越大,卖Token的人反而亏了呢?
图/图虫创意
中央厨房
首先得搞清楚,硅基流动到底在做什么生意。
2023年8月创办硅基流动时,创始人袁进辉对公司的定位是Token工厂——它并不直接提供算力,也不试图打造自己的大模型,而是连接模型、芯片和应用,将分散的算力资源和模型能力加工成开发者、企业可以直接调用的服务,由此“让模型像水电一样能被按需使用”。
袁进辉曾打过一个比方:算力就像是白菜、土豆等原材料,可以直接卖给客户,让客户自己加工;也可以把这些原材料加工成宫保鸡丁之类的成品菜,再端给客户——硅基流动做的就是后者,像极了一家生产预制菜的“中央厨房”。
对于开发者和小企业来说,这个模式非常有吸引力。
毕竟对于开发者而言,直接调用单一模型API并不困难,但随着模型数量迅速增加、芯片生态日益多元,不同模型之间的接口、性能、成本以及底层硬件环境各不相同,企业若想自行完成模型适配、推理优化和算力调度,需要投入大量工程资源。
这也正是AI推理通用基础设施的商业机会。今年英伟达GTC大会上,黄仁勋也提出了Token工厂概念,说“未来的数据中心不再是存储文件的仓库,而是生产Toke...







