旗下微信矩阵:

Token工厂为何受资本追捧?拆解魔形智能的商业样本

2026-08-13 15:17 · 网络     

核心摘要:成立两年的魔形智能三个月内连融两轮,日均Token调用量达数万亿级,收入达数亿元。在开源模型大行其道的背景下,Token工厂为何成为资本新宠?本文从融资节奏、商业模式和市场逻辑三个维度拆解这一商业样本。

什么是Token工厂?

Token是AI大模型处理信息的基本计量单位,每一次AI对话、代码生成背后都伴随着Token的消耗。Token工厂的本质,是将算力、推理引擎和运营系统组合起来,把底层复杂性封装成企业可以直接调用的Token产品——就像用电不需要自己建发电厂一样。

开源模型越繁荣,Token工厂越值钱

DeepSeek、Kimi、GLM、MiniMax等开源模型密集发布,企业可以直接下载模型权重,通用推理框架也日趋成熟。表面上看,大模型推理正在变成"有卡就能干"的生意。

**但事实并非如此。**魔形智能创始人、CEO徐凌杰指出:"模型是开源的,但高效的部署方式并不会全部开源。"模型能够运行,只代表生产出了Token;能否在大规模并发下守住延迟、吞吐、成功率和成本,才决定这些Token能不能卖出去。

开源模型提供了共同的原料,高效部署则决定工厂之间的产量、质量和利润。模型权重越容易获得,单纯"拥有模型"的稀缺性越低,资本开始把注意力投向模型之后的生产环节——谁能把相同模型运行得更快、更稳、更便宜,谁就更有机会获得客户和利润。

商业模式如何跑通?

魔形智能披露的日均数万亿Token,是客户已经调用并产生收入的实际用量,并非理论产能。按照目前增速,公司2026年营收预计将达到数亿元。

其市场策略是先服务大B客户。大型互联网企业对稳定性和性能要求极高,供应商通常需经过多轮测试才能进入生产环境。一旦服务质量得到验证,客户会增加采购份额,并将更多模型和业务迁移到同一平台。魔形智能的Token已进入部分互联网企业的核心业务,主要用于研发团队的日常工作、AI编程及内部办公流程。

这类客户对价格敏感,但质量排在价格之前。首先要守住接口成功率——AI编程和办公集中在工作时间,接口频繁失败则工具难以进入工作流。其次是响应速度,首Token延迟超过3秒,很多企业客户已难以接受。

在部分业务场景中,算力采购和运行成本可占Token总成本的八成甚至九成。魔形智能目前已有相当比例的模型达到盈亏平衡,整体业务正在向规模化盈利靠近。

下一站:日均10万亿Token

魔形智能计划继续扩充算力资源和技术团队,迭代自研推理引擎,推进国产超节点及相关硬件研发,覆盖更多开源模型和AI算力芯片的组合。公司下一个目标,是将日均Token产量推向10万亿级。

多家战略资源方入局,意味着魔形智能获得的不只是财务资金,还包括算力、数据中心和产业资源。行业竞争焦点正从拥有多少算力,转向每元钱、每瓦电力究竟能生产多少可用Token——真正的较量,是谁能把工厂稳定地开起来,持续产出可销售的智能。

(免责声明:本文转载自其它媒体,转载目的在于传递更多信息,并不代表本站赞同其观点和对其真实性负责。请读者仅做参考,并请自行承担全部责任。)