据多家媒体10月2日报道,主打按需AI推理的云服务商Modal Labs正在推进一轮7.5亿美元融资,投后估值约157.5亿美元。这个数字约为该公司今年5月估值的三倍,半年之内翻了两番。与此同时,公司10月1日刚推出面向智能体的完整虚拟机沙箱产品,让智能体可以在独立的全功能计算环境里执行任务。融资与产品发布的节奏叠在一起,指向同一个判断:智能体经济正在把推理算力变成一门独立的大生意。投资方名单尚未完全披露,市场消息称多家现有股东选择加注跟投,交易的抢手程度超出公司预期。
先看这轮估值跳变的背景。Modal Labs成立于2021年,核心产品是无服务器GPU云服务:开发者不必租整台服务器,按秒计费地使用GPU跑模型推理与批量任务,平台负责调度、扩缩容与环境隔离。这种模式把大模型推理的使用门槛从运维工程降到了几行代码,在AI应用开发者中积累了不错的口碑。
估值的陡峭爬升,反映的是资本市场对推理环节的重新定价。过去两年,算力投资的故事几乎全部围绕训练展开,训练集群的规模决定叙事的想象空间。但从今年开始,推理的真实消耗量快速追上并超过训练:模型上线之后,每一次用户提问、每一次智能体调用工具,都在产生推理算力需求,而且随用户增长线性放大。推理云因此从大厂云业务的一个附属品类,变成了有独立融资、独立估值的新赛道,Modal的三倍跳就是这种重定价的直接体现。同类公司近期的融资节奏同样密集,按需推理成了投资机构资产配置里的标配方向,估值锚点从传统的云收入倍数切换到了推理用量的增长斜率。
Modal最新的产品动向值得单独展开。10月1日推出的虚拟机沙箱,给每个智能体分配一台完整的虚拟电脑:有文件系统、有浏览器、有代码执行环境,智能体可以在里面自主完成多步骤任务。这个产品直指智能体落地的一个关键痛点:智能体要执行真实任务,就需要一个既隔离又完整的运行环境,共享沙箱不够用,物理机又太浪费。
这个产品的想象空间在于它与智能体浪潮的咬合。当业界讨论智能体常驻化、全天候工作时,一个现实问题被反复提起:数百万个同时运行的智能体,算力怎么供应?按需分配的虚拟机沙箱是眼下最经济的答案之一。Modal选择在这个节点推出产品并推进大额融资,时间点上明显是在卡位:智能体平台客户在选择基础设施时,先发者有机会锁定长期合约。与通用算力不同,智能体工作负载的特点是长时运行加突发峰值,调度系统要在两种模式之间平滑切换,这正是Modal过去几年积累的看家本领,也是它敢于在大厂眼皮下定价的底气。
把需求侧拆开看,推理云的增量来自几个叠加的来源。第一是消费级智能体产品的爆发,头部厂商的常驻智能体各自绑定云端算力,7乘24小时待命,哪怕闲置时间也在消耗调度资源。第二是企业级智能体进入真实业务系统,客服、财务、研发流程的自动化每推进一步,推理用量就增加一截。第三是应用开发者的长尾需求,大量初创公司没有自建算力的能力,按需推理云是唯一现实的选择。
这笔账单的规模已经有了参照系。头部模型公司的年化收入接近70亿美元,而支撑这些收入的推理成本同样以数十亿美元计;多家机构测算,五大科技巨头今年的AI资本开支将达到前所未有的量级,其中相当比例最终落在推理侧。巨头自建之外,溢出的需求流向了专业推理云,这构成了Modal这类公司生存与增长的基本盘。需求的结构也在变化,早期的推理用量以短平快的问答为主,如今智能体的多步骤任务动辄持续数分钟,单次会话的算力消耗成倍上升,客单价与粘性都随之改善。
当然,这个赛道的竞争远谈不上轻松。上有云巨头的同类服务在降价施压,同等赛道的创业公司也在密集融资,GPU供给的价格波动更是直接影响毛利。推理云的护城河需要靠调度技术、冷启动速度与开发者生态一层层垒起来,任何一环被巨头追平,客户迁移的成本都很低。Modal的选择是用智能体沙箱这类新产品制造差异,赌的是智能体工作负载的调度复杂度足以构成技术壁垒。产品层面的另一个变量是开源生态,调度框架的开源化会降低客户迁移成本,Modal需要在易用性与商业功能之间找到平衡。
风险同样清晰。估值三倍跳意味着资本市场已经把未来数年的增长预期计入了价格,一旦智能体产品的商业化不及预期,推理需求的斜率放缓,高估值就会变成压力。此外,巨头完全可能把按需推理做成赠送性质的功能,用云合同捆绑销售。窗口期之内,Modal们要做的是把开发者习惯与场景绑定做深,把融资变成产能与客户合约。对观察者来说,这轮融资是智能体经济向上传导到基础设施层的又一个信号:当应用层的竞争白热化时,真正稳赚的往往是卖铲子的那批公司,前提是铲子确实更好用。对中国的云计算厂商来说,这个市场同样在快速成形,智能体应用的推理需求已经开始外溢,谁能率先把按需推理的产品体验做到位,谁就能在国内市场复制这条增长曲线。