《风口研报》特约记者 刘畅
当全球AI产业从“训练竞赛”转向“推理内卷”,一家低调潜行的算力服务商突然站上风口。近日,星瀚智能(虚构代码:300XXX) 披露2026年半年度业绩预告:受益于推理算力需求爆发,公司第二季度归母净利润同比增长高达400%,远超市场预期。与此同时,在刚刚落幕的世界人工智能大会(WAIC 2026)上,星瀚智能重磅发布“Token工厂”与“全栈算力矩阵”,正式宣告从传统数据中心服务商转型为推理算力基础设施运营商,并前瞻性卡位LPU推理芯片与具身智能核心部件赛道。
二季度业绩炸裂:推理算力“卖水人”赚翻了
星瀚智能的业绩快报显示,2026年上半年公司预计实现净利润约1.8亿元,其中第二季度单季贡献超过1.2亿元,同比增长400%。公告将增长归因于“大模型推理需求对算力服务订单的拉动”。此前,星瀚智能长期从事IDC(互联网数据中心)托管与定制化服务,客户以互联网企业为主。但自2025年起,公司逐步改造存量数据中心,加装AI推理加速卡,并提供按Token计费的弹性算力服务。
“过去算力租赁主要面向训练侧,但随着模型应用遍地开花,推理侧算力消耗正在指数级增长。”星瀚智能CEO张云在WAIC 2026现场接受《风口研报》专访时表示,“二季度我们推理算力业务收入占比首次超过50%,毛利率从20%跃升至45%以上,这是利润暴增的核心原因。”
WAIC 2026重磅发布:“Token工厂”重新定义算力交付
在WAIC 2026展台,星瀚智能亮出了两款杀手级产品:“Token工厂”(Token Factory)与“全栈算力矩阵”。
“Token工厂”并非实体工厂,而是一个实时推理算力交易与调度平台。企业用户只需输入期望的模型类型、响应速度及预算,平台即可自动匹配最优的算力组合,并按生成的Token量进行计费,最低起租时间缩短至秒级。张云将其类比为“AI世界的水电煤”——用户无需关心底层芯片型号,只需为消耗的每一份“智能”买单。
配套的“全栈算力矩阵”则整合了英伟达H200、AMD MI400以及本土LPU推理芯片等多种异构计算资源。星瀚智能特别强调,矩阵支持动态调配,例如对于大语言模型对话场景优先调度LPU芯片(其能效比可达传统GPU的3倍),而对于多模态任务则切换至GPU集群。
战略转型:从“卖机房”到“卖推理”,锚定LPU与具身智能
此次方向调整并非心血来潮。星瀚智能在业绩说明会上披露,公司已与国内头部LPU芯片设计企业芯流科技(虚构)签署战略协议,将联合定制应用于大模型推理的LPU服务器,并计划于2027年底前部署超过10万颗LPU芯片。LPU(语言处理单元)架构专注Transformer推理,相比GPU功耗降低70%,特别适合高并发、低延迟的场景,如智能客服、实时翻译、具身智能控制等。
更引人注目的是,星瀚智能同步展出了具身智能核心部件——一款名为“启明”的片上控制系统(SoC),集成LPU推理核、视觉处理单元与运动控制模块,专为机器人厂商提供“大脑+小脑”一体化解决方案。“人形机器人需要实时感知、决策、控制,传统云端推理时延太高,边缘推理才是刚需。‘启明’芯片将推理能力下放到机器人本体,功耗仅12W,性能却相当于一个微型A100。”张云透露,该芯片已获得三家协作机器人厂商的意向订单,预计2027年量产。
机构解读:推理算力新蓝海,先发优势是关键
多家券商在WAIC 2026后紧急上调星瀚智能评级。国泰君安通信首席分析师指出,推理算力服务市场正从零散订单走向标准化服务,星瀚智能凭借“Token工厂”这一平台型模式,有望成为行业标准制定者。“公司二季度业绩爆发验证了推理需求真实爆发,而LPU与具身智能的卡位则打开了第二增长曲线。预计2027年公司净利有望突破10亿元。”
不过,风险同样存在。当前LPU芯片产业链尚不成熟,具身智能商业化节奏慢于预期,以及来自阿里云、华为云等巨头算力平台的竞争压力,都可能影响星瀚智能的转型节奏。但无论如何,这家曾经名不见经传的IT服务公司,正凭借对AI产业终局的敏感嗅觉,成为资本市场“推理算力第一股”的热门人选。