何夕2077研究與前沿

商湯混合推理工廠盈利

2026年7月20日 00:00

重點摘要

商湯混合推理工廠盈利。 智能體需求⚙️已升至原來十倍。商湯在混合推理方案報道披露新架構。國產卡負責預填充任務計算。高端卡承擔後續解碼環節。每日產量🎛️瞄準十萬億詞元。

站內 AI 整理稿

商汤混合推理工厂盈利

商汤科技在AI推理领域再传捷报。其混合推理工厂已正式实现盈利,同时智能体(Agent)相关算力需求激增至原先的十倍,标志着该业务进入快速放量阶段,市场增长势头强劲。这一关键进展表明,商汤在AI推理领域的商业化能力正加速兑现,从技术领先向规模化营收迈出了实质性步伐。商汤混合推理工厂是业内首批专为大模型推理场景打造的算力基础设施,旨在通过异构计算架构优化推理效率。自推出以来,该工厂持续迭代,逐步从技术验证走向商业运营。此次实现盈利,意味着商汤在推理算力的成本控制与收入获取之间找到了平衡点,证明了其商业模式的可复制性与可持续性。

据最新披露的混合推理方案细节,商汤在架构设计上进行了针对性创新:采用国产专用芯片负责预填充(Prefill)计算任务,而高端显卡则承担后续的解码(Decoding)环节。通过这种异构分工,计算资源得以“各司其职”——预填充阶段对算力吞吐要求高,国产芯片可发挥性价比优势;解码阶段对延迟敏感,高端显卡的强单卡性能确保低时延响应。两者协同,大幅提升整体推理效率。这一设计使得算力分配更加经济高效。相比单一芯片方案,混合架构能显著降低单位算力成本,同时满足不同场景对速度与吞吐的需求。优化后的算力结构直接支撑了业务规模的迅速扩展,也为此轮盈利奠定了技术基础。

随着智能体应用爆发,大量实时、长序列推理任务涌入,混合推理工厂的成本优势进一步凸显。智能体需求的十倍增长是此次盈利的重要驱动力。当前,以AutoGPT、MetaGPT等为代表的智能体框架日益成熟,企业级AI应用从简单的对话问答转向多步骤自主决策与执行,推理请求量呈指数级攀升。商汤混合推理工厂凭借其弹性调度与高效推理能力,及时承接了这部分增量需求,工厂使用率快速提升,规模效应随之显现。目前,该工厂每日产量目标已瞄准十万亿词元(Token),展现出业界领先的大规模推理能力。十万亿词元相当于每天可处理数千亿汉字文本,足以支撑海量智能体并发任务。

这一体量的达成,不仅要求算力硬件的充沛供应,更依赖调度系统与推理框架的极致优化,是商汤软硬一体实力的综合体现。盈利能力的确认与需求的持续攀升,使商汤在AI推理领域的竞争力得到进一步巩固。相较于单纯提供云服务的厂商,商汤拥有自研芯片、算法、平台的完整闭环,能从架构层进行垂直优化;而相比硬件厂商,商汤又具备模型级调度与部署经验。这种“懂算法、懂芯片、懂场景”的独特定位,为其赢得了差异化优势。从行业视角看,混合推理工厂的盈利释放了一个积极信号:大模型推理不再只是烧钱的成本中心,完全可以成为利润中心。

随着更多企业将AI能力嵌入核心业务,对高效、低成本推理的需求将持续爆发,率先跑通商业闭环的厂商有望抢占先机。商汤此次实质性突破,或加速整个产业对推理算力投资的价值重估。商汤科技高层此前曾多次表示,生成式AI的价值最终将体现在推理环节。混合推理工厂的盈利正是这一判断的落地验证。未来,商汤计划进一步扩大异构算力池规模,探索更多国产芯片与高端显卡的组合方案,同时拓展金融、医疗、自动驾驶等垂直行业的推理服务,推动单位成本持续下行。值得注意的是,智能体需求的十倍增长并非短期波动。随着Agentic AI(智能体AI)成为行业共识,推理侧所需的算力消耗将远远超过训练侧,这为混合推理工厂提供了长期增长动力。

商汤已具备每日十万亿词元的处理底座,下一步目标是达到百万亿级,以满足超级推理集群的需求。市场分析人士指出,商汤混合推理工厂的盈利节点比预期更早到来,反映了其技术路线与市场需求的高度契合。在国产算力替代与多模态推理加速的双重背景下,商汤若能持续保持成本优势与服务稳定性,有望在该赛道成长为标杆级基础设施供应商。总体而言,这一里程碑标志着商汤从“模型提供商”向“推理服务运营商”的转型初具雏形。盈利为后续研发投入提供了正向现金流,而需求的爆发则为规模扩张打开了天花板。在AI推理的黄金时代,商汤混合推理工厂正以高效的异构引擎,驶入放量增长的快车道。

Related

相關文章

天才,對AI發展到底有多重要?

加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

剛剛

Jeff Dean們,趕在貝葉斯AI到來之前跳船

Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

4 小時前

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分

Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

7 小時前

智元下架了首席科學家羅劍嵐

智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。

10 小時前