CNCF發佈招商銀行AI調度平臺案例 源於範式的HAMi技術獲生產級驗證

重點摘要
云原生计算基金会(CNCF)近日正式发布了一项重量级案例研究——招商银行基于HAMi构建的AI计算调度平台。该案例是HAMi从CNCF Sandbox级别晋升至Incubation级别后,首个获得官方认证的标杆项目,标志着这项由中国团队发起并主导的开源技术已在金融级生产环境中获得国际权威认可。 HAMi项目的起源可以追溯到范式智能内部的vGPU技术实践。范式智能是一家全栈AI云服务平台提供商,面对异构GPU设备碎片化严重、资源调度效率低下等普遍性痛点,其团队选择将内部能力开源,推动AI算力管理基础设施的标准化。
云原生计算基金会(CNCF)近日正式发布了一项重量级案例研究——招商银行基于HAMi构建的AI计算调度平台。该案例是HAMi从CNCF Sandbox级别晋升至Incubation级别后,首个获得官方认证的标杆项目,标志着这项由中国团队发起并主导的开源技术已在金融级生产环境中获得国际权威认可。HAMi项目的起源可以追溯到范式智能内部的vGPU技术实践。范式智能是一家全栈AI云服务平台提供商,面对异构GPU设备碎片化严重、资源调度效率低下等普遍性痛点,其团队选择将内部能力开源,推动AI算力管理基础设施的标准化。
自2024年8月加入CNCF以来,HAMi在不到两年时间内完成了从Sandbox到Incubating的快速升阶,在社区治理、安全性、采用广度和项目成熟度方面均达到国际顶级开源标准。在本次发布的案例中,招商银行借助HAMi在Kubernetes基础上搭建了“一池多芯、弹性共享、拓扑优化”的统一异构AI计算调度平台。平台通过“一池多芯”实现了多厂商、多类型算力芯片的统一池化管理;“弹性共享”使算力资源可根据业务需求动态分配,有效聚合碎片化资源;“拓扑优化”则针对分布式训练和推理任务进行最佳性能调优。
实际运行数据显示,该平台将硬件池利用率提升至100%,分布式训练跨机调度概率降低30%,直接回应了金融行业长期面临的算力孤岛、资源闲置和运维成本高等难题。行业分析人士指出,招商银行的这一实践为金融业AI基础设施建设提供了可复用的参考范式。作为强监管行业,金融企业对技术的稳定性、安全性和可控性要求极高。招商银行的成功验证了HAMi在金融级生产环境中的可靠性,有望推动更多金融机构采纳类似的算力池化方案。HAMi开源生态的发展同样迅速。
截至目前,该项目已吸引来自17个国家和地区的500余名开发者参与贡献,最终用户覆盖云服务商、互联网、金融、汽车、物流、教育等领域的超过300家企业,并已拓展至东南亚、欧洲等海外市场。在生产部署方面,蔚来汽车利用HAMi提升自动驾驶训练与仿真效率,贝壳找房优化异构算力池化,顺丰科技用于大模型推理流量调度,SNOW Corp.、DaoCloud、PREP EDU等也在各自核心场景中应用了HAMi。根据实际运营数据,通过异构加速器共享与隔离调度,企业最高可节省80%的硬件采购成本,GPU综合利用率提升5至10倍。
今年,HAMi项目在KubeCon+CloudNativeCon Europe阿姆斯特丹主论坛的Keynote环节亮相,成为近年来唯一获此演讲席位的中国开源项目。这一成就反映出全球云原生生态对中国AI算力调度技术的高度关注,也代表着HAMi的国际影响力迈上新台阶。范式智能作为HAMi项目的核心发起方和主要贡献者,近期在技术层面持续加码。范式率先将Kubernetes DRA(动态资源分配)标准推向生产级,完成了libvgpu.so动态注入、环境变量配置、临时目录管理等关键工程突破,并已实现对NVIDIA、昇腾、昆仑芯等主流芯片的适配落地。
这使得HAMi能够支持更为广泛的硬件生态,进一步强化其在异构环境中的竞争力。业内普遍认为,HAMi从加入CNCF到获得官方标杆案例认证的快速成长,充分体现了其在项目成熟度、社区活跃度和技术领先性上的综合实力,也标志着源自中国工程实践的开源技术正在加速迈向全球AI算力调度领域的事实标准。未来,随着AI基础设施持续向开放、高效、标准化演进,HAMi有望在更大范围内推动算力资源的管理变革,助力企业规模化落地AI应用。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。