科大訊飛發佈星火Token Factory,打造企業級AI模型智能路由與治理新底座

重點摘要
# 科大讯飞发布星火Token Factory,企业级AI模型智能路由与治理平台正式亮相 2026年7月19日,科大讯飞正式推出星火Token Factory,定位为企业级AI模型智能路由与治理平台,旨在帮助企业构建面向未来的人工智能基础设施。随着大模型应用从单点试点走向多业务、多场景规模化落地,企业对模型资源统一管理、成本优化和安全治理的需求日益迫切,星火Token Factory的发布恰逢其时。 当前,企业在部署大模型时面临一系列运营挑战。
# 科大讯飞发布星火Token Factory,企业级AI模型智能路由与治理平台正式亮相
2026年7月19日,科大讯飞正式推出星火Token Factory,定位为企业级AI模型智能路由与治理平台,旨在帮助企业构建面向未来的人工智能基础设施。随着大模型应用从单点试点走向多业务、多场景规模化落地,企业对模型资源统一管理、成本优化和安全治理的需求日益迫切,星火Token Factory的发布恰逢其时。当前,企业在部署大模型时面临一系列运营挑战。不同业务场景需要调用不同的模型能力,但实际操作中往往采用统一模型处理,导致资源浪费和成本高企。同时,多种模型并行运行对系统稳定性与安全合规形成压力。
企业关注的重点正从模型能力本身转向如何将AI能力有效融入业务体系,实现稳定运行、统一治理和持续优化。科大讯飞正是基于这一现实痛点,推出了面向大规模运营的模型治理底座。星火Token Factory作为连接企业应用与大模型的统一中间层,提供模型统一接入、智能路由调度、Token成本优化、安全合规治理等核心能力,形成覆盖“接入—治理—观测—运营”全链路的完整闭环。平台致力于成为企业大模型服务的统一入口,实现模型资源的可管、可控、可追溯,从而支撑企业实现AI的高效管理与规模化运营。智能路由是平台的核心亮点。
系统通过分析Prompt长度、规则配置、对话轮次、session亲和性等多维特征,将请求划分为L1至L3不同复杂度等级。在此基础上,平台综合考虑质量、成本、延迟、可用性和安全等级五个优化因子,为每个请求动态匹配最合适的模型。简单任务调用性价比高的模型,复杂任务则调用能力更强的模型,从而实现资源利用最大化,显著降低总体Token成本。整个路由决策过程平均延迟控制在100毫秒以内,确保用户体验不受影响。在推理引擎层面,星火Token Factory针对国产昇腾硬件进行了端到端的深度优化。
通过模型压缩与精度优化、算子融合、计算通信调度重排、分布式KV Cache管理以及并行解耦加速等一系列技术,平台大幅提升了本地推理效率。实际测试表明,在相同硬件条件下,星火Token Factory相比主流开源框架vLLM-Ascend推理效率提升约5倍,首Token延迟降低30%至40%。这使得同等算力能够支撑接近翻倍的业务请求量,或使用更少算力达成相同服务水平,为国产化私有部署带来了显著的性能与成本优势。安全治理是企业级应用的重中之重。
星火Token Factory采用“三权分立”原则,确保管理不碰数据、操作不碰权限、审计不碰业务,配合混合授权机制,从制度和技术两个层面杜绝越权与数据泄露风险。所有关键操作生成不可篡改、不可删除、不可绕过的全链路审计日志,覆盖数据访问、权限变更、模型调用等六大类操作,充分满足等保合规要求。此外,平台支持对个人隐私信息(如身份证、手机号、银行卡等)和经营敏感数据(财务、薪资、合同等)进行分级路由,确保敏感数据不流出安全域。面对企业AI应用日益增多的现状,成本归因与运营监测变得愈发关键。
星火Token Factory提供端到端全链路日志审计能力,完整记录每一次模型调用的路由决策、Token消耗和响应状态。通过精细化的预算管理、ROI分析和可视化报表,企业能够清晰掌握AI算力的使用情况,快速定位问题,并为后续资源规划和运营优化提供数据依据,真正实现从“黑盒运行”到“透明运营”的转变。星火Token Factory的发布,进一步丰富了科大讯飞在企业AI基础设施领域的产品矩阵。通过打造统一、高效、安全的模型管理平台,科大讯飞为企业构建可持续升级的AI应用体系提供了坚实基础。这不仅标志着企业AI治理能力的一次重要升级,也意味着大模型应用正从单点探索正式迈入规模化运营的新阶段。
科大讯飞方面表示,未来将持续优化星火Token Factory的能力,以更加开放、高效、稳定的AI基础设施服务,助力更多企业加速释放人工智能价值,推动产业智能化发展,帮助企业在AI浪潮中建立长期可持续的竞争优势。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。