雷峰網生成式AI

WAIC | 從能力領先到產業交付,科大訊飛如何讓AI成為真實世界生產力?

2026年7月18日 07:00

重點摘要

科大訊飛在WAIC展示從自主可控大模型到行業應用的完整AI生產力佈局,強調AI競爭已從模型能力轉向真實世界生產力。訊飛星火X2在高考測試中表現突出,並透過成本控制與產業深耕,在智慧教育、醫療、企業服務等領域實現大規模落地。軟硬體終端如AI學習機、翻譯機等持續獲得市場肯定,顯示AI正在成為真實世界的生產力工具。

站內 AI 整理稿

進入2026年下半年,AI產業的競爭格局正在發生根本性轉變。過去,大模型之間的較量圍繞著參數規模、榜單排名和單項能力的比拼。然而,當AI技術真正進入校園、醫院、辦公室與日常生活場景,決定其價值的標準,已經從「模型能不能寫會算」,轉向「能不能在真實流程中穩定運作、創造效率」。這意味著,AI競賽的主戰場,已從模型能力的對決,邁向「真實世界生產力」的交付。今年在上海舉行的世界人工智能大會(WAIC)上,科大訊飛將以「解放生產力 釋放想像力」為主軸,全面展示其從底層模型、行業應用到智慧終端的完整AI生產力佈局。這不僅是一次產品展示,更是科大訊飛對AI產業新階段的系統回應。

要讓AI成為真實世界的生產力,不能只靠一個會對話的模型,而需要一套穩定可靠的基礎設施、持續領先的模型能力、深入行業的應用場景,以及被用戶持續使用的真實載具。在這條路徑上,科大訊飛選擇了兩個關鍵詞:全棧自主可控,以及能力持續領先。自主可控並非退而求其次,更不是在安全與效能之間妥協。對於教育、醫療、政務等核心領域來說,一個能夠紮根的大模型,必須同時滿足兩個條件:底座掌握在自己手中,且能力足以對標世界一流。科大訊飛選擇了一條更難的路——不是把已經在其他算力平台訓練好的模型搬遷到國產晶片上部署,而是從零開始,在全國產算力平台上完成模型的訓練、迭代與推理部署。

這看似一步之差,實則是完全不同的能力層級:推理是機器搬廠運作,訓練則是在新廠房裡完成設計、製造與升級,考驗的是從參數更新、數值穩定到多機多卡通訊、故障恢復的整套系統能耐。2023年10月,科大訊飛與華為聯合發布國內首個全國產算力平台「飛星一號」,同年5月推出的訊飛星火大模型,自此持續走上海全產算力訓練與迭代的道路。初期,國產算力集群的訓練效率僅為同規模英偉達集群的約30%,但經過算子優化與工程調校,效率逐步提升至84%至93%。2024年10月,基於國產萬卡集群訓練的訊飛星火4.0 Turbo正式發布,七項核心能力在中文領域全面超越GPT-4 Turbo。

2025年,業界首個基於全國產算力訓練的深度推理模型「訊飛星火X1」問世,並持續迭代至X1.5,在參數規模小一個數量級的情況下,整體效果比肩業界領先水準。進入2026年,星火星火加速迭代。2月,訊飛星火X2升級,採用MoE稀疏架構,推理效能較X1.5提升50%;4月,星火X2-Flash發布,針對智能體與程式碼任務優化效率;6月,星火多模態大模型X2-VL問世,強化圖文理解與視覺推理能力。這些版本演進證明,國產算力底座不僅能支撐大模型訓練,更能支撐領先模型的持續進化。然而,僅有自主可控還不夠,能力領先才是進入高價值場景的關鍵。近期多家媒體組織的大模型測評中,訊飛星火X2表現亮眼。

在羊城晚報教育發展研究院舉辦的「高考」全科測試中,星火X2在物理類總分與Claude Opus 4.8同獲708分並列第一,歷史類總分亦突破700分,成為唯一在兩條賽道均達「屏蔽生」水準的模型。新京報數學測試中,星火X2以148分居首;澎湃新聞作文測試中,星火X2以65.5分奪冠,英文作文亦與ChatGPT 5.5 Pro並列第一梯隊。在通用能力上,星火X2在AIME 2025測試中取得95.7分,展現競賽級數學解題能力;MMLU Pro中獲得87.3分,並支援超過130種語言的處理。聰明只是起點,交付才是真正的考驗。

在智慧體時代,複雜任務的token消耗動輒數十萬到上百萬,企業關心的不只是模型多強,而是完成任務的成本與穩定性。科大訊飛沒有盲目追求最大參數,而是透過技術提升效率。星火X2-Flash以30B總參數,在智能體核心任務上接近萬億級模型的表現,但整體token消耗不到後者的三分之一。對於需要大規模部署Agent的企業來說,跑得動、跑得穩,遠比一次驚豔的演示更重要。成本是門檻,行業理解則是更深層的護城河。科大訊飛在教育領域深耕超過二十年,已在全國6萬餘所學校深度應用,服務超過1.6億師生。搭載大模型的星火智能批閱機,日均批改作業超過600萬頁,建構覆蓋4000多個錯誤標籤的三級分析體系。

在醫療領域,「智醫助理」已在31個省市、806個區縣常態化應用,累計提供超過12億次AI輔診建議,幫助修正有價值的病例超過203萬例。2026年6月,基於全國產算力訓練的星火醫療大模型V3.5升級發布,持續提升語音辨識、病歷生成與醫學影像輔診能力。在企業服務方面,星辰Agent已整合百餘種開放平台能力,智能體數量超過130萬。招採智能體讓核心場景效率提升超過3倍,開發時間從幾天縮短到分鐘級。

2023年10月以來,科大訊飛已與能源、金融、汽車、運營商、政務等行業龍頭共同發布20多個行業大模型,覆蓋超過300個應用場景,並成為國家能源集團、中糧集團、工商銀行、中國人保、中國移動等數十家央國企的大模型合作夥伴。據公開數據統計,2024年與2025年,科大訊飛在中國通用大模型廠商中的中標項目數與金額連續兩年位居首位,2025年中標數達210個,總金額超過23億元。真實世界的AI不只存在於雲端,更發生在每個人身邊。教室、會議室、車內、家庭,這些場景充滿噪音、遠場、多人口音與個性化需求。

科大訊飛將麥克風陣列、語音辨識、多模態感知等軟硬體能力與星火大模型結合,推出AI學習機、AI眼鏡、智能辦公本、翻譯機、同傳麥克風、AIPC、聽見APP等終端產品,以及服務於教育、醫療、汽車等領域的B端方案。2026年「618」期間,科大訊飛的AI學習機、智能辦公本、翻譯機、AI錄音筆等產品在各大電商平台多個品類奪得銷售冠軍,其中翻譯機已連續10年、AI學習機連續4年拿下品類銷售冠軍。今年WAIC的主題是「智能夥伴,共創未來」。對於科大訊飛而言,智能夥伴不再只是螢幕中的對話對象,而是課堂中的教學助手、醫院裡的診療輔助、企業裡的流程協同者,甚至是有形世界中的行動單元。

從自主可控的底座,到教育、醫療、企業服務與智慧終端,科大訊飛試圖展示一條完整的路徑,讓AI從技術起點出發,穿過行業流程與用戶入口,真正抵達每個人身邊,成為真實世界的生產力夥伴。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

39 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前