亮相WAIC|靈汐科技LynAInfra(靈琍)類腦超節點重磅登場,重構大模型推理新格局

重點摘要
本屆世界人工智能大會WAIC期間,靈汐科技正式重磅發佈自研類腦超節點集群產品——LynAInfra(靈琍),以全鏈路自研的類腦算力方案,破解當下AI推理行業痛點,為國產高速推理賽道帶來全新選擇。 當前人工智能行業發展遇到明顯桎梏,能耗過高、推理延遲偏高兩大難題,持續阻礙AI推理業務大規模落地。即便GPU產品迭代更新,傳統芯片架構的底層侷限依舊無法被打破;但市場端推理需求迎來爆發,未來推理業務將佔據AI基礎設施市場80%以上份額。 伴隨著Token經濟興起,AI編程加速、AI視頻生成、多智能體協同等高價值場景,對推理時延和使用成本提出更高標準,GPU方案運營開銷大、首token延遲偏高的短板愈發突出,英偉達佈局Groq加碼高速推理賽道,也印證行業正在急切尋找推理架構革新方案。 立足行業現狀,靈汐科技依託自研類腦芯片存算一體、事件驅動、眾核並行的先天特質,發揮低功耗、低時延核心優勢,傾力打造面向高速推理場景的LynAInfra類腦高性能超節點,對標創新版Groq。 相較傳統GPU方案,產品推理能效比提升3-10倍,首token延遲壓縮至幾十到百毫秒級別,兼顧強悍推理性能與出色能耗水平,樹立起“瓦特換比特”的算力全新標杆。 LynAInfra靈琍一體化超節點集群由靈汐科技完全自主研發,依託國內已實現規模化商用落地的類腦芯片構建。LynAInfra128算力櫃搭載128張HP640系列板卡,單櫃級聯數千顆類腦芯片,釋放近100P@FP16算力,整機功耗控制在30kW以內。 依託自研LynxLink高速互聯協議以及統一內存地址編譯技術,產品既支持單機櫃算力提升(Scale up),也可以多機櫃橫向擴展(Scale out),打破單卡、單節點顯存和算力上限,適配不同體量大模型部署任務。設備採用風冷散熱方案,模塊化設計兼容現有智算中心機櫃、供電、網絡配套設施,大幅降低客戶部署改造成本。
本屆世界人工智能大會WAIC期間,靈汐科技正式重磅發佈自研類腦超節點集群產品——LynAInfra(靈琍),以全鏈路自研的類腦算力方案,破解當下AI推理行業痛點,為國產高速推理賽道帶來全新選擇。當前人工智能行業發展遇到明顯桎梏,能耗過高、推理延遲偏高兩大難題,持續阻礙AI推理業務大規模落地。即便GPU產品迭代更新,傳統芯片架構的底層侷限依舊無法被打破;但市場端推理需求迎來爆發,未來推理業務將佔據AI基礎設施市場80%以上份額。
伴隨著Token經濟興起,AI編程加速、AI視頻生成、多智能體協同等高價值場景,對推理時延和使用成本提出更高標準,GPU方案運營開銷大、首token延遲偏高的短板愈發突出,英偉達佈局Groq加碼高速推理賽道,也印證行業正在急切尋找推理架構革新方案。立足行業現狀,靈汐科技依託自研類腦芯片存算一體、事件驅動、眾核並行的先天特質,發揮低功耗、低時延核心優勢,傾力打造面向高速推理場景的LynAInfra類腦高性能超節點,對標創新版Groq。相較傳統GPU方案,產品推理能效比提升3-10倍,首token延遲壓縮至幾十到百毫秒級別,兼顧強悍推理性能與出色能耗水平,樹立起“瓦特換比特”的算力全新標杆。
LynAInfra靈琍一體化超節點集群由靈汐科技完全自主研發,依託國內已實現規模化商用落地的類腦芯片構建。LynAInfra128算力櫃搭載128張HP640系列板卡,單櫃級聯數千顆類腦芯片,釋放近100P@FP16算力,整機功耗控制在30kW以內。依託自研LynxLink高速互聯協議以及統一內存地址編譯技術,產品既支持單機櫃算力提升(Scale up),也可以多機櫃橫向擴展(Scale out),打破單卡、單節點顯存和算力上限,適配不同體量大模型部署任務。設備採用風冷散熱方案,模塊化設計兼容現有智算中心機櫃、供電、網絡配套設施,大幅降低客戶部署改造成本。
LynAInfra實現從芯片架構到集群互聯的全鏈路創新。多機櫃之間可以做到無感級聯,輕鬆承載超大模型運行任務,將推理性能與能效比推向行業前列。放眼產業長遠價值,LynAInfra128憑藉架構級節能優勢,用30kW功耗撐起近100P算力,減少算力使用過程中的碳排放,助力智算中心綠色建設,響應國家雙碳戰略;對於企業客戶而言,可以顯著降低大模型推理的單位算力開銷,縮減整體擁有成本,助力大模型落地於產業數字化、城市治理、前沿科研等場景;更深層次來看,整套方案堅持國產自主創新路線,擺脫國外算力架構束縛,加固國產算力供應鏈安全,以類腦創新算力賦能數字經濟高質量發展。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。