百萬 Token 上下文首次下放到端側:訊飛星火 X2.5 雙子星開源,全程國產算力訓練
AI資訊AI新閒資訊正文百萬 Token 上下文首次下放到端側:訊飛星火 X2.5 雙子星開源,全程國產算力訓練發布於AI新閒資訊時間 :Sep 1, 2026閱讀 :1分鐘9 月 1 日,科大訊飛全資子公司詞元星火正式推出並開源星火 X2.5-4B 和星火 X2.5-1.7B 兩款端側通用大模型。這兩款產品也是端側模型中首個原生支持最長 100 萬 Token 上下文的模型,同時已全面開放模型權重、代碼倉庫和部署文檔。百萬級上下文加持,小模型也能“讀全書”兩款模型均採用混合注意力架構,圍繞智能體、代碼、數學和指令遵循等核心能力進行優化,綜合實測能力領先業界同尺寸一流開源模型。
在上下文能力上,星火 X2.5-4B 和 1.7B 使用覆蓋長篇文檔、技術資料等場景的千億 Token 級高質量數據訓練,原生支持 100 萬 Token 上下文窗口,可以一次接收和理解更大規模的信息。以產品售後為例:用戶可將完整售後手冊導入星火 X2.5-4B,模型先梳理不同場景下的售後規則並標註對應章節,當被問及“購買 10 天后設備故障且使用過第三方耗材是否符合換貨要求”時,能夠關聯退換貨、故障處理和例外條件等跨章節規定給出綜合判斷。即使後續補充偏遠地區、設備存有家庭地圖等新條件,模型也能保持前文情境,結合物流、數據清除、費用承擔等規則繼續給出建議。
長上下文解決的是“信息能不能看全”,智能體和工具調用能力解決的則是“看完之後能不能動手”。星火 X2.5 端側模型可面向個人辦公、代碼開發、智能硬件和機器人等場景提供本地化智能能力。在代碼開發場景中,星火 X2.5-4B 在算法實現、代碼補全與生成等任務上可對標參數規模大 2 至 3 倍的雲端模型;在 Domux 智能家居測試集上,星火 X2.5-1.7B 的控制指令端到端執行正確率達到 90.3%,平均響應時間僅 0.85 秒;在機器人場景中,兩款模型可部署在機器人本體或邊緣設備,支持操作控制、目標追蹤、導航決策等任務,減少對雲端連接和固定預設程序的依賴。
全程國產算力訓練,即刻可下載體驗星火 X2.5-4B 和 1.7B 均基於全國產算力平臺完成全流程訓練,使用約 20 萬億 Token 多樣化數據進行預訓練,並通過高質量監督微調和強化學習持續提升表現。部署層面,兩款模型支持 NVIDIA、華為、海光及後摩等硬件平臺,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通過 Ollama、LM Studio 等工具快速部署,並支持使用 LLaMA-Factory 開展增量訓練。即日起,模型權重已在 Hugging Face、GitHub 等平臺開放,對應模型 API 已上線訊飛星辰 MaaS 平臺,限時免費。
9 月 7 日,科大訊飛還將正式發佈全新一代旗艦通用大模型星火 X2.5,進一步升級代碼和智能體等核心能力。相關推薦科大訊飛旗下詞元星火重磅開源兩款全新機型9月1日,科大訊飛子公司詞元星火開源星火X2.5-4B和1.7B兩款端側通用大模型,原生支持最高100萬Token超長上下文,突破端側算力瓶頸,讓小體積設備也能處理超長文本,推動端側AI性能與容量雙重升級。Sep 1, 202630.7k科大訊飛將發佈星火X2.5通用大模型科大訊飛9月1日將開源星火X2.5-4B和1.
7B兩款端側通用大模型,原生支持1M token長上下文,重點提升智能體交互、數學計算與通用理解能力,面向車載、智能硬件及萬物互聯等端側場景。9月7日還將發佈更大規模模型。Aug 31, 2026245.3k科大訊飛旗下詞元星火重磅開源兩款全新機型9月1日,科大訊飛子公司詞元星火開源星火X2.5-4B和1.7B兩款端側通用大模型,原生支持最高100萬Token超長上下文,突破端側算力瓶頸,讓小體積設備也能處理超長文本,推動端側AI性能與容量雙重升級。Sep 1, 202630.
7k35 億美元押注聯發科:英偉達聯手打造覆蓋 AI 工廠到 PC 的下一代計算平臺英偉達與聯發科宣佈深化合作,覆蓋AI基礎設施、本地AI計算與汽車領域,共建下一代AI計算平臺。英偉達投資35億美元聯發科可轉債。聯發科將採用NVLink Fusion平臺,為超大規模企業、雲服務商等提供定製XPU,接入英偉達AI工廠。Sep 1, 2026125.4k千問學習功能升級:新增教材同步作文輔導,互動講解擴展至高中大學數理化,全部免費9月1日開學季,阿里通義千問APP升級學習功能:新增同步教材單元作文輔導、初中語文數學教材精講,拍題講解擴展至高中大學數理化,全部免費。
作文輔導不直接給範文,而是連續提問引導學生梳理素材與結構,如“我的心愛之物”逐步挖掘細節,完成審題構思。Sep 1, 2026120.8k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

3秒出片比播放還快,MiniMax打開了AI視頻的實時商業化路徑
MiniMax推出新一代影片生成模型H3 Max,生成5秒768p影片僅需不到3秒,速度已超越播放速度,並帶動AI即時直播與AI版短影片App等創新應用。該模型基於開源的H3進行後訓練與推理優化,吞吐量約為原版35倍,同時在圖生影片評比中拿下第一。市場上已出現多個由開發者打造的即時生成直播頻道,顯示此技術開啟新的商業化路徑,而MiniMax股價也在近期大漲。

奧特曼播客曝猛料:Astra操作電腦已達人類水平
OpenAI 執行長奧特曼(Sam Altman)近日在一場播客訪談中投下震撼彈,直言旗下 AI 代理系統 Astra 在操作電腦方面的能力,已經達到與人類相當的水準。這番談話迅速在科技圈發酵,外界普遍將其視為 AI 從「回答問題」邁向「實際動手執行任務」的關鍵分水嶺。 奧特曼在節目中並未停留在技術層面的描述,而是進一步闡述 AI 能力躍升後對社會結構的深遠影響。他特別點名高等教育體系,認為傳統四年制大學的養成模式已經跟不上時代,主張兩年就足以完成必要的學術訓練。

奧特曼直言:四年太久,大學兩年就夠
OpenAI 執行長山姆·奧特曼(Sam Altman)近日再度拋出震撼教育界的觀點。他向外界直言,傳統大學四年學制早已不合時宜,在人工智慧迅速改變知識取得與技能養成的當下,兩年時間便足以讓年輕人具備進入社會所需的核心能力。這番言論迅速在矽谷與科技圈引發熱烈討論,也讓外界重新審視高等教育的效率與未來走向。 奧特曼長期以來便對现行教育體系抱持批判態度。他認為,現行的大學課程設計源自工業時代的標準化思維,過度依賴課堂授課與學分累積,卻忽略了學生真正需要的是解決問題的能力與實作經驗。

月之暗面與微軟、谷歌、亞馬遜談判, 爭取最高30%服務分成
中國月之暗面就Kimi K3與美雲企談30%收入分成,具標誌性意義。 近日,財聯社報道,據消息人士透露,月之暗面正就Kimi K3 AI模型與微軟、亞馬遜、谷歌進行收入分成談判。月之暗面在初期談判中,正尋求從K3相關服務產生的收入中抽取最高30%的分成。 如果談成,這將是中國AI公司和美國雲巨頭之間,第一個大型模型收入分成協議。 不過談判仍處於早期階段,分成核算口徑、合作落地週期、服務邊界等核心細節尚未最終敲定。目前,涉及的三家雲廠商和月之暗面都拒絕對談判公開發表評論。

混元Hy4 preview輕量版來了!權重壓縮86%,性能幾乎不減
(公眾號:zhidxcom) 作者 | 程茜 編輯 | 心緣 9月1日報道,今日中午,騰訊發佈了其最新一代旗艦模型預覽版本Hy4 preview的輕量版模型,將模型權重從1.5TB壓縮到214GB。 騰訊混元的測試結果顯示,壓縮後的模型與Hy4 preview原始模型相比,長文理解、多輪長上下文檢索和原版基本在同一水平,數學有小幅回落。壓縮後模型能覆蓋日常編程輔助、工具調用、長文檔處理和常規問答。

2026年的一切,都只是Robocity的序幕
35分鐘前“最強大腦”與“最強小腦”相互需要2026-08-11百度AI的驗牌時刻到了2026-07-27閱讀更多內容,狠戳這裡查看AI測評DeepSeek選靠譜AI,看真實評測查看AI測評官方交流社區加入諮詢項目審核和入駐聯繫項目推薦訂閱號關注下一篇馬斯克狂贊,硅谷大佬驚呼:Grok Bot是下一個ChatGPT時刻硅谷投資人稱Grok Bot是新ChatGPT時刻,為AI生產革命。