國產黑馬本地大模型StartLux-27B正面硬剛DeepSeek,開啟端側AI新時代

2026年8月31日 03:377300 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文國產黑馬本地大模型StartLux-27B正面硬剛DeepSeek,開啟端側AI新時代發布於AI新閒資訊時間 :Aug 31, 2026閱讀 :1分鐘中國信通院人工智能研究所近日公佈的檢驗報告顯示,上海原點星輝科學技術有限公司(StartLux)研發的本地大模型 StartLux-V1.0-27B-Preview 在可信AI大模型基準測試(MCP專項測試)中表現亮眼。該模型以27B 的參數量取得了綜合性能排名第二的成績,超越了第三名的 DeepSeek-V4-Flash,其能力範圍正式跨入 DeepSeek-V4-Pro 所代表的萬億參數模型能力區間。

此次 MCP專項測試共涵蓋位置導航、網頁搜索、瀏覽器自動化、金融分析、代碼倉庫管理、3D設計等6類專項任務及綜合評估,重點考察大模型在多工具協同、複雜任務執行及真實環境交互等維度的綜合表現。測試結果顯示,StartLux-V1.0-27B-Preview 綜合得分為39.25,不僅超越了284B 的 DeepSeek-V4-Flash-0731和198B 的 Step-3.7-Flash,在同等參數規模下也比 Qwen-3.6-27B 高出5.34個百分點。在單項任務中,該模型在位置導航上斬獲第一,在瀏覽器自動化與金融分析等任務中則與1.

6T 參數的 DeepSeek-V4-Pro 並列第一或獨佔鰲頭。這一突破源於技術路徑的創新。StartLux 以 Qwen3.6-27B 為基座進行後訓練定向增強,團隊自主設計了全新、多維度、可驗證、可規模化的模型優化升級技術。在訓練過程中,團隊採用 AI 訓練 AI(Auto Research)方法自主開展訓練實驗,並通過反饋持續持續優化策略,使其成為國內首個採用該方法進行後訓練的本地 Agent 模型。這一進展折射出行業的深刻轉向:當基礎模型能力跨過實用門檻,過去兩年以參數規模為核心的軍備競賽已進入同質化階段。

相比跑分,企業和用戶更關注實際問題解決能力、數據安全與可控成本,而這些需求正加速推動本地大模型走向前臺。當前,Google、Meta、英偉達等全球科技巨頭均在加速佈局30B 級別的本地模型,行業普遍預測本地大模型將在未來幾年內佔據重要市場份額。目前,StartLux-V1.0-27B-Preview 已經能夠在消費級個人電腦上運行。據悉,該公司計劃於年內推出第一代本地智能解決方案,同時團隊也在穩步推進後續訓練,並對擴散式語言模型等新架構展開深入研究與優化。相關推薦國產AI生態迎高光時刻:調用量連冠全球,明星模型強勢登頂上週全球AI大模型總調用量達69萬億Token,環比增長21.48%。

中國大模型周調用量34.25萬億Token,環比增21.76%,繼續保持強勢領跑;美國同期為9.17萬億Token。中國在算力與應用的全球角逐中優勢顯著。Aug 10, 2026376.6k騰訊CodeBuddy全面支持DeepSeek-V4-Flash正式版,Agent能力大幅提升CodeBuddy全系產品適配DeepSeek-V4-Flash正式版,新模型強化AI Agent能力,在基準測試中顯著超越前代預覽版。優化代碼生成、任務執行與複雜開發流程,為開發者提供更高效的智能編程體驗。Aug 3, 2026488.

2kDeepSeek-V4-Flash 正式版上線國家超算互聯網:一鍵調用,性能叫板最強閉源模型DeepSeek發佈V4-Flash穩定版並啟動API公測,國家超算互聯網平臺同步上線API調用與模型下載。該模型經後訓練,智能體與指令遵循大幅增強,基準測試可比肩強閉源模型。接入門檻極低,用戶無需配置。Aug 3, 2026373.7kDeepSeek-V4-Flash正式版上線,130億激活參數撬動Agent戰場7月31日,DeepSeek-V4-Flash正式版API上線。該模型Agent性能逆襲Pro版,打破以往強弱分層邏輯。總參數2840億,在Terminal Bench2.

1等基準測試中斬獲高分。此舉標誌國產大模型在Agent賽道邁出關鍵一步。Jul 31, 2026359.9k中國大模型周調用量連續三週超越美國 騰訊Hy3 preview周調用量2.66 萬億全球AI競爭加劇,最新數據顯示,中國大模型周調用量連續三週超越美國。5月11日至17日,全球AI大模型總調用量達26.9萬億Token,環比增4.7%。其中,中國貢獻7.693萬億Token,美國為4.24萬億Token,中國調用量明顯領先。May 18, 2026262.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

「GPT-6」灰測demo刷屏!週四發佈在即

OpenAI傳聞中的旗艦模型「Astra」疑似即為GPT-6,近期流出內部測試demo,展示驚人的3D資產生成能力,包含可演奏的鋼琴與細節完整的城堡,社群反應熱烈,但官方尚未證實。該模型原定8月推出,因安全疑慮而延期,如今傳出最快將於本週四(9月3日)正式發布。

剛剛
IT之家生成式AI

騰訊混元:Hy4 preview 調用激增,WorkBuddy 已緊急擴容

作者:浩渺 責編:浩渺 評論: 感謝網友 不一樣的體驗、files、麻辣清補涼 的線索投遞!8 月 31 日消息,騰訊混元今日發文稱,自 2026 年 8 月 28 日混元 Hy4 preview 在 WorkBuddy 首發接入以來,憑藉其 Agent 能力的顯著提升,受到了廣大用戶與開發者的積極體驗和熱情反饋,上線首日即在 WorkBuddy 任務隊列中出現排隊情況,對此深表歉意。

剛剛
鈦媒體生成式AI

上線一月,Seedance 2.5能否抗住“平替”圍攻?

Tech星球2026.08.31 11:24 · 來自北京全文3579字00:00 / 10:35平替扎堆來襲,Seedance 正在遭遇什麼? 文 | Tech星球,作者 | 翟元元字節跳動旗下視頻生成大模型Seedance 2.5上線近一個月,用戶對它的評價呈兩極分化:一種聲音認為它價格太貴,生成一段十幾秒的視頻最後需要幾十塊,對個人創作者而言門檻過高,貴是原罪。另一種聲音則認為,它是地表最強視頻生成模型,生成效果最好,暫時無人超越,貴但好用。即便眼下Seedance 2.

剛剛

AIGC,闖進長片片場

生成式AI的創作能量已從短影音延伸至長片電影製作,實際參與前製概念圖、動態分鏡到後期特效等環節,象徵其角色從輔助工具轉為能主導風格與敘事節奏的創作夥伴。不過進入長片也面臨人物一致性、跨場景細節誤差與複雜多人互動等技術門檻,導演與剪接師須在AI的創意生成與精準敘事間取得平衡。此外,AIGC正重塑影視產業的勞動分工與成本結構,雖為獨立製片開啟新可能,也迫使從業人員重新定位價值,以原創性與手工感作為區隔平庸與傑作的關鍵。

剛剛