前OpenAI CTO穆拉蒂打造多模態Inkling模型登場,號稱美國最強開源AI
重點摘要
AI資訊AI新閒資訊正文前OpenAI CTO穆拉蒂打造多模態Inkling模型登場,號稱美國最強開源AI發布於AI新閒資訊時間 :Jul 16, 2026閱讀 :1分鐘由前OpenAI首席技術官米拉·穆拉蒂創立的思維機器實驗室推出首款從零訓練的多模態AI模型Inkling,被外界認為是美國當前最強的開源模型。
前OpenAI技術長米拉·穆拉蒂(Mira Murati)創立的「思維機器實驗室」(Thinking Machines Lab)於2026年7月15日正式發表首款從零訓練的多模態AI模型Inkling,這款開源模型一登場就被外界認為是美國目前最強勁的開源AI系統。穆拉蒂自去年離開OpenAI後,低調籌備新公司與技術團隊,如今端出首個具體成果,迅速吸引全球科技界目光。Inkling採用混合專家架構(Mixture of Experts),總參數量高達975B(9750億),但在運作時僅激活41B參數,因此能在保持強大性能的同時兼顧運算效率。
最長上下文可支援100萬個tokens,預訓練階段涵蓋高達45萬億個tokens的數據,且橫跨文本、圖像、音頻與影片四種模態。目前模型權重已開放,開發者可直接下載使用。團隊背景同樣是這款模型的一大亮點。思維機器實驗室約三分之二的核心成員來自OpenAI,他們在該機構曾主導多項前沿研究、產品開發與安全防護工作,堪稱豪華陣容。穆拉蒂本人過去在OpenAI擔任CTO,對大型語言模型及多模態技術有深刻經驗,這也讓外界對Inkling的技術基礎抱有一定期待。儘管出身顯赫,Inkling在推理與程式碼生成方面仍落後於中國的開源模型。根據公布的評測數據,智譜AI的GLM 5.
2在編碼、智能體推理與複雜推理任務上全面超前,SWEBench Pro得分為62.1%,高於Inkling的54.3%;而在終端代理任務Terminal Bench 2.1上,GLM 5.2更達到82.7%,遠超Inkling的63.8%。DeepSeek V4 Pro則在編碼與事實性測試中保有優勢;魔搭Kimi K2.6也在多項技術基準上勝出。不過,Inkling在數學領域表現搶眼,於AIME 2026測試中拿下97.1%的高分,成功超越DeepSeek。這項成績顯示該模型在邏輯推理與數學解題方面具有相當實力,補足了一部分與中國頂尖開源模型之間的差距。
在開源對手方面,Inkling對比美國本土模型展現明顯優勢。相較於NVIDIA的Nemotron 3 Ultra,Inkling在推理、程式碼編寫與智能體工作流等層面均實現壓制,進一步鞏固其「美國最強開源模型」的聲勢。然而,面對Claude Fable 5、GPT-5.6 Sol與Gemini 3.1 Pro等閉源巨頭時,Inkling在極限推理與軟體工程自主性上仍有可觀差距。以SWEBench Verified為例,Claude Fable 5得分高達95.0%;GPT-5.6 Sol在Terminal Bench 2.1上拿到89.5分,雙雙遠超Inkling的表現。
多模態能力則是Inkling另一個亮點。在視覺理解基準MMMU Pro中,Inkling取得73.3%的成績;音頻處理測試MMAU則拿到77.2%,與Gemini 3.1 Pro的82.5%相距不大,展現出這款開源模型在多模態領域的競爭力。整體而言,Inkling雖在部分高難度任務上不及閉源頂尖系統,但在開放權重的前提下能達到此水準,仍被視為開源社群的一大進展。思維機器實驗室的首款作品選擇開源路線,外界解讀為有意挑戰主流閉源AI模式,透過開放權重讓學術界與開發者可以自由下載、研究與改寫模型。這也呼應穆拉蒂過去在OpenAI期間談論AI安全與民主化的立場。
Inkling的問世,不僅為開源模型樹立新標竿,也讓美國在開源AI領域重新獲得一個有力的代表。隨著Inkling正式釋出,下一步的焦點將轉向其應用場景與社群回饋。特別是在編碼與推理能力上,團隊能否透過後續迭代縮小與中國開源勁旅以及閉源巨頭之間的差距,持續優化多模態表現,將決定這款「美國最強開源模型」能在全球AI競賽中走多遠。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。