穆拉蒂重磅迴歸:思維機器實驗室發佈首款多模態開源模型 Inkling
重點摘要
AI資訊AI新閒資訊正文穆拉蒂重磅迴歸:思維機器實驗室發佈首款多模態開源模型 Inkling發布於AI新閒資訊時間 :Jul 16, 2026閱讀 :1分鐘前 OpenAI 首席技術官米拉·穆拉蒂(Mira Murati)日前正式揭曉了其創立的“思維機器實驗室”(Thinking Machines Lab)的首個重磅成果——多模態 AI 模型 Inkling。
OpenAI 前技術長米拉·穆拉蒂(Mira Murati)所創立的思維機器實驗室(Thinking Machines Lab),於 7 月 16 日正式揭曉了團隊成立以來的首款重大成果——多模態 AI 模型 Inkling。這款模型憑藉出色的綜合性能,迅速被業界視為當前美國開源 AI 領域最強勁的挑戰者,也標誌著穆拉蒂在離開 OpenAI 後,以創辦人身分重新站上人工智慧舞台。思維機器實驗室的創始團隊陣容相當引人矚目,約有三分之二的成員來自 OpenAI。這些研究人員過去曾深入參與 OpenAI 的前沿研究、產品落地以及安全機制構建等關鍵工作,累積了紮實的實戰經驗。
Inkling 正是這支頂尖團隊從零開始自主訓練的第一款模型。在技術規格方面,Inkling 採用混合專家(Mixture-of-Experts, MoE)架構,總參數量達到 975B(9,750 億個參數),但每次推論時僅激活 41B(410 億)個參數,在運算效能與使用效率之間取得平衡。此外,該模型支援高達 1 百萬 tokens(1M tokens)的上下文窗口,能夠處理極為冗長的輸入內容。預訓練階段,Inkling 消化了 45 萬億 tokens(45T tokens)的數據,涵蓋文本、圖像、音訊及影片等多種模態,使其具備原生的多模態理解能力。
目前,思維機器實驗室已透過 Hugging Face 平台以及自家推出的 Thinker API,全面公開 Inkling 的模型權重。開發者與研究人員可以自由下載、使用,甚至針對特定需求進行微調,這項開放作法為開源社群提供了一個即戰力極高的基礎模型。在多項橫向基準測試中,Inkling 展現了全面的競爭力。數學求解方面,Inkling 在 AIME 2026 測試中取得 97.1% 的高分,略高於 DeepSeek V4Pro;在智能體工作流程測試 MCP Atlas 中,更以 74.1% 的成績遠超 Nemotron3Ultra,顯示其在代理任務上的優異表現。
然而,面對頂級閉源模型,Inkling 並非在所有領域都占上風。在推理、編碼以及特定軟體工程任務中,它與 Claude Fable5 或 GPT-5.6 Sol 仍有距離;但在原生視覺與音訊理解方面,Inkling 則展現出極強的實力。例如,在音訊處理基準測試 MMAU 中,它拿下 77.2% 的分數,已經非常接近 Gemini 3.1 Pro 的水準。若放眼當前美國開源模型生態,Inkling 與 GLM 5.2、DeepSeek V4Pro 以及 Kimi K2.6 等對手相比,表現各有千秋。GLM 5.
2 在純編碼與複雜推理任務上依然保持優勢,而 Inkling 則在通用指令跟蹤(IFBench)中略勝一籌,顯示出不同模型各自擅長的領域。整體而言,Inkling 的推出不僅是穆拉蒂團隊的首秀,也為開源社群帶來一個具備強大原生多模態能力的基座模型。隨著權重全面開放,這款模型有望在未來的 AI 開發與應用中扮演重要角色,也讓外界更加期待思維機器實驗室的下一步動向。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。