Thinking Machines推出首個開源大模型Inkling,主打定製化對抗“一刀切”AI
重點摘要
AI資訊AI新閒資訊正文Thinking Machines推出首個開源大模型Inkling,主打定製化對抗“一刀切”AI發布於AI新閒資訊時間 :Jul 16, 2026閱讀 :1分鐘由前OpenAI首席技術官Mira Murati創立的AI初創公司Thinking Machines Lab於2026年7月15日正式發佈其首個自主研發的開源人工智能模型Inkling。
由前OpenAI技術長Mira Murati創立的AI初創公司Thinking Machines Lab,在歷經一年半的基礎建設與模型研發之後,終於在2026年7月15日正式對外發表其首個自主開發的開源大型語言模型Inkling。這項發布不僅代表該公司首次公開亮相技術成果,更標誌著其選擇了一條與主流科技巨頭截然不同的道路——透過開放權重與高度客製化的設計,直接挑戰當前市場上以「一刀切」為核心的閉源AI商業模式。Thinking Machines Lab自成立以來便備受業界關注,其創辦人Mira Murati在OpenAI任內主導多項關鍵技術發展,離職後帶領團隊投入開源AI領域的基礎設施建設。
經過長達十八個月的低調研發,Inkling的問世終於讓外界一窺這家公司技術路線的全貌。與市面上追求通用、全能表現的封閉模型不同,Inkling從底層架構到應用理念都圍繞著「可塑性」與「企業級靈活性」進行設計。Inkling採用了當前業界頂尖的混合專家(Mixture of Experts, MoE)架構,整體模型參數量達到驚人的9750億,然而在實際運作時,系統僅需激活約410億個參數即可完成單一任務。這種設計讓模型得以同時兼顧超大規模的知識儲備與高效的運算成本,在維持高品質輸出的前提下,大幅降低部署時的硬體門檻與能源消耗。
據官方說明,Inkling在預訓練階段使用了高達45萬億個Token,內容涵蓋文本、圖像、音頻與視頻等多模態資料,使其具備跨模態的理解與生成能力,但目前正式版本主要支援文本、程式碼以及結構化資料的輸出。在技術表現上,Inkling最引人注目的特色在於其「可調節思考強度」功能。使用者可根據實際應用場景的需求,動態調整模型在推理過程中的運算深度,藉此在回應速度與精準度之間取得最佳平衡。這樣的設計讓企業得以針對不同業務模組設定不同等級的效能配置,而非被迫接受統一的運算邏輯。
根據官方公布的基準測試數據,Inkling在程式碼生成相關的評測中,僅需消耗NVIDIA Nemotron3Ultra模型約三分之一的Token數量,即可達到同等水準的表現,展現出極高的成本效益。Thinking Machines Lab將Inkling定位為企業級微調的起點,而非終端產品。為了讓企業能夠真正將模型落地到自身業務環境,該公司同步推出了模型客製化平台Tinker。Tinker提供從微調、測試到部署的一站式服務,企業用戶可以將Inkling的開放權重作為基底,導入私有資料進行領域調校,並透過分帳機制與託管服務進行商業化運作。
這種模式巧妙地避開了通用型聊天機器人的紅海競爭,轉而聚焦於企業對資料安全、模型可控性與成本效益的深層需求。當前AI產業正面臨兩大趨勢:一是企業對於專有資料外洩的憂慮日益加深,二是開源社群持續推動模型權重的透明化與可複製性。Inkling的誕生恰好回應了這兩個痛點。透過開放權重,企業不再需要將核心資料上傳至第三方伺服器,而是可以在自有基礎設施上進行微調與部署,從根本上降低資料外洩風險。同時,Inkling的MoE架構與低激活參數設計,也讓中小型企業有機會以相對較低的運算成本,享受到接近超大規模模型的效能表現。
業界分析人士指出,Thinking Machines Lab此次的產品策略,與目前主流AI公司以封閉API為核心的商業模式形成了鮮明對比。包括OpenAI、Google在內的大型科技業者,多數仍傾向提供統一規格的模型服務,使用者僅能透過API呼叫,無法深入調整模型內部的行為邏輯。而Inkling與Tinker的組合,則賦予了企業端更高的自主權,使其能夠針對特定行業的專業術語、法規要求或品牌語調進行精準校準,真正做到「模型為業務服務」而非「業務適應模型」。在開源社群的反應方面,Inkling的發布已吸引到大量開發者與企業IT團隊的關注。
由於其採用業界熟悉的Transformer衍生架構與MoE設計,許多具備深度學習背景的團隊已經開始著手評估將Inkling整合進既有流程的可能性。考量到該模型支援結構化資料輸出,對於需要處理大量報表、合約、程式碼與內部文件的企業而言,Inkling在自動化流程與智能分析方面的潛力相當可觀。值得注意的是,Thinking Machines Lab雖然選擇了開源路線,但其商業模式並非完全仰賴社群捐贈或免費授權。透過Tinker平台提供的託管微調服務與分帳機制,該公司建立了可持續的營收來源。
這種「開源核心+付費服務」的模式,在近年來的開源軟體領域已屢見不鮮,但將其應用於千億參數等級的大型語言模型,仍屬業界少見的嘗試。若此模式能夠成功,未來可能促使更多AI初創公司跟進,進一步打破頭部企業對高品質模型技術的壟斷。從時間點來看,Inkling的推出正值全球AI監管環境快速變化的時刻。歐盟的人工智慧法案已逐步生效,各國政府對於演算法透明度與資料治理的要求日趨嚴格。在這樣的背景下,能夠提供完整模型權重、允許企業自行審查與調整的開源方案,無疑擁有更強的合規彈性。
Thinking Machines Lab顯然也意識到這一點,因此在技術文件與授權條款中特別強調了模型的可解釋性與可控性,試圖搶佔受到嚴格監管的金融、醫療與公共服務領域。整體而言,Inkling的發布不僅是Thinking Machines Lab技術實力的首次展示,更是一場對當前AI商業典範的挑戰。它證明了在大型語言模型領域,開放與客製化並非效率的敵人,反而可能是企業級應用的最佳解方。隨著越來越多企業開始評估從封閉API轉向自建微調模型的可能性,Inkling的出現無疑為市場提供了一個具體且可行的替代方案。
未來,這款模型能否在實際部署中持續展現優勢,並帶動更多開發者與企業投入開源生態,將是業界持續關注的焦點。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。