Kimi K3 已提前亮相?神秘模型「Kivine」現身,百萬上下文能力驚豔全球
重點摘要
如果傳聞屬實,Kimi K3 將成為國產模型的重要節點。 作者丨鄭佳美、樊天驕 編輯丨馬曉寧 7 月 15 日,一款名為 Kivine 的匿名模型突然出現在 LMArena。按照正常流程,它本應該只是眾多匿名測試模型中的一個,等待用戶通過盲測判斷能力高低。但這一次情況有些不同,在上線之後短短幾個小時內,Kivine 就迅速成為全球 AI 社區關注的焦點。
7 月 15 日,一個名為 Kivine 的神祕模型突然登上知名 AI 模型評測平台 LMArena,按照慣例,匿名測試模型必須靠純粹的實力在盲測中證明自己,但 Kivine 的出現方式卻一點也不低調。上線僅僅幾個小時內,這個隱藏身分的模型就迅速引爆全球 AI 社群,大量測試者湧入平台,試圖一探究竟。與此同時,越來越多的跡象開始指向同一個結論:這個看似不具名的模型,很可能就是月之暗面(Moonshot AI)尚未正式發表的下一代旗艦產品——Kimi K3。目前月之暗面並未對外證實 Kivine 與 Kimi K3 之間的關聯,也沒有釋出任何官方技術文件或規格說明。
然而,從 LMArena 上的模型表現數據,到用戶實際測試後的反饋,再到 beta.link 後台出現的產品資訊,甚至是一度上線又迅速被下架的充值活動頁面,所有線索串聯起來,已經形成一條相當完整的證據鏈。業內人士普遍認為,Kimi K3 很可能已經完成大部分發布準備工作,只差最後的公開亮相。這並非空穴來風。LMArena 是一個以社群盲測聞名的平台,模型在匿名的狀態下與其他競品對決,成績完全取決於真實能力。Kivine 在上線後短時間內便獲得大量關注,說明它在各項測試中的表現明顯優於平均水平,甚至在某些指標上展現出壓倒性優勢。
許多參與測試的開發者與研究者指出,Kivine 在處理超長上下文任務時表現異常出色,其百萬級別的上下文長度幾乎可以與目前業界頂尖的模型抗衡,這正是月之暗面先前在 Kimi 系列中強調的核心技術方向。用戶測試反饋同樣提供了關鍵線索。多位測試者在社群平台上分享,Kivine 在回答複雜問題時的邏輯連貫性、記憶準確度以及指令遵循能力,都與他們對 Kimi K3 的期待高度吻合。更有測試者發現,Kivine 在部分對話場景中會出現與 Kimi 系列模型相似的語氣與回覆模式,只是整體品質更上一層樓。這些細節雖然不足以作為直接證據,卻讓懷疑的聲浪越滾越大。除此之外,beta.
link 後台被發現出現了與 Kivine 相關的產品資訊。這個通常用於內部測試或預發布階段的域名,記錄了模型的版本號、API 端點設定以及部分效能參數,資訊內容與月之暗面過去在 Kimi 系列上的技術路線圖一致。雖然該頁面很快就被設為不可見,但截圖與相關討論已經在開發者社群中流傳開來。更耐人尋味的是,在 Kivine 引發關注的同時,有網友發現月之暗面官網曾短暫出現一個名為「Kimi K3 提前體驗」的充值活動頁面。該頁面詳細列出了不同方案的定價與對應的權益,包括更長的上下文處理額度與優先使用權,但上線不到幾個小時就被撤下,目前僅能透過快取或截圖看到部分內容。
這種「先上後撤」的作風,在科技產品的預熱行銷中並不少見,往往意味著產品已經接近正式發布,只是還在調整最終的發表時間點。回顧月之暗面的發展歷程,Kimi 系列一直以長上下文能力作為主要賣點。從最初的 Kimi 到 Kimi K2,每一次迭代都在處理超長文本的效率與準確度上取得明顯進步。如果傳聞屬實,Kimi K3 將成為國產模型在極長上下文領域的重要節點,不僅可能進一步拉開與同級對手的差距,還有望在學術研究、法律文書分析、醫療病歷整理等需要大量上下文記憶的場景中創造新的應用可能。當然,在官方正式宣布之前,所有推測都仍屬於市場傳聞。
月之暗面可能選擇在近期舉辦的技術大會或媒體溝通會上正式揭曉 Kimi K3,也可能突然以公開測試的方式讓模型直接與用戶見面。無論如何,Kivine 的出現已經為全球 AI 社群注入一劑強心針,也讓外界對國產大模型在長上下文領域的進展有了更直接的期待。目前,LMArena 上的 Kivine 仍在持續接受來自全球用戶的測試挑戰,而關於它是否就是 Kimi K3 的討論,也將隨著更多測試數據的流出而越發熱烈。對於關注 AI 模型發展的人來說,這無疑是今年夏天最值得追蹤的動態之一。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。

內部賽馬暫停,騰訊、阿里、字節AI辦公產品“合兵”對陣
過去半年,騰訊、阿里巴巴、字節跳動等大廠在AI辦公產品領域經歷內部賽馬後,近期紛紛收攏資源,推出整合方案。騰訊將QClaw業務調整至雲產品六部,與WorkBuddy統一管理;阿里整合三款產品推出千問辦公;字節則將飛書團隊併入豆包。市場數據顯示,6月國內AI辦公智能體平臺月訪問量突破6000萬次,顯示此領域競爭日益激烈。