DeepSeek開放內測
DeepSeek 近期開放內測,焦點落在新模型 DeepSeek V4.1 Flash。根據 AI 資訊日報與何夕 2077 的資訊,這款模型已在 DeepSeek 官方交流群中開放短期測試,而非全面公開發布。從目前流出的消息來看,這次內測不只是一個型號更新,還指向新架構與原生多模態兩項技術方向。這次測試採用相對低調的方式進行。消息指出,DeepSeek V4.1 Flash 是在官方交流群內開放,且性質屬於短期測試,因此外界看到的並非正式產品頁或完整上線公告,而是偏向開發者與社群成員先行接觸的階段。這樣的安排讓模型在正式公開前,能先在小範圍內被試用與驗證。
值得注意的是,內測消息提到模型可能採用新架構。若此說法屬實,代表 DeepSeek V4.1 Flash 不只是既有模型版本的微調,而可能涉及底層設計的調整。不過,目前官方尚未提供技術報告,因此新架構的具體內容、設計方式與改動幅度仍無法從公開資料確認。另一個受到關注的方向是原生多模態。消息將 V4.1 Flash 與原生多模態連結在一起,意味著多模態能力可能不是外掛式拼接,而是模型設計的一部分。對模型開發而言,原生多模態通常關係到文字、圖像或其他輸入形式能否在同一架構下處理;但現階段這仍屬於內測消息,尚待官方文件進一步說明。在接入方式上,開發者不用更改 baseurl,只需替換模型名。
這表示既有串接流程與 API 位址不必先調整,開發者若想測試 V4.1 Flash,主要動作是將請求中的模型名稱改掉。對已經在使用 DeepSeek 服務的開發者來說,這樣的切換方式相對直接,也有助於降低嘗試新模型的工程成本。這類設計也讓測試更容易在既有專案中展開。開發者不必重新建立一整套連線設定,只要在原本的架構上替換模型名稱,就能比較新舊模型在同一串接環境下的表現。對於需要快速驗證相容性或收集使用回饋的短期內測而言,不改 baseurl 是一項實際的安排。不過,這次內測也留下明顯的臨時測試痕跡。消息指出,端點名帶有 0910 到期信息,像是臨時測試版本。
端點名稱中出現到期資訊,通常意味著該測試端點可能具有使用期限,而非永久開放的正式服務。這與短期測試的定位相互呼應,也提醒開發者留意測試環境的時效性。目前最關鍵的資訊缺口,是官方尚未公開技術報告。沒有技術報告,外界難以得知 V4.1 Flash 的訓練方法、架構細節、資料組成或能力邊界。雖然內測消息提到新架構與原生多模態,但在正式文件出現前,這些說法仍只能視為測試階段的線索,而不是完整規格。參數規模同樣未公開。對大型語言模型而言,參數規模常被用來推測模型容量與資源需求,但這次 DeepSeek V4.1 Flash 並未揭露相關數字。
由於官方沒有提供參數資訊,外界無法判斷它在 DeepSeek 既有模型序列中的定位,也難以從規模角度比較不同版本之間的差異。Benchmark 成績也仍未公布。模型評測通常會透過公開基準測試呈現能力,但 V4.1 Flash 目前沒有對外釋出 benchmark 結果。在缺乏評測數據的情況下,開發者若想了解模型表現,只能透過實際內測、使用者回饋或社群討論來累積觀察,而沒有一個官方統一的比較基準。因此,現階段可以確認的事實相對有限。DeepSeek V4.
1 Flash 已在官方交流群開放短期測試,內測消息指向新架構與原生多模態,開發者不用改 base_url、只需替換模型名,端點名則帶有 0910 到期信息。至於技術報告、參數規模與 benchmark,則都還沒有公開。在官方進一步說明之前,這次內測更像是 DeepSeek 對特定開發者與社群成員釋出的前置測試。它讓外界得以提前看到 V4.1 Flash 的存在與部分接入方式,但同時保留了許多未解資訊。新架構與原生多模態是否會成為正式版本的關鍵特徵,仍需等待後續公開資料才能確認。
Related
相關文章

美國 AI 巨頭提議開發減速,歐洲同行和政界並不認同
作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)報道,此前,阿莫迪、奧爾特曼和馬斯克先後發出警告,能力不斷增強的 AI 系統可能帶來風險,故有必要控制其發展節奏,但歐洲企業和官員對此表現出明顯懷疑。法國初創企業 Mistral 在聲明中指出,這些風險早在幾個月前就已十分明確了。

MiniMax Code CLI 正式開源,在評測中取得 76.7% 的任務通過率
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 Domado 的線索投遞!9 月 18 日消息,MiniMax 今晚宣佈,MiniMax Code CLI 的 v0.4.12 版本面向全球開發者正式開放,並且以 MIT 協議正式開放源代碼。

北京發佈“詞元經濟十條”:高標準建設詞元工廠,推動關鍵核心技術攻關
作者:浩渺 責編:浩渺 評論: 感謝網友 蛋殼兒 的線索投遞!9 月 18 日消息,北京市經濟和信息化局今日宣佈,北京市“詞元經濟十條”正式發佈。為貫徹落實《國務院關於深入實施“人工智能+”行動的意見》(國發〔2025〕11 號),率先培育智能經濟新形態,以詞元(Token)為抓手,發展詞元經濟新增量,制定《北京市加快詞元經濟發展的行動方案(2026—2028 年)》(注:以下簡稱《行動方案》)。
PrismML Releases Ternary Bonsai 2 27B: A 5.9 GB Apache 2.0 Model Retaining 98.2% of Qwen3.8 27B Performance
PrismML has released Ternary Bonsai 2 27B, a ternary-weight version of Qwen3.8 27B. The language model occupies 5.93 GB, against 53.80 GB in FP16. PrismML reports that it keeps 98.2% of the parent model’s average across 20 benchmarks.

OpenAI剛曝光循環架構,這家公司更早將其用於世界模型
鍵詞只有一個:循環。 Astra採用了一種被稱為“循環深度”(Recurrent Depth)的架構,本質是讓同一組Transformer層被反覆複用,用更少的參數實現更深的計算。 這被外界視為OpenAI對傳統“堆參數、堆算力”路線的一次重大修正——不再只是把模型做大,而是讓模型學會“反覆思考”。 消息一齣,整個AI社區迅速升溫。

千問辦公接入高德門店經營專家套件 提升實體店選址與經營效率
此項新功能自9月18日起正式上線,用戶只需在千問辦公添加相應套件並完成高德賬號授權,即可實現從門店選址到日常經營分析的全鏈路工作。隨著實體商業的不斷發展,傳統的人工選址和經營分析方式顯得效率低下且容易出錯。個體創業者在開新店時,往往需要花費大量時間進行實地勘察,整體耗時可達一週,而商家在監測門店熱度變化及競爭對手動態時,也面臨數據整理繁瑣、分析結果不準確的問題。