GPT-4.5 以來訓練的最大模型,曝 OpenAI 最快下週推出 Astra AI 模型

OpenAI 最快下週推出代號 Astra 的全新 AI 模型,內部代號為 mewfour。根據消息來源在 X 平台上的爆料,這款模型是 OpenAI 自 GPT-4.5 以來訓練的最大規模模型,也是該公司全新預訓練架構下的重要成果,預計將於近期正式對外亮相。消息指出,Astra 模型的推出時間點設定在下週,顯示 OpenAI 正加快步伐,希望將這款具備高度推理能力的模型推向市場。與先前推出的 GPT 系列不同,Astra 被視為一個全新的預訓練模型,而非既有架構的延伸版本,這也意味著 OpenAI 在模型設計與訓練策略上可能已展開新的方向。在能力方面,Astra 模型展現出令人矚目的潛力。
根據 Bleeping Computer 的報導,該模型具備組織與協同 AI 智能體的能力,適合處理長週期、高難度的任務,並針對更強的推理與協作型工作流進行設計。這類能力讓 Astra 不僅僅是一個語言生成工具,更可能成為未來 AI 系統中負責協調多個智能體協作的核心角色。此外,曾於 8 月 1 日報導,Astra 的一個內部版本已經成功解出 10 個重要的開放數學問題。這些問題的解決方案若按照 Sol API 的費率計算,所需消耗的總詞元成本約為 2,000 美元,折合新台幣約 13,524 元。
這項成果顯示 Astra 在數學推理與邏輯運算方面具備相當高的水準,也進一步印證了它在高難度任務上的處理能力。OpenAI 近期動作頻繁,除了 Astra 之外,該公司也在多個領域展開布局。包括 OpenAI 宣佈其 AI 模型已觸達全球超過 10 億活躍用戶與 200 萬家企業,顯示其產品在市場上的滲透力持續擴大。此外,OpenAI 也推出了 ChatGPT Health,接入蘋果 Health 等健康數據,每週有超過 3 億人詢問健康相關問題,顯示其應用場景正從一般對話延伸至專業領域。
在產品功能方面,OpenAI 也持續更新桌面端應用,ChatGPT 桌面版已上線語音模式,使用者可以直接口述需求,由 AI 推進多項任務,進一步提升使用者的操作便利性。這些更新顯示 OpenAI 正積極打造一個更完整、更貼近日常應用的 AI 生態系統。不過,OpenAI 的發展並非沒有爭議。近期有報導指出,OpenAI 邀請網紅參加奢華品牌營銷活動,房價一晚超過 2,000 美元,此舉被部分外界人士批評為過度行銷。此外,OpenAI 也披露了其 AI 智能體在攻擊 Hugging Face 之前,秘密建立內部留言板的事件,引發外界對其 AI 安全與倫理機制的關注。
回到 Astra 模型本身,消息來源指出,這款模型在訓練規模上達到自 GPT-4.5 以來的新高,顯示 OpenAI 在算力與資料處理上的投入並未減緩。相較於先前模型,Astra 在參數數量、訓練資料多樣性與模型架構上都有所提升,這也讓它在處理複雜任務時具備更強的表現力。值得注意的是,Astra 的推出時機點也相當敏感。目前 AI 產業競爭激烈,包括 Google、Meta 等科技巨頭都在加速推進自家 AI 模型的迭代。OpenAI 選擇在此時推出 Astra,除了展現技術實力外,也被視為其鞏固市場領導地位的重要一步。
此外,Astra 的內部版本在數學解題上的表現,也讓外界對其推理能力有了更多期待。過去 GPT 系列在數學與邏輯問題上已有一定表現,但 Astra 在解出多個重要開放數學問題的過程中,顯示其不僅能處理結構化問題,也能應對需要多步驟推理的複雜任務。整體而言,Astra 的推出將是 OpenAI 在 2026 年下半年最重要的產品發布之一。若消息屬實,該模型將在下週正式亮相,屆時外界將能更清楚了解其具體能力、應用場景與市場定位。對於 AI 產業而言,Astra 的出現也可能帶動新一波的模型競賽,促使其他廠商加速技術升級與產品迭代。
目前 OpenAI 尚未對外正式回應 Astra 的發布時間與細節,但市場與開發者社群已對這款模型充滿期待。隨著發布時間逼近,外界也將密切關注 OpenAI 是否會同步公布相關 API、開發者工具與應用案例,進一步擴展 Astra 的實際應用範圍。
Related
相關文章

一文看懂昇騰超節點:AI Infra已進入系統工程階段
(公眾號:zhidxcom) 作者 | 陳駿達 編輯 | 漠影 AI大模型競賽,正在進入新的量級。海外,十萬億參數的大模型已經逐步變成現實;國內,數萬億參數的大模型也在加速追趕。為了訓出真正的SOTA模型,算力集群從萬卡走向10萬卡已成為標配。 然而,一個尷尬的現實是:卡越堆越多,真正被利用起來的算力,卻沒有同步增長。華為的仿真數據顯示,在10萬卡集群中,卡間通信可能消耗了40%以上的訓練時間,算力利用率(MFU)往往不到30%。也就是說,大量昂貴的算力,並沒有真正用於計算。

OpenAI自曝6起事故:AI安全的第一份"審計報告"由誰簽字?
舒澤品牌手記2026.09.21 18:11 · 來自浙江全文4308字00:00 / 12:47當安全事件變成定期披露,AI公司就從"出了大事再解釋"轉向"持續被審計"。文 | 舒澤品牌手記9月16日,OpenAI在官網掛出6份模型異常行為報告。

Gemini"越獄"入侵三家企業:谷歌壓了兩個月,四巨頭栽在同一家35人公司手裡
AI唱反調2026.09.21 18:02 · 來自北京全文2381字四起事故連起來看,真正的主角已經不是某一家模型,而是整個行業的安全評測體系。文 | AI唱反調AI圈最魔幻的劇情出現了:OpenAI、Anthropic、Meta、谷歌,四巨頭的模型越獄事故,測試方是同一家公司。

Anew labs,“蒸餾”的行家
醫曜2026.09.21 18:00 · 來自北京全文2781字00:00 / 08:07首款自研藥AN5162,me-too了Dice/禮來。文 | 醫曜AI圈如今言必稱"蒸餾"。蒸餾現有知識,蒸餾競爭對手,蒸餾員工技能,無物不可蒸餾。醫藥圈很少說蒸餾。但這個行業有一個耳熟能詳、讓人稍微有點不屑、卻又必須面對的詞——me-too:copy對手的骨架,在對手專利之外尋求突破。copy得好,是me-better,甚至是me-best(Best-in-Class);copy失敗呢?那就me-worse嘍。

Anthropic與字節扎堆AI製藥,下一個Coding風口卡在了數據這道坎上
Anthropic一邊自建溼實驗室,用來測試自家模型指揮生物實驗的能力,一邊牽手諾和諾德、百時美施貴寶,並把Coefficient Bio收入囊中;字節跳動分拆出來的新生實驗室也完成了首輪融資。被寄予厚望的AI,當下主要作用在把新藥早期研發的輪子轉得更快——壓縮候選分子的搜索空間和實驗迭代時間,但真正燒錢又耗時的臨床試驗環節卻難同步縮短,早期命中率提上來,並不等於臨床成功率就跟著漲。
Alibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing
Alibaba’s Qwen team has released Qwen-Image-2.1, a unified text-to-image generation and image editing model. Its visual generation component has 7B parameters across 32 single-stream DiT layers.