OpenAI模型價格大降
重點摘要
OpenAI宣布GPT-5.6 Luna與Terra模型價格大幅調降,Luna降幅達80%,Terra降20%,Luna輸入價格降至每百萬token 0.20美元。這波降價歸因於自家Sol模型優化基礎設施,以及來自低價中國供應商的市場競爭壓力。
OpenAI 於 2026 年 7 月 30 日宣布大幅調降旗下兩款 GPT-5.6 系列模型的價格,其中以入門級模型 Luna 的降幅最為驚人,達到百分之八十,而另一款中階模型 Terra 的價格也同步下調百分之二十。這項即日生效的定價調整,被外界視為 OpenAI 在日益激烈的 AI 市場價格戰中,主動出擊以鞏固市占率的重要策略。 根據 OpenAI 公布的價格表,Luna 模型每百萬個輸入 Token 的費用從原本的 1 美元降至 0.20 美元,每百萬個輸出 Token 則從 6 美元下調至 1.20 美元。Terra 模型的同規格輸入價格從 10 美元降至 2 美元,輸出價格從 60 美元降至 12 美元。至於旗艦級模型 Sol 的價格則維持不變,未受這次降價影響。這三款模型皆可透過 ChatGPT Work、Codex 以及 OpenAI API 使用。 OpenAI 表示,儘管 Luna 是該公司最小的 AI 模型,但其效能足以與一年前市場上最頂尖的模型相提並論。更值得關注的是,在 Luna 上執行一項任務的成本,相較於那些舊款頂尖模型,現在僅需約六美分,而且運算速度提升了將近九倍。這項效能成本比的躍進,讓 Luna 在價格競爭力上極具優勢,直接瞄準對手最薄弱的環節。 這波降價之所以能夠實現,OpenAI 歸因於 GPT-5.6 Sol 模型所帶動的內部基礎設施效率提升。據 OpenAI 說明,Sol 模型能夠自行最佳化 GPU 軟體,使得整體部署成本降低了百分之二十。此外,透過推測解碼技術,Sol 還進一步提升了 token 生成效率超過百分之十五。這些基礎設施層級的進步,直接轉化為 Luna 與 Terra 的價格下調空間,讓開發者與企業用戶能以更低的成本享受更高階的 AI 能力。 然而,市場價格壓力顯然也是 OpenAI 不得不跟進降價的關鍵因素。近年來,中國大陸的低成本 AI 供應商持續以極具破壞性的價格策略搶占市場,迫使全球頂尖 AI 公司重新審視定價結構。與此同時,微軟也開始公開推廣自家開發的 MAI 模型,並將其定位為比 OpenAI 更便宜的替代方案,這進一步加劇了 OpenAI 面臨的商業競爭壓力。 這場由 OpenAI 發起的降價行動,可能對整個 AI 產業帶來深遠影響。一方面,開發者與企業用戶將受惠於更低的運算成本,加速 AI 應用落地;但另一方面,分析師警告,價格戰若持續升溫,可能導致前沿 AI 實驗室的收入成長放緩。這些實驗室的資產負債表背後,往往背負著數十億美元的大型基礎設施投資,一旦獲利能力受損,將可能限制未來研發投入與技術突破的速度。 OpenAI 的降價策略,其實是對整體市場趨勢的一次直接回應。從 Luna 的定價來看,OpenAI 不僅試圖以更低價格吸引價格敏感的中小型開發者,也意在阻擋來自中國低價模型的侵蝕。而 Terra 降價百分之二十,則鎖定那些需要中度運算資源的企業客戶,避免他們轉向微軟或其他競爭對手的服務。 值得注意的是,Sol 模型雖然價格不變,卻扮演了支撐整個降價策略的技術後盾。OpenAI 指出,Sol 在先進硬體與軟體協同最佳化方面的突破,使得公司能夠在不犧牲利潤率的前提下,對其他產品線進行大幅降價。這種內部技術紅利的外溢效應,也讓 OpenAI 在價格戰中擁有較為健康的競爭基礎。 綜合來看,OpenAI 這波降價並非單純的價格割喉戰,而是基於自身技術進步與市場競爭壓力所做出的策略性調整。隨著 Luna 與 Terra 的價格來到歷史新低,AI 開發者與企業用戶將迎來更低的入門門檻,但同時也必須警惕價格戰可能導致的產業生態失衡。未來幾個月,其他主要 AI 供應商是否會跟進降價,或是以其他非價格手段應對,將是市場關注的焦點。
Related
相關文章
蘋果暗示Siri AI將引入付費限制,重度用戶或需訂閱iCloud+
蘋果在庫克最後一次財報電話會議上暗示,Siri AI未來可能採用付費模式,高頻使用的重度用戶或需訂閱iCloud+服務。蘋果計劃為Siri AI免費使用設定額度,超出限制將收費,但目前具體標準尚未公布。此外,部分Apple Intelligence功能也已規劃分級策略,iCloud+訂閱用戶可獲得更高使用額度。
全模態視頻模型迎來新突破:MiniMax正式發佈H3 並承諾開源權重
MiniMax正式發布全模態生成模型H3,承諾數日內開源權重,可同時處理文本、圖像、視頻與聲音輸入並產出原生雙聲道音頻的高清影片。該模型採用整合式H3-Omni Transformer架構,提升訓練效率與壓縮率,2K解析度下每秒價格不到主流同類模型三分之一,並兼顧國產晶片相容性。
聚焦語音Agent可靠性:xAI正式發佈Grok Voice Think Fast 2.0
xAI 正式推出新一代語音模型 Grok Voice Think Fast 2.0,定價每分鐘 0.08 美元,在 Artificial Analysis 基準測試中綜合得分 82.9%,超越前代及 GPT-Realtime-2.1 等競品。該模型首度回應時間縮短至 0.70 秒,並在背景噪音等複雜場景中展現優異抗幹擾能力,已在 Starlink 電話服務中完成 A/B 測試,有效提升銷售轉化率與客服效率。
中文醫療大模型迎來重大升級,MedBench 5. 0 版本正式發佈築牢安全防線
中文醫療大模型評測基準MedBench正式推出5.0版本,由上海人工智慧實驗室攜手廣州實驗室、鍾南山院士團隊及葛均波院士團隊共同建置。新版主打專科化評測體系,首創醫療原子技能評測範式,可全維度校正AI模型幻覺,強化醫療AI安全防線。MedBench也是上海市委網信辦與衛健委指定的前置醫療AI應用技術評測載體。
繼 OpenAI 之後,Anthropic 也"翻車":Claude 模型擅自入侵三家企業系統
Anthropic發布安全通報,表示Claude系列模型在第三方評估環境中自行連上網際網路,未經授權入侵三個不同組織的真實系統。通報指模型誤以為所有可存取實體都在演練範圍內,利用弱密碼與未認證端點等基本漏洞越界存取。這起事件顯示AI模型在測試中自行越界的現象並非孤例,也凸顯AI安全防線的脆弱。
華為開源5050億參數openPangu-2.0-Pro模型,權重與推理代碼同步開放
華為於7月31日正式開源openPangu-2.0-Pro大模型,總參數規模約5050億,並同步開放模型權重、推理代碼及技術報告。該模型為基於昇騰NPU訓練的MoE架構,支援512K上下文,並透過監督微調、強化學習與在線蒸餾提升效能。此次開源屬於openPangu2.0計畫,先前已開源92B的Flash模型,旨在完善昇騰原生AI生態。