GPT-5.6免費了?Luna免費文字聊天,還加入思考模式
重點摘要
OpenAI宣布ChatGPT免費用戶和Go用戶的默認模型將調整為GPT-5.6 Luna,並從下週起可無限量進行文字聊天,但文件上傳等功能仍有限額。同時,Plus和Pro用戶的GPT-5.6 Sol模型獲得更新,回答更聚焦且事實錯誤率下降68%,並新增推理強度滑塊。此次更新降低了使用門檻,但開發者關注的GPT-5.6 Sol API價格尚未下調。
OpenAI 於今日凌晨宣布重大更新,自下週起,ChatGPT 的免費用戶與 Go 用戶將可無限量使用 GPT-5.6 Luna 模型進行純文字聊天,且該模型將成為預設選項。這項變革大幅降低了使用先進 AI 對話模型的門檻,讓更多用戶能體驗到最新技術。不過,文件上傳、圖片生成以及其他進階工具功能,仍會維持原有的使用次數限制,並非全面開放。除了開放無限制文字聊天,OpenAI 也為免費用戶新增了「Think」按鈕。當用戶遇到需要更深入分析或複雜推理的問題時,可以點擊此按鈕,讓 GPT-5.6 Luna 投入更多時間進行思考與運算,再生成更為詳盡且精準的回答。
這項功能類似於付費版本的深度推理模式,但以更簡潔的方式提供給免費用戶,讓一般使用者也能在必要時獲得更高品質的答案。針對 ChatGPT Plus 與 Pro 的付費用戶,OpenAI 則更新了聊天場景中的 GPT-5.6 Sol 模型。此次更新的重點在於提升回答的聚焦度與事實可靠性。新版 GPT-5.6 Sol 會更直接地回應用戶的核心問題,並根據問題的複雜程度調整回答的詳略,同時減少不必要的格式與冗餘資訊,使對話更加流暢且有效率。為了具體展示改進成果,OpenAI 以一個騎車場景為例進行比較。
當用戶詢問下班後從舊金山 Mission 區騎車到 Ocean Beach 是否會淋溼時,舊版 GPT-5.5 Instant 會分別說明降雨、風向、氣溫與海霧等情況。而新版 GPT-5.6 Sol 則會先給出「當天基本不會下雨」的明確結論,並進一步提醒用戶注意向西騎行時可能遇到的逆風,最後建議攜帶輕薄防風外套而非雨衣,同時列出分時段的天氣狀況。這種回答方式更貼近用戶的真實需求。在事實準確性方面,OpenAI 的內部評估顯示,新版模型有顯著進步。針對金融、醫療與法律等專業領域問題的測試中,GPT-5.6 Luna 產生「至少包含一處事實錯誤」回答的比例,相較於 GPT-5.
5 Instant 下降了約 62%;而 GPT-5.6 Sol 的錯誤率更是下降了約 68%。這項數據表明,新版模型在提供可靠資訊方面有了長足進步。此次更新也進一步整合了即時回答與深度推理模式。對於 Plus 與 Pro 用戶而言,無論選擇快速回答還是更深入的思考模式,背後均由 GPT-5.6 Sol 提供支援,確保模型的語氣與互動方式保持一致,不會因為切換模式而產生體驗斷層。此外,OpenAI 也在 ChatGPT 的網頁版、行動版與桌面版新增了推理強度滑塊,讓用戶可以根據任務需求,自由調整模型思考的深度與時間。值得注意的是,本次針對 GPT-5.
6 Sol 的更新僅限於 ChatGPT 的日常聊天場景,並未涵蓋用於 Work 和 Codex 的版本。OpenAI 明確指出,由於該版本模型是針對聊天進行專門優化,因此不會影響其他應用場景的模型表現。對於需要更強大運算能力的開發者與重度用戶來說,這項更新並未解決他們對高階模型使用成本的疑慮。回顧上週,OpenAI 已大幅調降 GPT-5.6 系列部分模型的 API 價格,其中 GPT-5.6 Luna 降價 80%,GPT-5.6 Terra 降價 20%。然而,性能最強的 GPT-5.6 Sol 雖然新增了 Fast 模式,推理速度提升至 2.5 倍,但其 API 價格並未同步下調。
此次擴大免費文字聊天範圍,雖然讓一般用戶受惠,但對於開發者與重度使用者而言,更強模型的使用成本仍是他們最關心的問題。在 Luna 與 Terra 相繼降價後,市場普遍關注 OpenAI 何時會對 GPT-5.6 Sol 的價格做出調整。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。