B 站上線“AI 無限競技場”:百大模型同臺 PK,GPT-6 Astra 暫居榜首
AI資訊AI新閒資訊正文B 站上線“AI 無限競技場”:百大模型同臺 PK,GPT-6 Astra 暫居榜首發布於AI新閒資訊時間 :Sep 20, 2026閱讀 :1分鐘9B 站宣佈上線“AI 無限競技場”大模型測評榜,並同步公佈了首輪模型排行榜。其中 GPT-6 Astra 在 10 個 UP 主測評中拿下榜首,打敗 GLM-5.3 獲得“榜首次數冠軍”;前五名中,國產大模型佔據三席。據 B 站介紹,“AI 無限競技場”是一個彙集 UP 主 AI 大模型測評的競技廣場,由各領域 UP 主對上百個大模型的真實場景實測構成,涵蓋代碼、推理、協作、知識等多種測評主題。
不設命題限制,用真實工作流說話與傳統跑分評測不同,B 站“AI 無限競技場”不設主題或測評維度限制——來自各個分區的 UP 主以真實工作流、專業應用、趣味腦洞等自主命題,在同題 PK 中直觀呈現各模型的實際表現差異。榜單涵蓋 DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千問、Hy、MiniMax 等主流模型的對比測評,排名實時更新,並持續面向全站 UP 主開放報名。公開信息顯示,過去一年 B 站 AI 知識內容消費時長同比增長 72%,月均觀看 AI 內容的用戶超過 1.9 億。
平臺湧現出大量覆蓋不同領域、維度與主題的測評內容,形成了從發佈到討論、測評、使用、求助再到共建的內容生態。相關推薦B站上線"AI 無限競技場"測評榜:上百模型同場廝殺,GPT-6 暫坐頭把交椅B站推出“AI無限競技場”測評榜,彙總10位UP主對上百個大模型的真實場景實測,覆蓋代碼、推理、協作、知識等。首輪榜單中GPT-6Astra居首並獲“登頂次數冠軍”,GLM-5.3次之;前五國產佔三席,與海外模型貼身競爭。該榜單不同於傳統跑分,更強調真實應用表現。Sep 20, 2026104.
8k Anthropic考慮推出新模型,擬應對OpenAI GPT-6Astra競爭路透社稱,Anthropic籌備IPO期間擬推新AI模型,以應對OpenAI GPT-6Astra在企業市場的競爭,但安全性仍在評估,發佈時間未定。此舉與其CEO阿莫代9月12日呼籲放緩AI能力迭代、重視安全的主張形成對照。Sep 20, 2026146.0kOpenAI 宣佈 GPT-5.5 將於 10 月 14 日下線:ChatGPT 與 Codex 同步移除OpenAI宣佈GPT-5.5將於10月14日從ChatGPT、ChatGPT Work及Codex下線,覆蓋所有訂閱方案。
官方提醒Codex用戶儘快切換至GPT-5.6 Sol或GPT-6 Astra。此次停用涉及全部計劃,替代模型為上述兩個。該模型於今年4月24日推出,較GPT-5.4在同等任務上有所優化。Sep 16, 2026178.9kGPT-6 Astra 模擬經營售貨機一年狂賺 1.5 萬美元,成績碾壓 Claude 近 3 倍Andon Labs的Vending-Bench2測試中,AI以500美元模擬經營售貨機一年。GPT-6 Astra平均賬戶餘額達15515美元首次登頂,最差一輪也超過Claude Fable5.1最佳表現。
差距不僅在於盈利,更在策略:Astra持續壓低採購價,一度砍至原價約48%。Sep 15, 2026256.6kGPT-6 Astra展現恐怖統治力:模擬售貨機一年狂攬1.5萬美元,成績碾壓Claude近3倍Andon Labs的Vending-Bench2測試中,AI代理用500美元模擬經營自動售貨機一年。GPT-6Astra平均餘額達15515美元,最差一輪也超Claude Fable5.1最好成績,首次登頂,優勢體現在供應鏈管理和規則執行力。Sep 14, 2026217.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

Anthropic 把 IPO 推到 11 月:2 萬億美元估值劍指 SpaceX 紀錄,安全警告成上市前的"護身符"
據《華爾街日報》9月19日報道,這家 Claude 開發商計劃將首次公開募股推遲到11月,比許多投資者此前押注的10月晚了一步。知情人士透露,部分顧問認為多等一個月,能讓公司把第三季度的財務數據擺上桌,用真金白銀證明自己的競爭地位——這紙報表,正是當下最硬的說服工具。

消息稱 Anthropic 擬在 IPO 前推出新模型,應對 GPT-6 Astra 衝擊
此事發生在公司籌備 IPO 前夕——就在此前,其首席執行官還呼籲整個 AI 行業放緩技術迭代的腳步。消息人士稱,推新模型意在直面來自直接競爭對手的壓力。此前,Anthropic CEO 達里奧·阿莫代伊已向全球 AI 業界發聲,呼籲行業放慢新能力發佈節奏、妥善處理安全風險。

階躍甩出 Step 5 Preview:600B 稀疏 MoE 只激活 27B,把開源旗艦的"性價比邊界"往外推了一格
64個注意力頭、8192token)。Step5Preview 自主改代碼、跑內核、測吞吐,遇到跑得通卻降速的方案就放棄、從最佳版本接著爬,約22小時後把峰值性能頂到508TFLOPS,壓過了 Claude Opus5的493TFLOPS。

谷歌高管稱亞洲 AI 普及速度被低估,兩年走完雲計算十多年曆程
作者:潞源 責編:潞源 評論: 9 月 20 日消息,據日經亞洲今日報道,谷歌亞太及日本地區 AI 業務總經理哈沙 · 孔杜裡(Harsha Konduri)表示,亞洲的 AI 普及速度遠超外界預估。AI 大約在兩年時間內迅速普及,而云計算進入企業日常運營用了十多年。

GPT-6 Astra 聯手人類攻破重大進展級數學難題:AI 不再只是解題機,成了規律發現者
題目問的是批准式委員會選舉裡"核是否為空",本意是尋找"核為空"的反例,GPT-6Astra 卻反過來證明:這樣的反例根本不存在,也就是說絕對公平的委員會在任何情況下都必定存在。更漂亮的是,模型還順手發明了一套基於"調和熵"的全新投票規則,給出多項式時間的算法,證明局部最優解就已經滿足"核"的要求。

國產大模型企業半月「連籤三單」,中國 AI 出海正在加速
本文作者: 胡清文 2026-09-20 14:50 導語:MiniMax 提供了一個好的觀察樣本。今年 9 月,國產 AI 出海賽道迎來一波密集落地潮。短短半個月,沙特、硅谷、新加坡三地接連官宣了與 MiniMax 的合作項目。