Fireworks AI 推出 FireRouter with Opus:編碼任務成本降 57%,準確率僅損失 1.5 個百分點

2026年9月29日 11:07
Fireworks AI 推出 FireRouter with Opus:編碼任務成本降 57%,準確率僅損失 1.5 個百分點
站內 AI 整理稿

AI資訊AI新聞資訊正文Fireworks AI 推出 FireRouter with Opus:編碼任務成本降 57%,準確率僅損失 1.5 個百分點發佈於AI新聞資訊發佈時間 :2026年9月29號 10:53閱讀 :1分鐘Fireworks AI 近日發佈 FireRouter with Opus,這是市場上首個緩存感知路由器,針對 Claude Opus 系列進行了優化,並首次以獨立路由模型形式作為 serverless 端點開放。經過一個多月的內部 A/B 測試,該方案執行編碼任務的準確率達到單獨使用 Opus 的98.1%,而成本降低了57%。

FireRouter 的核心邏輯是在每次用戶輪次中,評估模型集合中每個模型對當前任務的適合程度,估算每個模型的處理成本(包括提示緩存成本),並權衡切換模型帶來的節省與丟失緩存是否值得,最終路由到質量與成本之間取得最佳平衡的模型。目前路由池包含 Claude Opus5.5、GLM5.3和 GLM5.3Flash,隨著新模型發佈將持續調整。測試數據來自內部編碼流量,會話被隨機分配到 FireRouter with Opus 組或僅使用 Opus 的對照組,工作負載和用戶均相同。結果顯示,每次會話成本從15.36美元降至6.63美元,降幅57%(±19個百分點,95% 置信區間)。

準確率方面,FireRouter with Opus 在評分輪次中得分78.7%,而僅使用 Opus 為80.2%,差距僅1.5個百分點(±1.3),即達到 Opus 整體準確率的98.1%。緩存命中率方面,FireRouter with Opus 為94.2%,單獨使用 Opus 為97.8%,差距3.6個百分點。Fireworks AI 解釋稱,這是一個微小而有意的取捨——由於內部編碼工作中開源模型可以處理許多常規輪次,緩存感知路由通過將簡單任務分流至更便宜的模型,大幅降低了整體成本。

FireRouter with Opus 現已集成至 Claude Code、Codex、Cursor IDE 等多個工具鏈。用戶可通過 fireconnect login 和 fireconnect claude --model firerouter/opus 兩行命令啟用。Fireworks AI 表示,其 Fireworks Nexus 解決方案旨在讓工程團隊將領先的開源模型接入現有工具鏈,在不犧牲速度或質量的前提下將支出減半。相關推薦Claude Opus 5.5 已在內測:連跳兩級直逼 GPT-6,價格還打骨折爆料稱Claude Opus 5.

5(代號claude-wafer-eap)已開啟內測,或於本週二突然發佈,版本跳過5.2。其定價為每百萬Token輸入4美元、輸出20美元,低於現役Opus 5的5/25美元,被視為直接對標GPT-6。2026年9月21號 15:11339.1k馬斯克放話每月推全新大模型 Grok4.5內測性能比肩Claude Opus馬斯克宣佈Grok4.5模型在SpaceX與特斯拉內部啟動Beta測試,基於1.5萬億參數V9模型,訓練中融入Cursor編程數據,性能已接近或超越Claude Opus,強化學習仍在優化中。2026年6月29號 13:49280.9k馬斯克披露 Grok 4.

5 進展:SpaceX 與特斯拉率先開啟內部“練兵”近日馬斯克在社交平臺宣佈,新一代大語言模型Grok 4.5已在SpaceX和特斯拉啟動內部私測,從實驗室邁向複雜工業場景。該模型以1.5萬億參數V9架構為基座,引入AI編程工具Cursor進行補充訓練,以增強邏輯推理能力,推動AI在航天與汽車領域實際部署。2026年6月29號 8:58180.8kAnthropic 重磅發佈“顧問工具”!Sonnet/Haiku 幹活,Opus 只當幕後軍師Anthropic推出Claude顧問工具,創新混合智能模式:小模型全程執行任務,遇到複雜決策時自動向大模型尋求策略建議。

顛覆傳統Agent構建思路,實現性價比最優解。2026年4月10號 10:28372.9k​Cursor 實測:在長程自動化編程任務中,GPT-5.2 表現優於 Claude Opus 4.5Cursor團隊測試發現,GPT-5.2在構建複雜Web瀏覽器等長週期編程任務中,比Claude Opus4.5更可靠。測試涉及HTML解析、CSS佈局和JavaScript虛擬機等底層開發,GPT-5.2在需要數百萬行代碼的“長跑式”項目中表現更優。2026年1月15號 15:18219.3k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

可靈AI發佈Kling4.0:支持8000Token與立體聲唇形同步

目前,Kling4.0Flash版本已面向黑金年卡會員開放小範圍率先體驗。本次升級在畫面真實感、創意可控性及敘事完整度三大核心維度實現了大幅躍升,為創作者帶來更專業的“全能班底”。視聽表現全面突破,直逼電影級質感Kling4.0顯著提升了應對高速運動、連續動作、跟拍及環繞等大幅度鏡頭運動時的穩定性與連貫性。

剛剛