AI打工大排行:Claude Fable 5自動賺錢的能力,是GPT-5.5的2.5倍

2026年7月13日 17:49
AI打工大排行:Claude Fable 5自動賺錢的能力,是GPT-5.5的2.5倍

重點摘要

Claude Fable 5在遠端勞動力指數(RLI)評比中以16.1%自動化率奪冠,是GPT-5.5的2.5倍,但AI評審機制仍不可靠。儘管進步速度驚人,八個月內自動化率翻四倍,仍有84%的真實自由職業項目無法靠AI完成。

站內 AI 整理稿

最新公布的遠端勞動力指數(RLI)評比中,AI自動化賺錢能力出現全新排名,引發業界高度關注。根據這份報告,Claude Fable 5以16.1%的自動化率奪冠,這項數據是GPT-5.5的2.5倍,顯示特定AI模型在替代自由職業項目上的效率已顯著領先其他競爭對手。這項評比主要針對AI能否獨立完成自由工作者常見的任務,例如資料整理、文案撰寫、程式碼生成等,並以自動化率作為衡量標準。Claude Fable 5的表現之所以突出,在於它在多項測試中展現出更精準的任務理解與執行能力。相較於GPT-5.5僅有約6.

4%的自動化率,Claude Fable 5幾乎能勝任六分之一以上的自由職業項目,這對於許多依賴外包人力的企業來說,無疑是一項重大突破。不過,該評比同時指出,AI評審機制的可靠性仍有待驗證,並非所有自動化判斷都能準確反映真實工作場景,部分測試結果可能因為任務設計的偏差而高估或低估了AI的實際表現。從進步幅度來看,這項技術的演進速度相當驚人。相較八個月前,Claude Fable 5的自動化率已翻了四倍,反映出AI在處理特定任務上的能力正在快速提升。研究團隊指出,這種指數級的成長並非偶然,而是來自於模型架構的優化、訓練資料的擴充以及強化學習技術的進步。

尤其是Claude系列在邏輯推理與長文本理解上的優勢,讓它在需要多步驟處理的任務中表現得比對手更加穩定。然而,即便有這樣的成長,目前仍有高達84%的真實自由職業項目無法完全靠AI完成。這意味著AI雖能逐步取代部分重複性工作,但在複雜、創意或需要人類判斷的任務上,仍存在明顯的執行瓶頸。例如,涉及情感溝通、策略規劃、品牌定位或跨領域整合的工作,AI往往只能提供初步建議,無法獨立產出符合客戶期待的成果。這也是為什麼許多企業雖然導入AI工具,卻仍需要人類工作者進行最終審核與調整。值得注意的是,這份RLI評比並非只關注單一模型,而是涵蓋了市面上多款主流AI系統。

除了Claude Fable 5與GPT-5.5之外,包括Google的Gemini系列、Meta的Llama系列以及開源模型如Mistral等,也都納入了測試範圍。結果顯示,Claude Fable 5在自動化率上遙遙領先,但在其他指標如回答一致性、錯誤率與創意表現上,各模型則互有勝負。這也說明,目前並不存在一款「全能型」AI,企業在選擇工具時仍需根據具體需求來評估。對於自由工作者而言,這份報告帶來了既振奮又警醒的訊息。

一方面,AI確實能協助處理繁瑣的行政作業、資料整理或基礎編碼,讓工作者能將時間投入更高價值的任務;另一方面,隨著AI自動化率持續攀升,部分低技術門檻的職位確實面臨被取代的風險。例如,簡單的資料輸入、翻譯校對或模板化文案生成,已經有愈來愈多企業轉向AI解決方案。不過,專家也強調,AI的自動化能力並不等於完全取代人類。在RLI評比中,即便是表現最好的Claude Fable 5,也僅能勝任約六分之一的自由職業項目,而且這些項目多半屬於結構化、規則明確的任務。對於需要創意發想、人際互動或深度專業知識的工作,AI的表現仍然有限。例如,品牌顧問、UX設計師、高階策略分析師等職位,短期內仍難以被AI取代。

此外,評比報告中也提到一個關鍵問題:AI評審機制的可靠性。由於測試過程中使用了自動化工具來判斷AI的輸出是否合格,但這些工具本身也可能存在偏誤。例如,某些任務的標準答案可能過於僵化,導致AI雖然給出合理但非標準的答案,卻被判定為失敗。這也意味著,實際應用中的AI表現可能比測試數據更好或更差,企業在導入時仍需進行實測與調整。從產業角度來看,這份RLI評比也反映出AI技術的競爭格局正在快速變化。過去一年,OpenAI的GPT系列長期佔據領先地位,但Claude Fable 5的崛起顯示,後起之秀完全有機會在特定領域實現超車。這也促使各大科技公司加速研發,試圖在下一波AI浪潮中搶佔先機。

業界預測,未來半年內,自動化率排行榜可能還會出現大幅變動。總結來說,AI在自由職業市場的自動化能力雖然進步神速,但距離全面取代人類仍有相當距離。Claude Fable 5以16.1%的自動化率奪冠,確實是一項里程碑,但84%的項目仍需人類參與,也提醒我們不應過度神化AI。對於企業與工作者而言,最務實的策略或許是將AI視為協作工具,而非替代方案,並持續提升自身在創意、判斷與溝通上的不可取代性。

Related

相關文章

一年砸下110億美元,比紅杉還兇,白宮才是AI圈最猛投資人

美國白宮過去一年在AI領域投入110億美元,規模超越紅杉資本等傳統創投,顯示政府正以國家級資源全面押注AI產業。這筆資金分散於多個聯邦機構,涵蓋基礎模型訓練、醫療及氣候應用等關鍵環節,並強調負責任AI開發。此舉反映美國對維持全球AI領導地位的危機感,但也引發市場機制扭曲與技術商業化延緩的疑慮。

剛剛

一口氣發佈三款教育插件,OpenAI教育產品再升級

OpenAI 推出三款教育插件,分別為課程助手、作業輔導員與互動學習夥伴,旨在協助教師備課與學生自主學習。這些工具整合至教育版平台,強調引導式學習而非直接給答案,並內建防護機制避免學生過度依賴。OpenAI 計畫未來加強多語言支援與特殊教育需求,持續深化教育科技布局。

剛剛

騰訊、字節、阿里,搶著給打工人配「AI助理」

騰訊、字節跳動與阿里巴巴三大中國科技巨頭,近期紛紛推出或升級企業級AI助理,目標是提升白領工作效率。各家AI助理的競爭重點從回答問題轉向執行任務,並分別強調跨應用串聯、主動式智慧與企業級安全等不同特色。儘管面臨資料隱私與AI幻覺等挑戰,但市場調查顯示超過六成中國企業計劃在一年內導入AI辦公工具。

剛剛

推行AI提效後,策劃們開始加班趕工期

當AI開始重寫小遊戲生產流程,真正的變化何時發生?這個問題在近期引發了業界廣泛討論。隨著人工智慧技術逐步滲透進創意與策劃領域,許多公司開始導入AI工具來提升工作效率,然而實際情況卻與預期有所出入。部分策劃人員反映,在推行AI提效後,他們不僅沒有減少工作量,反而因為系統調整與流程磨合,導致加班趕工期的現象頻繁出現。 這場變革的起點,源自於企業對AI生產力的高度期待。許多遊戲開發與內容製作公司,尤其是中小型團隊,紛紛導入AI輔助工具,試圖透過自動化生成文案、腳本、美術素材甚至程式碼,來縮短專案週期。

21 分鐘前

DeepSeek大漲價,Token價格戰終於要結束了?

DeepSeek大幅調漲API服務價格,引發市場對AI模型價格戰是否結束的討論。業界分析指出,漲價反映營運成本壓力與市場定位調整,可能代表中國AI產業從低價競爭轉向追求盈利與可持續發展。未來競爭焦點將從價格轉向模型效果與生態系統完整性,但漲價能否終結價格戰仍取決於市場供需與競爭對手反應。

49 分鐘前

狂攬130億!英偉達投的AI基建獨角獸又融資了

澳洲AI基礎設施獨角獸Firmus宣布完成20億美元(約136億人民幣)戰略股權融資,現有投資方英偉達與Coatue持續參投,並新增黑石旗下基金及Jane Street。該公司專注於設計、建設及營運AI工廠,核心產品HyperCube整合供電、液冷與伺服器機架,並提供GPU雲端算力服務。英偉達透過股權投資與技術合作,協助Firmus擴張亞太地區AI數據中心,同時擴大其晶片與計算架構的市場覆蓋。

53 分鐘前