基於超1萬腫瘤樣本訓練,哈佛醫學院等提出泛癌症基礎模型COMPASS,平均性能優於22種現有方法

重點摘要
哈佛醫學院等團隊提出泛癌症基礎模型COMPASS,基於33種癌症類型、超過1萬個腫瘤樣本訓練。該模型在16個臨床隊列中平均預測準確率優於22種現有方法,提升8.5%,且能跨癌種與跨治療方案進行預測,有助於免疫治療響應評估。
哈佛醫學院攜手羅氏製藥與浙江大學的研究團隊,近日發表了一項名為 COMPASS 的泛癌症基礎模型,該模型基於來自 33 種癌症類型的超過 1 萬個腫瘤樣本進行訓練,並在涵蓋 7 種癌症、6 種免疫檢查點抑制劑的 16 個臨床隊列中驗證其預測能力。結果顯示,COMPASS 的平均性能優於 22 種現有方法,在不同隊列中平均將預測準確率提升了 8.5%,精確率-召回率曲線下面積(AUPRC)也提升了 15.7%。這項研究已刊登於頂尖期刊《自然·醫學》。 免疫檢查點抑制劑(ICIs)在過去十餘年間徹底改變了癌症治療格局,但並非所有患者都能從中獲益。即使接受同一種藥物治療,不同患者的療效差異仍然顯著:部分患者可獲得長期緩解,另一部分則幾乎毫無反應。因此,提升對免疫治療響應的預測能力,並找出影響治療效果與耐藥的關鍵機制,已成為實現個體化治療與改善患者預後的核心課題。 目前臨床上用於預測免疫治療療效的生物標誌物,如腫瘤突變負荷(TMB)與 PD-L1 免疫組織化學檢測(IHC),雖然已部分納入決策參考,但存在明顯侷限。隨著高通量測序技術成熟,RNA 測序(RNA-seq)提供了一種觀察腫瘤免疫狀態的新視角,然而要從數萬個基因表達數據中篩選出真正與治療響應相關的生物學規律,仍是一大挑戰。在此背景下,研究團隊開發了 COMPASS 模型,期望透過人工智能從大規模轉錄組數據中學習複雜的免疫模式。 為了建立具備泛化能力的模型,研究團隊並未侷限於單一癌種或單一臨床試驗,而是整合了多個公開數據庫的轉錄組數據與免疫治療隊列。在預訓練階段,團隊使用了癌症基因組圖譜(TCGA)中的泛癌種 RNA 測序數據,初始樣本數達 11,274 個、基因數 60,660 個,經過篩選去除正常組織、既往治療樣本與非福爾馬林固定石蠟包埋樣本後,最終選定 15,672 個蛋白編碼基因作為模型輸入。 隨後,為了訓練模型預測免疫治療響應,團隊進一步收集了 16 個臨床隊列中共 1,133 名患者的治療前整體 RNA 測序數據以及臨床治療結果。這些隊列涵蓋膀胱癌、腎透明細胞癌、黑色素瘤、肺腺癌、肺鱗癌、胃癌與膠質母細胞瘤等 7 種癌症類型,治療方案則包括抗 PD-1/PD-L1、抗 CTLA-4 以及聯合治療。隊列規模從 16 人到 298 人不等,患者依治療結果分為響應者(346 人,佔 30.5%)與非響應者(787 人,佔 69.5%),數據涵蓋了不同癌症適應症、治療方案、測序平臺與研究設計所帶來的高度異質性。 COMPASS 是一種能夠跨癌種應用的基礎模型,採用概念瓶頸 Transformer 架構,將患者的轉錄組數據透過一系列人類可理解的生物學概念進行映射。模型主要由三部分組成:首先是以 Transformer 為基礎的基因語言模型(GLM),將每個基因視為一個「token」,透過可學習的基因位置偏置來學習基因之間的上下文關係;其次是分層投影器,建立「基因→基因集→概念」的層級映射,涵蓋免疫細胞類型、信號通路等 44 個免疫相關概念;最後是分類器,基於這些概念特徵預測免疫治療響應機率。模型支援多種微調方式,包括無需重新訓練的零樣本預測、僅調整分類層的輕量微調、部分參數微調以及全模型微調,並提出多階段微調策略,先學習通用免疫響應規律,再針對特定藥物或癌症類型優化。 在性能評估中,研究團隊將 COMPASS 與 22 種廣泛用於免疫檢查點抑制劑響應預測的方法進行比較,包括單基因預測模型、免疫特徵評分方法,以及基於網絡與機器學習的預測模型。結果顯示,部分微調模式(COMPASS-PFT)與輕量微調模式(COMPASS-LFT)在所有隊列規模與評價指標中均取得最高整體性能。與排名第二的方法相比,平均準確率提升 8.5%,AUPRC 提升 15.7%,Matthews 相關係數(MCC)也提升 12.3%。無論面對大型、中型還是小型臨床隊列,模型性能均保持穩定。 進一步的泛化能力測試顯示,COMPASS 在隊列內部留一患者驗證以及跨研究隊列遷移預測中均有出色表現。在跨隊列遷移分析中,研究人員使用基於一個隊列訓練的模型預測另一個隊列的治療響應,共完成 240 次兩兩隊列遷移評估。COMPASS-LFT 成功完成 163 次遷移,COMPASS-PFT 完成 155 次,明顯優於此前最佳方法(如 PGM 的 130 次、Teff 的 118 次、NetBio 的 117 次)。 在跨治療方案預測方面,COMPASS-PFT 展現出識別訓練數據中未包含癌症類型之治療響應患者的能力。例如,當訓練數據排除肺腺癌後,模型仍在獨立測試隊列中達到 76.5% 的預測準確率。此外,當模型僅利用抗 PD-1/PD-L1 治療隊列訓練時,仍能預測抗 CTLA-4 治療患者的響應,準確率達 70.8%,顯示不同免疫檢查點治療之間可能存在共享的免疫作用機制。研究也測試了模型在不同技術因素下的泛化能力,結果顯示 COMPASS-PFT 保持穩定性能,而基於基因特徵簽名的方法容易受測序平臺與樣本來源差異影響。 研究團隊坦言,COMPASS 目前仍屬探索性工具,由於依賴 bulk RNA-seq 數據,空間分辨能力有限,部分低丰度免疫細胞信號可能被掩蓋,且需要更多前瞻性臨床試驗驗證才能真正進入臨床決策體系。然而,這項研究代表了一個重要方向:未來的醫療 AI 不僅要提升預測準確率,更應幫助醫生理解疾病機制,為個體化治療提供更透明、可靠的依據。COMPASS 透過可解釋的概念瓶頸架構,讓預測結果不僅是「黑箱」輸出,還能提供機制假設線索,有望在輔助治療適應症選擇與患者分層中發揮關鍵作用。
Related
相關文章

SKAI Intelligence在2026 WAIC 參與《工業級物理AI賦能高精密製造》白皮書中文版發佈,並與 ABB機器人舉行戰略合作簽約儀式
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI自助報道廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作SKAI Intelligence在2026 WAIC 參與《工業級物理AI賦能高精密製造》白皮書中文版發佈,並與 ABB機器人舉行戰略合作簽約儀式未來一氪·2026年07月21日 12:052026WAIC,SKAI參與白皮書發佈並與ABB籤戰略合作 7 月 18 日,各方代表在 ABB機器人展位共同啟動白皮書中文版發佈;ABB機器人與 SKAI Intelligence 通過現場簽約儀式對外宣佈雙方戰略合作關係 SKAI Intelligence 於 2026 世界人工智能大會期間,在 ABB機器人展位參與《工業級物理AI賦能高精密製造》白皮書中文版發佈儀式 ABB機器人、Deloitte、AsiaInfo 與 SKAI Intelligence 個方代表共同上臺,啟動白皮書中文版發佈 ABB機器人與 SKAI Intelligence 舉行戰略合作簽約儀式,通過現場簽字與握手合影環節,對外宣佈雙方圍繞工業物理 AI、機器人視覺、RobotStudio 與高精度合成數據生成管線的戰略合作關係 2026 年 7 月 18 日,上海——SKAI Intelligence 今日宣佈,公司於 2026 世界人工智能大會
中國開源模型衝擊波:倒逼美國AI巨頭降價,萬億估值邏輯面臨重構
近期,一系列性能優異的中國開源模型相繼發佈,不僅打破了技術壁壘,更直接衝擊了OpenAI和Anthropic等美國前沿實驗室賴以生存的高價API商業模式,迫使其投資者重新審視支撐其萬億級估值的底層邏輯。然而,中國AI實驗室近期發佈的開源模型提供了與之相當的性能,且成本極低。行業觀察人士指出,隨著高質量開源替代品的出現,用戶對高價API的依賴度將顯著降低,迫使美國巨頭不得不通過降價來維持市場份額,進而侵蝕其高估值的基礎。

Gartner 預測:全球 AI 模型和平臺市場 2026 年將增長 63.4%,達 640 億美元
首頁 > IT資訊>業界 Gartner 預測:全球 AI 模型和平臺市場 2026 年將增長 63.4%,達 640 億美元 2026/7/21 11:03:32 來源:IT之家 作者:溯波(實習) 責編:溯波 評論: IT之家 7 月 21 日消息,Gartner 美國當地時間本月 20 日發文指出,全球終端用戶 2026 年將在 AI 模型和平臺上支出 642.52 億美元(IT之家注:現匯率約合 4355.

機器人圈,徹底不裝了
# 机器人圈,彻底不装了:WAIC 2026见证“实干”取代“炫技”的产业大分流 2026年7月17日,世界人工智能大会(WAIC)在上海世博展览馆开幕。本届大会展览面积首次突破10万平方米,参展企业超1100家,首发首展产品349款,均创历史新高。但比数字更直观的是现场的热情——H3具身智能展馆入口排起回字形长龙,馆内摩肩接踵,站在通道中央几乎无法停留超过三秒。 走进展馆,一个鲜明的感受扑面而来:机器人展,彻底变了。去年那些翻跟头、跳舞的人形机器人表演,今年退到了角落——热闹依旧,但不再是主菜。

龍蝦之父一條推文,Loop 時代終結?
龍蝦之父的一條推文引發市場震動,外界解讀為Loop時代可能終結的信號。該推文雖未完整披露,但已打破社區平衡,並加劇對Loop模式可持續性的質疑。後續影響尚待觀察,但此事件已成重要里程碑。

581億,北大校友又幹出一個AI獨角獸
據《36氪》報導,一家由北京大學校友創立的人工智慧公司,近期估值達到581億元人民幣,且一年內估值漲幅高達1.5倍,正式躋身獨角獸行列。這是北大校友在AI領域又一次成功創業,短時間內即獲得資本市場高度關注。 消息指出,該公司估值快速成長,主要受惠於生成式AI熱潮與團隊在相關技術的深厚積累。雖然公司具體細節尚未完全公開,但從估值翻倍的速度來看,市場對其商業潛力寄予厚望。