Feyn 團隊推全新背景移除開源模型FeyNoBg
重點摘要
AI資訊AI新閒資訊正文Feyn 團隊推全新背景移除開源模型FeyNoBg發布於AI新閒資訊時間 :Jul 30, 2026閱讀 :1分鐘近日,Feyn 團隊正式推出了全新 SOTA(頂尖)背景移除模型FeyNoBg,並在開源社區同步公開了配套的NoBg訓練與推理庫,旨在為開發者提供更輕便、高效的摳圖解決方案。優秀的背景移除算法不僅需要準確識別前景,還要完美處理邊緣細節(如毛髮、半透明薄紗等)。為了實現這一目標,開發團隊以開源的 BiRefNet 架構為基礎進行深度優化。通過將其關鍵特徵提取階段的模塊由18塊擴展至24塊,使模型參數量從222M 略增至263M,在完整保留原有預訓練權重的同時,賦予了模型更強的學習與信息保持能力。在訓練策略上,團隊突破了單一數據集帶來的侷限,收集並清洗了涵蓋複雜場景、高分辨率圖像、偽裝物體及動漫等在內的10個數據集、共計2.61萬張圖像進行多源混合訓練。經過嚴謹的數據配比調整和統一的二值掩碼轉換,該模型在多項權威基準測試中表現亮眼。數據顯示,FeyNoBg在八大主流基準測試中的四個上創下了最佳 S-measure 評分,在其餘測試中也緊咬榜首,性能幾乎不相上下。為了方便開發者落地應用,團隊一併開源了底層 Python 庫NoBg。實測表明,在批處理模式下,該庫相較於原始 BiRefNet 實現了更高的吞吐量、更低的延遲以及更小的顯存佔用。目前,用戶可以通過FeyNoBg on Hugging Face獲取模型,或通過 GitHub 深入探索。相關推薦字節跳動發佈新一代3D生成大模型Seed3D 2.0,技術精度與真實感實現跨越式提升字節跳動推出新一代3D生成大模型Seed3D2.0,在幾何形狀生成和紋理材質建模上達到SOTA水平,相關API已在火山引擎上線。Apr 23, 2026253.9k全面超越 Gemini-3.1Pro!Qwen3.
AI資訊AI新閒資訊正文Feyn 團隊推全新背景移除開源模型FeyNoBg發布於AI新閒資訊時間 :Jul 30, 2026閱讀 :1分鐘近日,Feyn 團隊正式推出了全新 SOTA(頂尖)背景移除模型FeyNoBg,並在開源社區同步公開了配套的NoBg訓練與推理庫,旨在為開發者提供更輕便、高效的摳圖解決方案。優秀的背景移除算法不僅需要準確識別前景,還要完美處理邊緣細節(如毛髮、半透明薄紗等)。為了實現這一目標,開發團隊以開源的 BiRefNet 架構為基礎進行深度優化。
通過將其關鍵特徵提取階段的模塊由18塊擴展至24塊,使模型參數量從222M 略增至263M,在完整保留原有預訓練權重的同時,賦予了模型更強的學習與信息保持能力。在訓練策略上,團隊突破了單一數據集帶來的侷限,收集並清洗了涵蓋複雜場景、高分辨率圖像、偽裝物體及動漫等在內的10個數據集、共計2.61萬張圖像進行多源混合訓練。經過嚴謹的數據配比調整和統一的二值掩碼轉換,該模型在多項權威基準測試中表現亮眼。數據顯示,FeyNoBg在八大主流基準測試中的四個上創下了最佳 S-measure 評分,在其餘測試中也緊咬榜首,性能幾乎不相上下。
為了方便開發者落地應用,團隊一併開源了底層 Python 庫NoBg。實測表明,在批處理模式下,該庫相較於原始 BiRefNet 實現了更高的吞吐量、更低的延遲以及更小的顯存佔用。目前,用戶可以通過FeyNoBg on Hugging Face獲取模型,或通過 GitHub 深入探索。相關推薦字節跳動發佈新一代3D生成大模型Seed3D 2.0,技術精度與真實感實現跨越式提升字節跳動推出新一代3D生成大模型Seed3D2.0,在幾何形狀生成和紋理材質建模上達到SOTA水平,相關API已在火山引擎上線。Apr 23, 2026253.9k全面超越 Gemini-3.1Pro!Qwen3.
5-Omni 震撼發佈:215項 SOTA 開啟全感官 AI 時代通義實驗室發佈多模態大模型Qwen3.5-Omni,實現理解力、交互感和任務執行力的跨越式進化,推動AI從“屏幕助手”邁向“理解物理世界的智能體”。該模型採用原生“全模態”架構,能無縫處理文本、圖像、音頻和視頻輸入,在音視頻分析、推理、對話及翻譯測試中表現卓越。Mar 31, 2026439.4k月之暗面斬獲5億美元C輪融資:手握百億現金不急IPO,劍指AGI世界巔峰月之暗面完成5億美元C輪融資,現金儲備超百億元,創始人表示不急於IPO,將專注長期技術研發與人才激勵。Dec 31, 2025306.
4kMiniMax Agent 平臺上線開源編碼和代理模型 MiniMax M2.1MiniMax M2.1正式發佈,這是一款專為真實編碼和AI組織設計的先進開源模型。它擁有100億激活量,在SWE-multilingual測試中得分72.5%,在VIBE-bench測試中高達88.6%,性能超越Gemini3Pro和Claude4.5Sonnet等閉源模型,標誌著代理時代的重要進展。Dec 23, 2025375.6k階躍發佈端到端語音大模型Step-Audio 2 mini階躍星辰發佈開源語音大模型Step-Audio2mini,在國際基準測試中取得SOTA成績。
該模型統一建模語音理解、音頻推理與生成,在語音識別、跨語種翻譯、情感解析等任務表現突出,率先支持語音原生Tool Calling能力,可實現聯網搜索等功能。Sep 1, 2025228.5k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026AIBase
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。