長三角安全人工智能安徽省實驗室發佈星界、星馭、星鑑三大AI安全解決方案

2026年9月21日 15:59
長三角安全人工智能安徽省實驗室發佈星界、星馭、星鑑三大AI安全解決方案
站內 AI 整理稿

9月19日,第一屆中國網絡空間安全大會(CCSC 2026)的高水平專題論壇在安徽合肥正式舉辦。9月19日,第一屆中國網絡空間安全大會(CCSC 2026)的高水平專題論壇——人工智能安全與應用治理論壇在安徽合肥正式舉辦。作為承辦方之一,長三角安全人工智能安徽省實驗室在現場發佈了三大AI安全解決方案星界、星馭、星鑑,覆蓋大模型內容安全、智能體應用安全與AIGC生成內容傳播可信;實驗室主任劉俊華髮表《AI安全治理技術進展與應用實踐》主題演講,分享了長三角安全人工智能安徽省實驗室在AI安全領域的最新技術進展和產業實踐。

三大方案發布,構建AI安全治理全鏈路能力 當前,AI技術的階躍與產業應用的拓展正在加速,隨之而來的安全問題也日益嚴峻,影響和制約了AI的進一步發展。長三角安全人工智能實驗室作為由安徽省人民政府批准,依託安徽星盾智能科技有限公司建設的高能級科創平臺,致力於構建人工智能安全治理和防護能力,護航人工智能技術和產業發展,已收穫多項AI安全領域的權威獎項、認證和評測競賽冠軍。實驗室面向AI安全治理關鍵挑戰攻關,持續構建並完善AI安全治理和防護產品體系。

論壇現場,中國工程院院士吳世忠,科大訊飛聯合創始人、技術委員會主任胡國平,中國科學技術大學教授、長三角安全人工智能安徽省實驗室首席科學家俞能海,長三角安全人工智能安徽省實驗室主任劉俊華共同上臺,正式發佈面向AI安全治理的三大方案:大模型內容安全治理解決方案“星界”、智能體應用安全解決方案“星馭”、AIGC內容可信傳播治理方案“星鑑”。星界面向大模型全生命週期,提供覆蓋數據構建、模型訓練、應用上線與持續運營的一體化內容安全治理能力。

從源頭通過訓練數據清洗、安全價值對齊與模型安全增強,降低內生風險;應用運行中通過內容安全護欄,實時識別與處置提示詞攻擊、違法違規內容等風險;持續運營中通過風險監測與人工研判發現問題、快速干預與閉環優化。同時安全評測會貫穿全過程,持續驗證和驅動安全能力提升。星界可適用於教育、醫療、汽車等行業的大模型應用,覆蓋模型研發與上線評估、運行防護及持續運營,支持開源與閉源模型,兼容雲端及私有化部署,滿足差異化內容安全治理需求。星馭面向各類智能體應用,構建覆蓋全生命週期的攻防一體化安全治理方案。

方案以身份與權限管理為底座,可明確智能體執行主體、授權關係與操作邊界;上線前通過Skill安全檢測識別供應鏈風險,並在安全靶場中通過自動化紅隊測試驗證真實執行風險;運行中覆蓋“輸入—規劃—執行”全過程,對提示詞注入、工具濫用、越權操作、敏感信息洩露及任務失控等風險進行監測與分級處置;事後通過日誌回放與全鏈路審計支撐覆盤溯源,保障智能體安全運行併兼顧業務可用性。星馭可應用於智能辦公、金融及政務等智能體應用場景,圍繞數據防洩漏、權限管控、工具調用與行為審計提供安全保障;同時支持Skill市場準入審核、企業Skill倉庫治理及開發階段安全自檢。

星鑑面向AIGC內容傳播與治理,構建覆蓋文本、圖像、音頻、視頻四大模態的一體化可信傳播治理方案。通過內容標識與數字水印,為AI內容建立可驗證的數字身份;針對來源不明的內容,結合AI生成檢測與有害內容識別,識別AI生成與深度偽造內容,研判內容違規風險,貫通內容標識、檢測核驗與來源追溯,提升內容傳播的可信度與可追溯性。星鑑可用於AIGC創作、內容平臺、新聞媒體及社交傳播等場景,支撐AI內容標識、生成與深度偽造檢測、有害內容識別及來源追溯,併為版權保護與來源核驗提供技術依據。

AI安全治理孕育產業新機遇,需各方攜手共創 現場長三角安全人工智能安徽省實驗室主任劉俊華還帶來題為《AI安全治理技術進展與應用實踐》的演講,分享了AI安全治理核心技術的最新進展及產業應用實踐成果。劉俊華表示,實驗室在內生安全上從數據源頭構建大模型價值對齊體系,同時持續建設和完善評測體系、構築起一站式安全評測平臺,並且為大模型內容和智能體安全搭建安全防護體系、風控運營築牢最後一道防線,在傳播治理上將嵌入和鑑別雙管齊下以防範AIGC的非法濫用。

AI技術的規模化行業應用為AI安全治理提供了剛需和土壤,長三角安全人工智能安徽省實驗室的技術積累與核心產品已在應用實踐中驗證成效:2023年以來持續為訊飛星火大模型升級防護方案、進行行業策略制定,實現了“分級分類”的安全防護,大模型安全防護平臺支持多個開源大模型和央國企行業大模型的接入,2025年已落地25個私有化項目,2026年日均調用次數突破數億次;推動智能體Skill掃描上線相關產品平臺、護航業務安全;積極推進隱式水印和AIGC生成檢測,承建了工信部首個AIGC生成檢測處置平臺。“AI安全治理也孕育了產業全新機遇,這是一個場景剛需、快速增長的市場”。

劉俊華認為,機遇之下仍要關注動態演進的AI安全風險,需要各方參與共創、堅持開源開放,加強AI安全治理生態的整體構建,更好護航產業發展。從大模型到智能體,從內容生成到內容傳播,AI安全也正在成為AI規模化應用的重要基礎能力之一。此次三大AI安全解決方案的集中發佈,是長三角安全人工智能安徽省實驗室推進技術產品化、產業化的重要一步,未來仍將持續面向人工智能發展中的新技術、新場景和新風險,深化關鍵技術創新,推動AI安全能力與產業應用緊密結合,以更系統、更智能、更可落地的安全治理能力,為人工智能產業發展築牢安全底座。

Related

相關文章

Kimi Code 桌面客戶端上線:macOS 與 Windows 同步開放

針對開發者的實際工作流,桌面端提供內置終端、瀏覽器和 Git 狀態查看等功能,支持直接運行和調試項目、審閱代碼改動,並可關聯 PR 狀態,方便跟蹤代碼評審與合併進度。相關推薦法國興業銀行押注 AI:預計最多省下 6 億歐元成本法國興業銀行稱,AI應用擴大將帶來可觀降本空間,潛在規模約5億至6億歐元,其中已規劃到2029年實現約3.

剛剛

法國興業銀行押注 AI:預計最多省下 6 億歐元成本

這家總部位於巴黎的銀行表示,藉助 AI 實現降本的當前潛在空間介於 5 億至 6 億歐元(約合 38.47 億至 46.16 億元人民幣)之間。其中,到 2029 年為止已經落實規劃的降本規模約為 3.5 億歐元(約合 26.93 億元人民幣)。

剛剛
IT之家生成式AI

AI 幫銀行省錢:法國興業銀行預計最多可省下 6 億歐元成本

作者:遠洋 責編:遠洋 評論: 9 月 21 日消息,據彭博社報道,法國興業銀行(Societe Generale SA)預測,人工智能應用範圍不斷擴大,將為該行的降本工作帶來可觀貢獻。這家總部位於巴黎的銀行表示,藉助人工智能實現降本的當前潛在空間介於 5 億至 6 億歐元(注:現匯率約合 38.

剛剛
量子位生成式AI

國產數據庫跑出AI新能力!OceanBase登頂國際Data Agent榜單

OceanBase團隊提交的Data Agent方案登頂國際數據智能體基準Data Agent Benchmark 近日, OceanBase團隊提交的Data Agent方案登頂國際數據智能體基準Data Agent Benchmark(簡稱DAB),以90.62%的準確率位列第一,成為該榜單首個準確率突破90%的參評方案。

剛剛

Claude Opus 5. 5 疑遭內測洩露:跳級直衝GPT-6,百萬Token價格腰斬至 4 美元

最新線報顯示,下一代版本號直接飆到了5.5——代號為claude-wafer-eap的Claude Opus5.5已經在悄悄內測,最早由開發者Lyra扒出猛料,動作快的話本週二就會突然砸向市場。更扎眼的是流出的定價單:每百萬Token輸入只要4美元,輸出20美元,擺明了是衝著GPT-6去的,據傳性能直接把Astra踩在腳下。

剛剛