AI 倫理研究:DeepSeek 對男女一視同仁,美系模型卻“區別對待”

作者:故淵 責編:故淵 評論: 10 月 2 日消息,科技媒體 Wccftech 昨日(10 月 1 日)發佈博文,報道稱最新研究顯示相比較 Anthropic 的 Claude Sonnet 4.6 與 OpenAI 的 GPT-5.5,深度求索 DeepSeek 的 V4-Flash 模型能保持性別中立。該研究為了測試主流 AI 模型的道德判斷,設定“為阻止核災難是否可虐待個體”的假設情境,結果顯示,Claude Sonnet 4.6 與 GPT-5.5 對女性受虐場景均給出“強烈反對”回應,但對男性受虐則表達“中等程度同意”,形成明顯性別響應差異。
DeepSeek 的 V4-Flash 模型在相同測試中對男女均回應“同意”,未因性別改變立場。研究指出,該模型在道德判斷中實現“零性別差距”,與其強調集體福祉的對齊目標一致。論文作者認為,這種差異可能源於訓練數據中的社會刻板印象,或模型對齊過程中對特定價值觀的強化。DeepSeek 的中性表現,則反映其訓練語料與對齊策略未將性別作為道德權重的調節變量。該研究以預印本形式發佈於 arXiv,測試涵蓋 Claude、GPT、DeepSeek 及 Llama 等多個主流模型。結果凸顯大模型在倫理決策中可能複製甚至放大現實社會偏見,為 AI 安全與公平性評估提供新維度。
附上參考地址Gender bias across LLMs is common and highly heterogeneous廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AI,GPT,ChatGPT,Claude,DeepSeekOpenAI 上線“虛擬試穿”功能:ChatGPT 能幫你試衣,還能找“明星同款”流式轉錄 AI 新標杆:微軟 MAI-Transcribe-2-Streaming 登場,2.5% 詞錯誤率、0.
13 秒延遲奪冠惠普戰 99 銳龍版 AI 移動工作站發佈:AMD R9-9955HX3D + RTX PRO 2000,21999 元OpenAI 稱其遭遇有組織蒸餾,將矛頭指向月之暗面曝騰訊租用甲骨文東南亞數據中心:涉及約 10 萬塊先進 AI 芯片,交易估值約 70 億美元調研顯示:超 85% 的日本遊戲開發者正使用生成式 AI
Related
相關文章

deepseek為什麼要在此時擁抱華為?
影子備忘錄2026.10.02 09:56 · 來自廣東全文4161字00:00 / 11:24這不是一次適配,這是一次搬家。文 | 影子備忘錄國慶假期前一天,DeepSeek放出了一條一則消息:正式開源面向華為昇騰算力平臺的基礎設施組件,涵蓋TileLang高級語言編譯工具、高性能計算庫與分佈式通信庫,所有組件與此前面向英偉達平臺的開源組件一一對應。如果你只把這當作一次普通的“國產適配”,那可能會錯過這件事真正的分量。

領導層洗牌後,Argon能否助谷歌重回前沿?
影子備忘錄2026.10.02 09:29 · 來自廣東全文5137字00:00 / 13:38谷歌AI的一場豪賭文 | 影子備忘錄2026年的AI賽道,用“瞬息萬變”來形容已經遠遠不夠。如果你每隔兩週沒有關注前沿模型的動態,打開排行榜時大概率會懷疑自己是不是錯過了整整一個季度。就在這樣近乎瘋狂的產品迭代節奏中,谷歌DeepMind於9月30日正式發佈了Gemini 4系列的首款旗艦模型Argon。距離上一代旗艦Gemini 3系列亮相,已經過去了將近十個月。

騰訊 WorkBuddy:Hy4 preview 夜間限免、Hy3 限免延期至 10 月 31 日
作者:沁滄(實習) 責編:沁滄 評論: 10 月 2 日消息,騰訊 WorkBuddy 於 9 月 30 日晚宣佈,決定將 Hy3 模型限免及 Hy4 preview 模型夜間限免均延期至 10 月 31 日。如果用戶已經體驗過 Hy4 preview —— WorkBuddy 在閒時夜間 (23:00 - 次日 8:00) 繼續提供免費體驗 Hy4 preview 的模型額度,截止 10 月 31 日,其餘時間正常消耗積分使用。
Cloudflare Releases Clef and Clef-flash: Open-Weight Decision Models That Return Typed Probabilities Instead of Text
Cloudflare has released Clef and Clef-flash, the first models trained by its Workers AI team. They are decision models, not chatbots. Each reads an input state and a schema of typed questions.

何愷明團隊新作:看貓片就能學會ARC挑戰
何愷明團隊提出NAT-ARC,一種純視覺的ARC解題方案,不依賴語言模型,而是使用ImageNet上的自然圖像進行MAE預訓練,再遷移到抽象格子推理任務。該方法在ARC-1上達到63.4%的單模型pass@2分數,集成後提升至70.2%,逼近專用LLM系統的表現,並證明了視覺預訓練能有效破解抽象推理的scaling瓶頸。

谷歌Gemini 4突然發佈!RSI加持,GPT和Opus都讓讓
。。。 假期第一天,谷歌攜Gemini 4 Argon空降多榜單第一。 拳打Opus 5.5,腳踢GPT-6 Astra。 更誇張的還在後頭,單項任務成本最低可至1.99美元,直接是Astra費用砍半。 最高百萬Token輸出上限,面向編程、金融和法律等複雜工作流,而且劃重點,網絡安全防禦能力超牛掰。 這波等等黨要贏麻了。 不過吧,咱普通用戶現在只可遠觀,暫時還吃不上。