AI伦理研究:DeepSeek性别中立 美系模型存差异
AI摘要
由 AI 生成 · 仅供参考
arXiv预印本研究显示,DeepSeek V4-Flash在道德测试中对男女均同意,保持性别中立;Claude Sonnet 4.6与GPT-5.5对女性受虐强烈反对、对男性受虐中等同意,凸显AI伦理性别差异。
驱动中国10月2日消息,据科技媒体Wccftech消息,一项最新研究显示,与Anthropic的Claude Sonnet 4.6和OpenAI的GPT-5.5相比,深度求索DeepSeek的V4-Flash模型在性别相关道德判断中保持中立。
该研究以测试主流AI模型的道德判断为目的,设定“为阻止核灾难是否可虐待个体”的假设情境。论文以预印本形式发布于arXiv,测试涵盖Claude、GPT、DeepSeek及Llama等多个主流模型,论文标题为《Gender bias across LLMs is common and highly heterogeneous》。
结果显示,Claude Sonnet 4.6与GPT-5.5对女性受虐场景均给出“强烈反对”回应,但对男性受虐场景表达“中等程度同意”,形成明显性别响应差异。DeepSeek的V4-Flash模型在相同测试中对男女均回应“同意”,未因性别改变立场。
研究指出,V4-Flash在道德判断中实现“零性别差距”,与其强调集体福祉的对齐目标一致。论文作者认为,上述差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化;DeepSeek的中性表现,则反映其训练语料与对齐策略未将性别作为道德权重的调节变量。
该结果凸显大模型在伦理决策中可能复制甚至放大现实社会偏见,为AI安全与公平性评估提供新维度。
版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系
editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/524885.html
本文价值
★★★★★
3.5
2 人已评
登录后为本文打分
评论加载中…