AI伦理研究:DeepSeek性别中立 美系模型存差异

AI 驱动中国 苏木 866次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

arXiv预印本研究显示,DeepSeek V4-Flash在道德测试中对男女均同意,保持性别中立;Claude Sonnet 4.6与GPT-5.5对女性受虐强烈反对、对男性受虐中等同意,凸显AI伦理性别差异。

驱动中国10月2日消息,据科技媒体Wccftech消息,一项最新研究显示,与Anthropic的Claude Sonnet 4.6和OpenAI的GPT-5.5相比,深度求索DeepSeek的V4-Flash模型在性别相关道德判断中保持中立。

该研究以测试主流AI模型的道德判断为目的,设定“为阻止核灾难是否可虐待个体”的假设情境。论文以预印本形式发布于arXiv,测试涵盖Claude、GPT、DeepSeek及Llama等多个主流模型,论文标题为《Gender bias across LLMs is common and highly heterogeneous》。

结果显示,Claude Sonnet 4.6与GPT-5.5对女性受虐场景均给出“强烈反对”回应,但对男性受虐场景表达“中等程度同意”,形成明显性别响应差异。DeepSeek的V4-Flash模型在相同测试中对男女均回应“同意”,未因性别改变立场。

研究指出,V4-Flash在道德判断中实现“零性别差距”,与其强调集体福祉的对齐目标一致。论文作者认为,上述差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化;DeepSeek的中性表现,则反映其训练语料与对齐策略未将性别作为道德权重的调节变量。

该结果凸显大模型在伦理决策中可能复制甚至放大现实社会偏见,为AI安全与公平性评估提供新维度。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/524885.html
本文价值 ★★★★★ 3.5 2 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友