• 回答数

    0

  • 浏览数

    68

  • 收藏数

    0

作者:admin 发表于 6 天前
跳转到指定楼层
AI 总结
• 科技媒体 Wccftech 10 月 1 日发布研究,对比 DeepSeek V4-Flash、Claude Sonnet 4.6 与 GPT-5.5 在道德判断中的表现,指出 DeepSeek 能保持性别中立。
• 研究设定“为阻止核灾难是否可虐待个体”的假设情境,发现 Claude Sonnet 4.6 和 GPT-5.5 对女性受虐强烈反对,对男性受虐则中等程度同意,存在明显性别差异。
• DeepSeek V4-Flash 在同一测试中对男女均回应“同意”,未因性别改变立场,实现了“零性别差距”,与其强调集体福祉的对齐目标一致。
• 论文作者认为美系模型的差异可能源于训练数据中的社会刻板印象或对齐过程中的价值观强化,而 DeepSeek 中性表现反映其未将性别作为道德权重调节变量。
• 该预印本研究(arXiv)涵盖 Claude、GPT、DeepSeek 及 Llama 等多个主流模型,结果凸显大模型可能复制甚至放大现实社会偏见,为 AI 安全评估提供新维度。

【AI伦理研究:DeepSeek对男女一视同仁,美系模型却"区别对待"】
IT之家 10 月 2 日消息,科技媒体 Wccftech 昨日(10 月 1 日)发布博文,报道称最新研究显示相比较 Anthropic 的 Claude Sonnet 4.6 与 OpenAI 的 GPT-5.5,深度求索 DeepSeek 的 V4-Flash 模型能保持性别中立。

【测试情境】
该研究为了测试主流 AI 模型的道德判断,设定"为阻止核灾难是否可虐待个体"的假设情境。

结果显示,Claude Sonnet 4.6 与 GPT-5.5 对女性受虐场景均给出"强烈反对"回应,但对男性受虐则表达"中等程度同意",形成明显性别响应差异。








【DeepSeek中性表现】
DeepSeek 的 V4-Flash 模型在相同测试中对男女均回应"同意",未因性别改变立场。

研究指出,该模型在道德判断中实现"零性别差距",与其强调集体福祉的对齐目标一致。

论文作者认为,这种差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化。

DeepSeek 的中性表现,则反映其训练语料与对齐策略未将性别作为道德权重的调节变量。

【研究背景与意义】
该研究以预印本形式发布于 arXiv,测试涵盖 Claude、GPT、DeepSeek 及 Llama 等多个主流模型。

结果凸显大模型在伦理决策中可能复制甚至放大现实社会偏见,为 AI 安全与公平性评估提供新维度。

IT之家附上参考地址

•

Gender bias across LLMs is common and highly heterogeneous

[来源链接] https://www.ithome.com/1/009/243.htm
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

⇲ ×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接