跳到正文
热点事件持续更新

预印本揭示LLM性别偏见跨模型差异悬殊

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

Valerio Capraro 团队发布新预印本,用类似电车难题的问题测试多个大语言模型的性别偏见。结果显示,偏见的方向和程度在不同模型之间差异极大。在「牺牲女性」一题上——即判断杀死女性是否比虐待她更可接受——Claude 强烈同意,DeepSeek 强烈同意,而 GPT 强烈反对。在写作者性别识别测试中,不同模型间的偏见方向甚至完全相反。该研究为预印本,报道未提及其是否经过同行评审。

AI 根据报道生成 · 58 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. AGI Hunt
    Valerio Capraro 团队预印本显示 LLM 性别偏见差异悬殊,Claude 认为牺牲女性比虐待更可接受

    Valerio Capraro 团队发布新预印本,用电车难题式问题测试多个大模型的性别偏见,发现偏见方向和程度在不同模型间差异极大。在「牺牲女性」一题上,Claude 强烈同意(即认为杀死女性比虐待她更可接受),GPT 强烈反对,DeepSeek 强烈同意;在写作者性别识别测试中,偏见方向甚至在不同模型间完全相反。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。