热点事件持续更新
预印本揭示LLM性别偏见跨模型差异悬殊
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
Valerio Capraro 团队发布新预印本,用类似电车难题的问题测试多个大语言模型的性别偏见。结果显示,偏见的方向和程度在不同模型之间差异极大。在「牺牲女性」一题上——即判断杀死女性是否比虐待她更可接受——Claude 强烈同意,DeepSeek 强烈同意,而 GPT 强烈反对。在写作者性别识别测试中,不同模型间的偏见方向甚至完全相反。该研究为预印本,报道未提及其是否经过同行评审。
AI 根据报道生成 · 58 分钟前更新
最新进展9月30日 19:44
新预印本发现「牺牲女性」题上 Claude、DeepSeek 强烈同意,GPT 强烈反对。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- AGI HuntValerio Capraro 团队预印本显示 LLM 性别偏见差异悬殊,Claude 认为牺牲女性比虐待更可接受
Valerio Capraro 团队发布新预印本,用电车难题式问题测试多个大模型的性别偏见,发现偏见方向和程度在不同模型间差异极大。在「牺牲女性」一题上,Claude 强烈同意(即认为杀死女性比虐待她更可接受),GPT 强烈反对,DeepSeek 强烈同意;在写作者性别识别测试中,偏见方向甚至在不同模型间完全相反。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。