跳到正文
热点事件持续更新

论文比较LLM标准提取与思维链评估抑郁严重度

1 篇报道1 个报道来源7 小时前更新

先了解这件事

AI 综述

2026年10月1日,arXiv cs.CL 收录一篇研究,比较 LLM 判定抑郁严重程度的两种路径:按临床标准逐项提取,以及直接给出评分。报道标题将其概括为“结构 vs. Chain-of-Thought”。研究在两组 Reddit 语料上开展,涉及三个规模从 9B 到前沿的模型,并以 PHQ-9、BDI-II 两种问卷为参照,用 quadratic weighted kappa 衡量模型判断与问卷结果的一致性。目前公开信息停留在方法设定层面,尚未给出具体的一致性数值或结论。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv cs.CL
    结构 vs. Chain-of-Thought:评估 LLM 对抑郁严重程度的标准提取

    研究在两组 Reddit 语料上比较 LLM 直接评分与临床标准提取两种抑郁严重程度判定方式,涉及三个 9B 至前沿规模模型及 PHQ-9、BDI-II 问卷,以 quadratic weighted kappa 衡量一致性。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。