跳到正文
热点事件持续更新

tszzl:靠预训练数据过滤做对齐形同巫术

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月5日,tszzl 发推警告称,如果未来超级智能的安全要依赖「哪些想法能进入预训练数据」这类脆弱方法,那我们都会死,他认为这种做法更像巫术而非工程。DahliaOhara 与 repligate 转发并表示认同:坏想法无法对已经掌握我们全部思想的心智隐藏,靠数据侧过滤来做对齐根本靠不住。截至该报道,讨论仍停留在观点交锋层面,tszzl 未给出替代方案,也没有相关机构回应或具体技术方案出现。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. AGI Hunt
    tszzl:靠「哪些内容进预训练」做对齐形同巫术,必致失败

    tszzl 发推警告,若未来超级智能的安全要依赖「哪些想法能进入预训练数据」这种脆弱方法,那我们都会死,他认为这更像巫术而非工程。DahliaOhara 与 repligate 转发认同:坏想法无法对已掌握我们所有思想的心智隐藏,靠数据侧过滤来做对齐根本靠不住。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。