跳到正文
原文
AGI Hunt· lbgos_Loss783·· 4 小时前AI 评分42

自建网安基准:Qwen3.8 27B 本地跑仅 28%,GPT-6 Luna 达 91%

自建网安基准:Qwen3.8 27B 本地跑仅 28%,GPT-6 Luna 达 91%

AI 导读

Reddit 用户 lbgosLoss783 自建网攻能力基准 rangebench,覆盖 pwn、web、crypto、逆向、取证等,共 19 个任务、6 个模型、544 次评分尝试。

来源:AGI Hunt · agihunt.info