AGI Hunt· lbgos_Loss783·· 4 小时前AI 评分42
自建网安基准:Qwen3.8 27B 本地跑仅 28%,GPT-6 Luna 达 91%
自建网安基准:Qwen3.8 27B 本地跑仅 28%,GPT-6 Luna 达 91%
AI 导读
Reddit 用户 lbgosLoss783 自建网攻能力基准 rangebench,覆盖 pwn、web、crypto、逆向、取证等,共 19 个任务、6 个模型、544 次评分尝试。
来源:AGI Hunt · agihunt.info