跳到正文
原文
AGI Hunt· victormustar·· 3 小时前AI 评分53

开发者发布 Qwen3.8-27B-pi 微调模型,修复推理强度分级乱序

个人微调 Qwen3.8-27B:修复 low 推理反超 medium 的乱序问题

AI 导读

开发者 bytkim 发布 Qwen3.8-27B-pi,一个针对 Pi 编码 agent 场景微调的 Qwen3.8-27B 模型,起因是基座模型的 effort 分级失效,low 档推理 token 常比 medium 多,Terminal-Bench 2.1 上 medium 通过率甚至低于 low。

来源:AGI Hunt · agihunt.info