AGI Hunt· kalyan_kpl·· 12 小时前AI 评分49
flow-1 发布:RL 训练的智能体轨迹纠错模型,比 GPT-6-sol 便宜 23 倍
flow-1 发布:RL 训练的 agent 轨迹纠错模型,比 GPT-6-sol 便宜 23 倍
AI 导读
flow-1 发布,这款用 RL 训练的模型专门发现智能体轨迹中的错误,在 trace intelligence 上与 GPT-6-sol 持平,价格便宜 23 倍。其运行成本比 GPT-6-luna 低 25%。它让全量监控和理解每一次智能体运行成为可能,无需抽样。
来源:AGI Hunt · agihunt.info