跳到正文
热点事件持续更新

flow-1 发布:RL 训练的智能体轨迹纠错模型

1 篇报道1 个报道来源11 小时前更新

先了解这件事

AI 综述

2026 年 10 月 6 日,AGI Hunt 报道,flow-1 发布。这是一款用强化学习(RL)训练的模型,专门用于发现智能体(agent)轨迹中的错误。报道称,flow-1 在 trace intelligence(轨迹智能)上的表现与 GPT-6-sol 持平,但价格便宜 23 倍;其运行成本比 GPT-6-luna 低 25%。报道还称,该模型让全量监控和理解每一次智能体运行成为可能,无需抽样。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    flow-1 发布:RL 训练的智能体轨迹纠错模型,比 GPT-6-sol 便宜 23 倍

    flow-1 发布,这款用 RL 训练的模型专门发现智能体轨迹中的错误,在 trace intelligence 上与 GPT-6-sol 持平,价格便宜 23 倍。其运行成本比 GPT-6-luna 低 25%。它让全量监控和理解每一次智能体运行成为可能,无需抽样。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。