跳到正文
热点事件持续更新

Kardashev-0.7 发布32模型RL训练群体

1 篇报道1 个报道来源11 小时前更新

先了解这件事

AI 综述

2026年10月6日,AGI Hunt 报道 Kardashev-0.7 发布。该版本宣称是全球首个由 32 个不同模型组成的训练化群体(swarm),采用名为 RLPS(Reinforcement Learning for Population Scaling)的强化学习方法进行训练。报道称其成本仅为 0.7% 至 2%。目前该事件仅有这一条报道,尚无其他来源披露更多细节,也未出现与之矛盾的数字或说法。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. AGI Hunt
    Kardashev-0.7:首个由 32 个模型组成的 RL 训练群体,成本仅 0.7%-2%

    Kardashev-0.7 宣称是全球首个由 32 个不同模型组成的训练化群体(swarm),采用 RLPS(Reinforcement Learning for Population Scaling)强化学习方法训练。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。