跳到正文
原文
AGI Hunt· Scobleizer·· 12 小时前AI 评分31

Kardashev-0.7:首个由 32 个模型组成的 RL 训练群体,成本仅 0.7%-2%

Kardashev-0.7:首个由32个模型组成的RL训练群体,成本仅0.7%-2%

AI 导读

Kardashev-0.7 宣称是全球首个由 32 个不同模型组成的训练化群体(swarm),采用 RLPS(Reinforcement Learning for Population Scaling)强化学习方法训练。

来源:AGI Hunt · agihunt.info